Het private AI-platform voor teams. Eén server draait de modellen — elke app en elk apparaat gebruikt ze gewoon. AI Server levert chat, embeddings, beeldgeneratie, spraak en vision vanaf je eigen hardware, via OpenAI-compatibele API's, aan de hele AI Suite en aan elk compatibel hulpmiddel.
Begin gratis op je eigen machine. Als je team groeit, bedien je je netwerk; als één machine niet genoeg is, maakt de AI Gateway-modus van meerdere servers één load-balanced eindpunt — op je LAN, in Docker of op Kubernetes. Op geen enkel moment een cloud van een leverancier in het datapad.
Download in de Microsoft Store Zie wat het doet ↓ Licenties & prijzen
Zonder server downloadt elke pc zijn eigen modellen, heeft zijn eigen GPU nodig en wordt afzonderlijk geconfigureerd en bijgewerkt. Met AI Server worden modellen één keer gedownload, draaien ze op de beste hardware die je hebt en bedienen ze iedereen.
OpenAI-compatibele eindpunten voor chat, embeddings, beeldgeneratie, spraak-naar-tekst (inclusief live streaming), tekst-naar-spraak, stemklonen en vision — alles geleverd vanaf je eigen hardware. Richt er elk compatibel hulpmiddel of je eigen code op.
Elke AI Suite-app ontdekt de server en besteedt zijn AI-werk eraan uit — zonder enige configuratie. Notities, pdf's, vertaling, dictaat, afbeeldingen, e-mail en meer, allemaal met één set modellen op één machine.
API-sleutels met plannen per sleutel, snelheidslimieten, quota's en budgetten, gebruiksanalyses per app en model, en inhoudsvrije auditlogboeken met ondertekende export. De controles die IT verwacht, zonder een cloudleverancier ertussen.
Zet één schakelaar om en meerdere servers worden één eindpunt: load balancing met gezondheidscontroles, modelbewuste routering die machines verkiest waar het model al warm is, canary-uitrol en upgrades zonder downtime.
Een desktop-app voor de machine onder het bureau; containers, Kubernetes-manifests en een Helm-chart voor het rack of de cloud. Zelfde product, zelfde API's, zelfde licentie — van één laptop tot een GPU-farm.
Elke server host zijn eigen live dashboard en native Prometheus-metrics: gezondheid van de vloot, latentie, gebruik en capaciteit in één oogopslag — zonder extra monitoringstack om te beginnen.
AI Gateway is AI Server in zijn farm-frontendmodus. Clients maken er verbinding mee precies alsof het één AI Server is; erachter doet een pool van worker-servers het eigenlijke inferentiewerk. Voeg een machine toe en de capaciteit groeit; haal er een weg voor onderhoud en het verkeer wordt soepel afgevoerd — niemands verzoek wordt gedropt.
Op Kubernetes worden workers automatisch ontdekt naarmate ze schalen, zodat een automatisch schalende farm geen handmatige poolaanpassingen nodig heeft. De hele omgeving blijft observeerbaar vanuit het ingebouwde dashboard en Prometheus-metrics.
Het gratis niveau is een echt product, geen proefversie: een volledige lokale AI-server voor alle AI Suite-apps op je eigen machine, voor altijd. Betaalde niveaus beginnen precies waar de waarde de grenzen van een machine overschrijdt.
Een volledige lokale AI-server op je eigen machine. Onbeperkt gebruik door elke AI Suite-app op die machine; generieke OpenAI-compatibele clients zijn snelheidsbeperkt.
Bedien je eigen apparaten over je netwerk: LAN-serving, draaien als een OS-service, API-sleutels voor je laptop en telefoon, onbeperkte generieke clients en een kleine gateway-pool.
Bedien anderen: commercieel gebruik, onbeperkte API-sleutels, volledige governance (quota's, budgetten, audit-ondertekening) en een productie-gatewayfarm met canary-uitrol en automatische worker-ontdekking.
Onbeperkte omgevingen, organisatie-inschrijving met AI Admin Console, offline en air-gapped gebruik, en prioriteitsondersteuning. Gelicentieerd per omgeving — neem contact met ons op.
Installeer de app gratis vanuit de bijbehorende marktplaats. Een rechtstreeks Personal- of Commercial-abonnement bevat één productsleutel die op elk ondersteund platform werkt.
Centraliseer kostbare modellen en governance terwijl teams vertrouwde apps en OpenAI-compatibele tools blijven gebruiken.
Deel goedgekeurde chat-, vertaal-, herschrijf-, document-RAG-, beeld- en spraakmodellen vanaf één beheerde machine in plaats van elke werkplek.
Implementatiepatroon lezen →Geef juridische, zorg-, financiële, overheids- en onderzoeksteams AI terwijl prompts, bestanden, modeltoegang en audit binnen de gekozen grens blijven.
Implementatiepatroon lezen →Verbind OpenAI-compatibele apps, agents en CI-evaluatie met een intern endpoint. Platformteams beheren modellen en capaciteit zonder vendorsleutel per project.
Implementatiepatroon lezen →Plaats AI Gateway voor verspreide workers voor statusroutering, warm-model-affiniteit, rollend onderhoud en groei zonder clientherconfiguratie.
Implementatiepatroon lezen →Bewijs nuttig werk en de privacygrens op één machine voordat u gebruikers, beleid of een serverfarm toevoegt.
Kies één begrensde taak, zoals privéchat, vragen over documenten, vertaling of transcriptie, plus de mensen die deze beoordelen.
Kies model en machine voor de verwachte context, reactietijd en gelijktijdige gebruikers. Valideer eerst op CPU of voeg GPU-capaciteit toe wanneer nodig.
Bevestig welke clients, modellen, logboeken en netwerkroutes zijn toegestaan. Houd prompts en bestanden binnen de gekozen grens.
Ga naar netwerkbediening, API-sleutels en quota en registreer de omgeving daarna in AI Admin Console of voeg AI Gateway-workers toe wanneer de vraag dat rechtvaardigt.
AI Server is als gratis/BYOL Kubernetes-app beschikbaar in Microsoft Marketplace en AWS Marketplace. Uw provider factureert de cloudinfrastructuur; dezelfde AI Server Commercial- of Enterprise-licentie activeert gateway en workers.
Installeer de gecertificeerde Kubernetes-app in een bestaand AKS-cluster. Begin met een CPU-node voor validatie en voeg NVIDIA GPU-workers toe voor echte inferentieworkloads.
Zoek in Microsoft MarketplaceImplementeer het Helm-pakket uit AWS Marketplace op Amazon EKS. Een kleine pool systeemnodes en aparte GPU-workers houden clusterdiensten stabiel en maken schalen eenvoudig.
Zoek in AWS MarketplaceAI Server is geen proxy naar een cloud-API. De modellen draaien op je hardware; verzoeken reizen van je apps naar je server en terug, binnen je perimeter. Offline en air-gapped gebruik zijn ondersteunde implementatiemodi, geen speciale uitzonderingen.
Voor hulp bij implementatie, adviezen over sizing, Kubernetes-vragen of licenties, schrijf naar [email protected] — of gebruik het contactformulier en kies "Product".