Den privata AI-plattformen för team. En server kör modellerna — varje app och varje enhet använder dem bara. AI Server tillhandahåller chatt, embeddningar, bildgenerering, tal och vision från din egen hårdvara, via OpenAI-kompatibla API:er, till hela AI Suite och till valfritt kompatibelt verktyg.
Börja gratis på din egen dator. När teamet växer betjänar du ditt nätverk; när en dator inte räcker gör läget AI Gateway flera servrar till en enda lastbalanserad slutpunkt — i ditt LAN, i Docker eller på Kubernetes. Ingen leverantörsmoln i datavägen i något steg.
Hämta i Microsoft Store Se vad den gör ↓ Licensiering & priser
Utan en server laddar varje dator ner sina egna modeller, behöver sin egen GPU och konfigureras och uppdateras separat. Med AI Server laddas modeller ner en gång, körs på den bästa hårdvara du har och betjänar alla.
OpenAI-kompatibla slutpunkter för chatt, embeddningar, bildgenerering, tal-till-text (inklusive direktströmning), text-till-tal, röstkloning och vision — allt levererat från din hårdvara. Rikta valfritt kompatibelt verktyg eller din egen kod mot den.
Varje AI Suite-app upptäcker servern och lämnar över sitt AI-arbete till den — helt utan konfiguration. Anteckningar, PDF:er, översättning, diktering, bilder, e-post och mer, alla delar en enda uppsättning modeller på en dator.
API-nycklar med planer per nyckel, hastighetsgränser, kvoter och budgetar, användningsanalys per app och modell, samt innehållsfria granskningsloggar med signerad export. Kontrollerna som IT förväntar sig, utan en molnleverantör inblandad.
Slå på en brytare så blir flera servrar en enda slutpunkt: hälsokontrollerad lastbalansering, modellmedveten routning som föredrar maskiner där modellen redan är varm, canary-lanseringar och uppgraderingar utan driftstopp.
En skrivbordsapp för datorn under skrivbordet; containrar, Kubernetes-manifest och ett Helm-diagram för racket eller molnet. Samma produkt, samma API:er, samma licens — från en bärbar dator till en GPU-farm.
Varje server har sin egen liveinstrumentpanel och inbyggda Prometheus-mätvärden: flottans hälsa, latens, användning och kapacitet i ett ögonkast — utan en extra övervakningsstack för att komma igång.
AI Gateway är AI Server som körs i sitt farm-frontend-läge. Klienter ansluter till den precis som om den vore en enda AI Server; bakom den utför en pool av arbetarservrar (workers) själva inferensen. Lägg till en maskin så växer kapaciteten; ta ner en för underhåll och trafiken dräneras mjukt — ingens begäran släpps.
På Kubernetes upptäcks workers automatiskt när de skalar, så en autoskalande farm behöver inga manuella pooländringar. Hela beståndet förblir observerbart från den inbyggda instrumentpanelen och Prometheus-mätvärdena.
Gratisnivån är en riktig produkt, inte en testversion: en fullständig lokal AI-server för alla AI Suite-appar på din egen dator, för alltid. Betalda nivåer börjar precis där värdet korsar maskingränser.
En fullständig lokal AI-server på din egen dator. Obegränsad användning av varje AI Suite-app på den datorn; generiska OpenAI-kompatibla klienter är hastighetsbegränsade.
Betjäna dina egna enheter över ditt nätverk: LAN-servering, körning som en OS-tjänst, API-nycklar för din bärbara dator och telefon, obegränsade generiska klienter och en liten gateway-pool.
Betjäna andra: kommersiell användning, obegränsade API-nycklar, fullständig styrning (kvoter, budgetar, granskningssignering) och en produktions-gatewayfarm med canary-lanseringar och automatisk workerupptäckt.
Obegränsade miljöer, organisationsregistrering med AI Admin Console, offline- och luftgapad drift samt prioriterad support. Licensierad per miljö — prata med oss.
AI Server är inte en proxy till ett moln-API. Modellerna körs på din hårdvara; begäranden färdas från dina appar till din server och tillbaka, inom din perimeter. Offline- och luftgapad drift är stödda distributionslägen, inte särskilda undantag.
För hjälp med distribution, råd om dimensionering, Kubernetes-frågor eller licensiering, skriv till [email protected] — eller använd kontaktformuläret och välj "Produkt".