Den privata AI-plattformen för team. En server kör modellerna — varje app och varje enhet använder dem bara. AI Server tillhandahåller chatt, embeddningar, bildgenerering, tal och vision från din egen hårdvara, via OpenAI-kompatibla API:er, till hela AI Suite och till valfritt kompatibelt verktyg.
Börja gratis på din egen dator. När teamet växer betjänar du ditt nätverk; när en dator inte räcker gör läget AI Gateway flera servrar till en enda lastbalanserad slutpunkt — i ditt LAN, i Docker eller på Kubernetes. Ingen leverantörsmoln i datavägen i något steg.
Hämta i Microsoft Store Se vad den gör ↓ Licensiering & priser
Utan en server laddar varje dator ner sina egna modeller, behöver sin egen GPU och konfigureras och uppdateras separat. Med AI Server laddas modeller ner en gång, körs på den bästa hårdvara du har och betjänar alla.
OpenAI-kompatibla slutpunkter för chatt, embeddningar, bildgenerering, tal-till-text (inklusive direktströmning), text-till-tal, röstkloning och vision — allt levererat från din hårdvara. Rikta valfritt kompatibelt verktyg eller din egen kod mot den.
Varje AI Suite-app upptäcker servern och lämnar över sitt AI-arbete till den — helt utan konfiguration. Anteckningar, PDF:er, översättning, diktering, bilder, e-post och mer, alla delar en enda uppsättning modeller på en dator.
API-nycklar med planer per nyckel, hastighetsgränser, kvoter och budgetar, användningsanalys per app och modell, samt innehållsfria granskningsloggar med signerad export. Kontrollerna som IT förväntar sig, utan en molnleverantör inblandad.
Slå på en brytare så blir flera servrar en enda slutpunkt: hälsokontrollerad lastbalansering, modellmedveten routning som föredrar maskiner där modellen redan är varm, canary-lanseringar och uppgraderingar utan driftstopp.
En skrivbordsapp för datorn under skrivbordet; containrar, Kubernetes-manifest och ett Helm-diagram för racket eller molnet. Samma produkt, samma API:er, samma licens — från en bärbar dator till en GPU-farm.
Varje server har sin egen liveinstrumentpanel och inbyggda Prometheus-mätvärden: flottans hälsa, latens, användning och kapacitet i ett ögonkast — utan en extra övervakningsstack för att komma igång.
AI Gateway är AI Server som körs i sitt farm-frontend-läge. Klienter ansluter till den precis som om den vore en enda AI Server; bakom den utför en pool av arbetarservrar (workers) själva inferensen. Lägg till en maskin så växer kapaciteten; ta ner en för underhåll och trafiken dräneras mjukt — ingens begäran släpps.
På Kubernetes upptäcks workers automatiskt när de skalar, så en autoskalande farm behöver inga manuella pooländringar. Hela beståndet förblir observerbart från den inbyggda instrumentpanelen och Prometheus-mätvärdena.
Gratisnivån är en riktig produkt, inte en testversion: en fullständig lokal AI-server för alla AI Suite-appar på din egen dator, för alltid. Betalda nivåer börjar precis där värdet korsar maskingränser.
En fullständig lokal AI-server på din egen dator. Obegränsad användning av varje AI Suite-app på den datorn; generiska OpenAI-kompatibla klienter är hastighetsbegränsade.
Betjäna dina egna enheter över ditt nätverk: LAN-servering, körning som en OS-tjänst, API-nycklar för din bärbara dator och telefon, obegränsade generiska klienter och en liten gateway-pool.
Betjäna andra: kommersiell användning, obegränsade API-nycklar, fullständig styrning (kvoter, budgetar, granskningssignering) och en produktions-gatewayfarm med canary-lanseringar och automatisk workerupptäckt.
Obegränsade miljöer, organisationsregistrering med AI Admin Console, offline- och luftgapad drift samt prioriterad support. Licensierad per miljö — prata med oss.
Installera appen kostnadsfritt från dess marknadsplats. En direkt Personal- eller Commercial-prenumeration innehåller en produktnyckel som fungerar på alla plattformar som stöds.
Centralisera dyra modeller och styrning medan teamen behåller bekanta appar och OpenAI-kompatibla verktyg.
Dela godkända modeller för chatt, översättning, omskrivning, dokument-RAG, bild och tal från en hanterad maskin i stället för varje arbetsstation.
Läs distributionsmönstret →Ge juridik, vård, finans, offentlig sektor och forskning AI medan promptar, filer, modellåtkomst och revision stannar inom vald gräns.
Läs distributionsmönstret →Anslut OpenAI-kompatibla appar, agenter och CI-utvärdering till en intern endpoint. Plattformsteamet styr modeller och kapacitet utan leverantörsnyckel per projekt.
Läs distributionsmönstret →Placera AI Gateway framför distribuerade workers för hälsobaserad routning, varm modellaffinitet, rullande underhåll och skalning utan klientändring.
Läs distributionsmönstret →Bevisa nyttan och integritetsgränsen på en maskin innan du lägger till användare, policyer eller en serverfarm.
Välj en avgränsad uppgift, till exempel privat chatt, dokumentfrågor, översättning eller transkribering, och personerna som ska utvärdera den.
Välj modell och maskin för förväntad kontext, svarstid och samtidiga användare. Validera först på CPU eller lägg till GPU-kapacitet när arbetslasten kräver det.
Bekräfta vilka klienter, modeller, loggar och nätverksvägar som tillåts. Håll instruktioner och filer inom den valda gränsen.
Gå vidare till nätverksservering, API-nycklar och kvoter. Registrera sedan miljön i AI Admin Console eller lägg till AI Gateway-workers när efterfrågan motiverar det.
AI Server finns som kostnadsfri/BYOL Kubernetes-app i Microsoft Marketplace och AWS Marketplace. Molninfrastrukturen faktureras av leverantören; samma AI Server Commercial- eller Enterprise-licens aktiverar gateway och workers.
Installera den certifierade Kubernetes-appen i ett befintligt AKS-kluster. Börja med en CPU-nod för validering och lägg sedan till NVIDIA GPU-workers för verklig inferens.
Hitta i Microsoft MarketplaceDriftsätt Helm-paketet från AWS Marketplace på Amazon EKS. En liten pool systemnoder och separata GPU-workers håller tjänster stabila och gör skalning enkel.
Hitta i AWS MarketplaceAI Server är inte en proxy till ett moln-API. Modellerna körs på din hårdvara; begäranden färdas från dina appar till din server och tillbaka, inom din perimeter. Offline- och luftgapad drift är stödda distributionslägen, inte särskilda undantag.
För hjälp med distribution, råd om dimensionering, Kubernetes-frågor eller licensiering, skriv till [email protected] — eller använd kontaktformuläret och välj "Produkt".