La piattaforma di IA privata per i team. Un server esegue i modelli — ogni app e ogni dispositivo li usa e basta. AI Server offre chat, embedding, generazione di immagini, voce e visione dal tuo hardware, tramite API compatibili con OpenAI, a tutta l'AI Suite e a qualsiasi strumento compatibile.
Inizia gratis sulla tua macchina. Quando il team cresce, servi la tua rete; quando una macchina non basta, la modalità AI Gateway trasforma più server in un unico endpoint con bilanciamento del carico — sulla tua LAN, in Docker o su Kubernetes. Nessun cloud di fornitori nel percorso dei dati, in nessun momento.
Scaricalo dal Microsoft Store Guarda cosa fa ↓ Licenze e prezzi
Senza un server, ogni PC scarica i propri modelli, richiede la propria GPU e va configurato e aggiornato separatamente. Con AI Server i modelli si scaricano una volta sola, girano sul miglior hardware che hai e servono tutti.
Endpoint compatibili con OpenAI per chat, embedding, generazione di immagini, riconoscimento vocale (incluso lo streaming in tempo reale), sintesi vocale, clonazione della voce e visione — tutto servito dal tuo hardware. Puntaci qualsiasi strumento compatibile o il tuo codice.
Ogni app dell'AI Suite individua il server e gli delega il proprio lavoro di IA — senza alcuna configurazione. Note, PDF, traduzione, dettatura, immagini, e-mail e altro, tutto condividendo un unico set di modelli su una sola macchina.
Chiavi API con piani per chiave, limiti di frequenza, quote e budget, analisi d'uso per app e modello e registri di audit privi di contenuti con esportazione firmata. I controlli che l'IT si aspetta, senza un fornitore cloud di mezzo.
Basta un interruttore e più server diventano un unico endpoint: bilanciamento del carico con controllo dello stato, routing consapevole del modello che preferisce le macchine che lo hanno già caricato, rilasci canary e aggiornamenti senza tempi di inattività.
Un'app desktop per la macchina sotto la scrivania; container, manifest Kubernetes e un chart Helm per il rack o il cloud. Stesso prodotto, stesse API, stessa licenza — da un portatile a una farm di GPU.
Ogni server ospita la propria dashboard in tempo reale e metriche Prometheus native: salute della flotta, latenza, utilizzo e capacità a colpo d'occhio — senza uno stack di monitoraggio aggiuntivo per iniziare.
AI Gateway è AI Server eseguito nella sua modalità front-end di farm. I client vi si connettono esattamente come se fosse un singolo AI Server; dietro, un pool di server di lavoro (worker) esegue l'inferenza vera e propria. Aggiungi una macchina e la capacità cresce; togline una per la manutenzione e il traffico defluisce con dolcezza — nessuna richiesta viene persa.
Su Kubernetes i worker vengono individuati automaticamente man mano che scalano, così una farm con scalabilità automatica non richiede modifiche manuali al pool. L'intero parco resta osservabile dalla dashboard integrata e dalle metriche Prometheus.
Il livello gratuito è un prodotto vero, non una prova: un server di IA locale completo per tutte le app dell'AI Suite sulla tua macchina, per sempre. I livelli a pagamento iniziano esattamente dove il valore supera i confini di una macchina.
Un server di IA locale completo sulla tua macchina. Uso illimitato da parte di ogni app dell'AI Suite su quella macchina; i client generici compatibili con OpenAI hanno un limite di frequenza.
Servi i tuoi dispositivi sulla tua rete: distribuzione su LAN, esecuzione come servizio del sistema, chiavi API per portatile e telefono, client generici illimitati e un piccolo pool di gateway.
Servi altre persone: uso commerciale, chiavi API illimitate, governance completa (quote, budget, firma di audit) e una farm di gateway di produzione con rilasci canary e individuazione automatica dei worker.
Parchi illimitati, arruolamento dell'organizzazione con AI Admin Console, funzionamento offline e air-gapped e supporto prioritario. Licenza per parco — parliamone.
AI Server non è un proxy verso un'API cloud. I modelli girano sul tuo hardware; le richieste viaggiano dalle tue app al tuo server e ritorno, dentro il tuo perimetro. Il funzionamento offline e air-gapped sono modalità di distribuzione supportate, non eccezioni speciali.
Per aiuto sulla distribuzione, consigli di dimensionamento, domande su Kubernetes o licenze, scrivi a [email protected] — oppure usa il modulo di contatto e scegli "Prodotto".