La piattaforma di IA privata per i team. Un server esegue i modelli — ogni app e ogni dispositivo li usa e basta. AI Server offre chat, embedding, generazione di immagini, voce e visione dal tuo hardware, tramite API compatibili con OpenAI, a tutta l'AI Suite e a qualsiasi strumento compatibile.
Inizia gratis sulla tua macchina. Quando il team cresce, servi la tua rete; quando una macchina non basta, la modalità AI Gateway trasforma più server in un unico endpoint con bilanciamento del carico — sulla tua LAN, in Docker o su Kubernetes. Nessun cloud di fornitori nel percorso dei dati, in nessun momento.
Scaricalo dal Microsoft Store Guarda cosa fa ↓ Licenze e prezzi
Senza un server, ogni PC scarica i propri modelli, richiede la propria GPU e va configurato e aggiornato separatamente. Con AI Server i modelli si scaricano una volta sola, girano sul miglior hardware che hai e servono tutti.
Endpoint compatibili con OpenAI per chat, embedding, generazione di immagini, riconoscimento vocale (incluso lo streaming in tempo reale), sintesi vocale, clonazione della voce e visione — tutto servito dal tuo hardware. Puntaci qualsiasi strumento compatibile o il tuo codice.
Ogni app dell'AI Suite individua il server e gli delega il proprio lavoro di IA — senza alcuna configurazione. Note, PDF, traduzione, dettatura, immagini, e-mail e altro, tutto condividendo un unico set di modelli su una sola macchina.
Chiavi API con piani per chiave, limiti di frequenza, quote e budget, analisi d'uso per app e modello e registri di audit privi di contenuti con esportazione firmata. I controlli che l'IT si aspetta, senza un fornitore cloud di mezzo.
Basta un interruttore e più server diventano un unico endpoint: bilanciamento del carico con controllo dello stato, routing consapevole del modello che preferisce le macchine che lo hanno già caricato, rilasci canary e aggiornamenti senza tempi di inattività.
Un'app desktop per la macchina sotto la scrivania; container, manifest Kubernetes e un chart Helm per il rack o il cloud. Stesso prodotto, stesse API, stessa licenza — da un portatile a una farm di GPU.
Ogni server ospita la propria dashboard in tempo reale e metriche Prometheus native: salute della flotta, latenza, utilizzo e capacità a colpo d'occhio — senza uno stack di monitoraggio aggiuntivo per iniziare.
AI Gateway è AI Server eseguito nella sua modalità front-end di farm. I client vi si connettono esattamente come se fosse un singolo AI Server; dietro, un pool di server di lavoro (worker) esegue l'inferenza vera e propria. Aggiungi una macchina e la capacità cresce; togline una per la manutenzione e il traffico defluisce con dolcezza — nessuna richiesta viene persa.
Su Kubernetes i worker vengono individuati automaticamente man mano che scalano, così una farm con scalabilità automatica non richiede modifiche manuali al pool. L'intero parco resta osservabile dalla dashboard integrata e dalle metriche Prometheus.
Il livello gratuito è un prodotto vero, non una prova: un server di IA locale completo per tutte le app dell'AI Suite sulla tua macchina, per sempre. I livelli a pagamento iniziano esattamente dove il valore supera i confini di una macchina.
Un server di IA locale completo sulla tua macchina. Uso illimitato da parte di ogni app dell'AI Suite su quella macchina; i client generici compatibili con OpenAI hanno un limite di frequenza.
Servi i tuoi dispositivi sulla tua rete: distribuzione su LAN, esecuzione come servizio del sistema, chiavi API per portatile e telefono, client generici illimitati e un piccolo pool di gateway.
Servi altre persone: uso commerciale, chiavi API illimitate, governance completa (quote, budget, firma di audit) e una farm di gateway di produzione con rilasci canary e individuazione automatica dei worker.
Parchi illimitati, arruolamento dell'organizzazione con AI Admin Console, funzionamento offline e air-gapped e supporto prioritario. Licenza per parco — parliamone.
Installa gratuitamente l’app dal relativo marketplace. Un abbonamento diretto Personal o Commercial include un codice prodotto valido su tutte le piattaforme supportate.
Centralizza modelli costosi e governance lasciando ai team app familiari e strumenti compatibili OpenAI.
Condividi da una macchina gestita modelli approvati di chat, traduzione, riscrittura, RAG documentale, immagini e voce invece di scaricarli su ogni postazione.
Leggi il modello di distribuzione →Offri AI a team legali, sanitari, finanziari, pubblici e di ricerca mantenendo prompt, file, accesso e audit nel confine scelto.
Leggi il modello di distribuzione →Collega app compatibili OpenAI, agenti e valutazioni CI a un endpoint interno. Il team piattaforma controlla modelli e capacità senza chiavi vendor in ogni progetto.
Leggi il modello di distribuzione →Metti AI Gateway davanti a worker distribuiti per routing basato sullo stato, affinità dei modelli caldi, manutenzione progressiva e crescita senza riconfigurare i client.
Leggi il modello di distribuzione →Dimostra lavoro utile e confine di privacy su una macchina prima di aggiungere utenti, policy o una server farm.
Scegli un’attività delimitata, come chat privata, domande sui documenti, traduzione o trascrizione, e le persone che la valuteranno.
Seleziona modello e macchina in base a contesto, tempo di risposta e utenti simultanei previsti. Valida prima su CPU o aggiungi GPU quando serve.
Conferma client, modelli, log e percorsi di rete consentiti. Mantieni prompt e file entro il confine scelto.
Passa al servizio in rete, alle chiavi API e alle quote, poi registra l’ambiente in AI Admin Console o aggiungi worker AI Gateway quando la domanda lo giustifica.
AI Server è disponibile come applicazione Kubernetes gratuita/BYOL su Microsoft Marketplace e AWS Marketplace. L’infrastruttura cloud è fatturata dal provider; la stessa licenza AI Server Commercial o Enterprise attiva gateway e worker.
Installa l’app Kubernetes certificata in un cluster AKS esistente. Inizia con un nodo CPU per convalidare la distribuzione, quindi aggiungi worker NVIDIA GPU per i carichi di inferenza reali.
Trova in Microsoft MarketplaceDistribuisci il pacchetto Helm di AWS Marketplace su Amazon EKS. Un piccolo pool di nodi di sistema e worker GPU separati mantiene stabili i servizi e semplifica la scalabilità.
Trova in AWS MarketplaceAI Server non è un proxy verso un'API cloud. I modelli girano sul tuo hardware; le richieste viaggiano dalle tue app al tuo server e ritorno, dentro il tuo perimetro. Il funzionamento offline e air-gapped sono modalità di distribuzione supportate, non eccezioni speciali.
Per aiuto sulla distribuzione, consigli di dimensionamento, domande su Kubernetes o licenze, scrivi a [email protected] — oppure usa il modulo di contatto e scegli "Prodotto".