A plataforma de IA privada para equipas. Um servidor executa os modelos — cada aplicação e cada dispositivo simplesmente os utiliza. O AI Server fornece chat, embeddings, geração de imagens, voz e visão a partir do seu próprio hardware, através de APIs compatíveis com OpenAI, a toda a AI Suite e a qualquer ferramenta compatível.
Comece grátis na sua própria máquina. Quando a sua equipa cresce, sirva a sua rede; quando uma máquina não chega, o modo AI Gateway transforma vários servidores num único ponto de acesso com balanceamento de carga — na sua LAN, no Docker ou no Kubernetes. Sem nuvem de fornecedor no caminho dos dados, em momento algum.
Obtenha na Microsoft Store Veja o que faz ↓ Licenciamento e preços
Sem um servidor, cada PC descarrega os seus próprios modelos, precisa da sua própria GPU e é configurado e atualizado separadamente. Com o AI Server, os modelos são descarregados uma vez, correm no melhor hardware que tiver e servem toda a gente.
Endpoints compatíveis com OpenAI para chat, embeddings, geração de imagens, voz para texto (incluindo transmissão em direto), texto para voz, clonagem de voz e visão — tudo servido a partir do seu hardware. Aponte qualquer ferramenta compatível ou o seu próprio código para ele.
Cada aplicação da AI Suite descobre o servidor e delega-lhe o seu trabalho de IA — sem qualquer configuração. Notas, PDFs, tradução, ditado, imagens, e-mail e muito mais, todos a partilhar um único conjunto de modelos numa só máquina.
Chaves de API com planos por chave, limites de taxa, quotas e orçamentos, análises de utilização por aplicação e modelo, e registos de auditoria sem conteúdo com exportação assinada. Os controlos que a área de TI espera, sem um fornecedor de nuvem pelo meio.
Ative um interruptor e vários servidores passam a ser um único ponto de acesso: balanceamento de carga com verificação de estado, encaminhamento consciente do modelo que prefere máquinas que já o têm carregado, lançamentos canary e atualizações sem tempo de inatividade.
Uma aplicação de ambiente de trabalho para a máquina debaixo da secretária; contentores, manifestos de Kubernetes e um chart de Helm para o rack ou a nuvem. Mesmo produto, mesmas APIs, mesma licença — de um portátil a uma quinta de GPU.
Cada servidor aloja o seu próprio painel em direto e métricas nativas do Prometheus: saúde da frota, latência, utilização e capacidade num relance — sem uma pilha de monitorização adicional para começar.
O AI Gateway é o AI Server a correr no seu modo de front-end de quinta. Os clientes ligam-se a ele exatamente como se fosse um único AI Server; por trás, um conjunto de servidores de trabalho (workers) faz a inferência propriamente dita. Adicione uma máquina e a capacidade cresce; retire uma para manutenção e o tráfego é escoado com suavidade — nenhum pedido é descartado.
No Kubernetes, os workers são descobertos automaticamente à medida que escalam, pelo que uma quinta com escalonamento automático não precisa de edições manuais do conjunto. Todo o parque permanece observável a partir do painel incorporado e das métricas do Prometheus.
O nível gratuito é um produto a sério, não uma avaliação: um servidor de IA local completo para todas as aplicações da AI Suite na sua própria máquina, para sempre. Os níveis pagos começam exatamente onde o valor ultrapassa as fronteiras de uma máquina.
Um servidor de IA local completo na sua própria máquina. Utilização ilimitada por cada aplicação da AI Suite nessa máquina; os clientes genéricos compatíveis com OpenAI têm limite de taxa.
Sirva os seus próprios dispositivos pela sua rede: serviço em LAN, execução como serviço do sistema, chaves de API para o seu portátil e telemóvel, clientes genéricos ilimitados e um pequeno conjunto de gateway.
Sirva outras pessoas: utilização comercial, chaves de API ilimitadas, governação completa (quotas, orçamentos, assinatura de auditoria) e uma quinta de gateway de produção com lançamentos canary e descoberta automática de workers.
Parques ilimitados, inscrição de organização com o AI Admin Console, funcionamento offline e isolado da rede, e suporte prioritário. Licenciado por parque — fale connosco.
O AI Server não é um proxy para uma API na nuvem. Os modelos correm no seu hardware; os pedidos viajam das suas aplicações para o seu servidor e de volta, dentro do seu perímetro. O funcionamento offline e isolado da rede são modos de implementação suportados, não exceções especiais.
Para ajuda na implementação, conselhos de dimensionamento, questões de Kubernetes ou licenciamento, escreva para [email protected] — ou use o formulário de contacto e escolha «Produto».