AI Server

A plataforma de IA privada para equipas. Um servidor executa os modelos — cada aplicação e cada dispositivo simplesmente os utiliza. O AI Server fornece chat, embeddings, geração de imagens, voz e visão a partir do seu próprio hardware, através de APIs compatíveis com OpenAI, a toda a AI Suite e a qualquer ferramenta compatível.

Comece grátis na sua própria máquina. Quando a sua equipa cresce, sirva a sua rede; quando uma máquina não chega, o modo AI Gateway transforma vários servidores num único ponto de acesso com balanceamento de carga — na sua LAN, no Docker ou no Kubernetes. Sem nuvem de fornecedor no caminho dos dados, em momento algum.

Obtenha na Microsoft Store Veja o que faz ↓ Licenciamento e preços

O QUE O AI SERVER FAZ

Uma implementação que alimenta tudo

Sem um servidor, cada PC descarrega os seus próprios modelos, precisa da sua própria GPU e é configurado e atualizado separadamente. Com o AI Server, os modelos são descarregados uma vez, correm no melhor hardware que tiver e servem toda a gente.

APIs de IA universais

Endpoints compatíveis com OpenAI para chat, embeddings, geração de imagens, voz para texto (incluindo transmissão em direto), texto para voz, clonagem de voz e visão — tudo servido a partir do seu hardware. Aponte qualquer ferramenta compatível ou o seu próprio código para ele.

Alimenta toda a AI Suite

Cada aplicação da AI Suite descobre o servidor e delega-lhe o seu trabalho de IA — sem qualquer configuração. Notas, PDFs, tradução, ditado, imagens, e-mail e muito mais, todos a partilhar um único conjunto de modelos numa só máquina.

Governação incorporada

Chaves de API com planos por chave, limites de taxa, quotas e orçamentos, análises de utilização por aplicação e modelo, e registos de auditoria sem conteúdo com exportação assinada. Os controlos que a área de TI espera, sem um fornecedor de nuvem pelo meio.

Escala com o AI Gateway

Ative um interruptor e vários servidores passam a ser um único ponto de acesso: balanceamento de carga com verificação de estado, encaminhamento consciente do modelo que prefere máquinas que já o têm carregado, lançamentos canary e atualizações sem tempo de inatividade.

Corre em qualquer lugar

Uma aplicação de ambiente de trabalho para a máquina debaixo da secretária; contentores, manifestos de Kubernetes e um chart de Helm para o rack ou a nuvem. Mesmo produto, mesmas APIs, mesma licença — de um portátil a uma quinta de GPU.

Observável por conceção

Cada servidor aloja o seu próprio painel em direto e métricas nativas do Prometheus: saúde da frota, latência, utilização e capacidade num relance — sem uma pilha de monitorização adicional para começar.

AI GATEWAY

De um servidor a uma quinta — sem alterar um único cliente

O AI Gateway é o AI Server a correr no seu modo de front-end de quinta. Os clientes ligam-se a ele exatamente como se fosse um único AI Server; por trás, um conjunto de servidores de trabalho (workers) faz a inferência propriamente dita. Adicione uma máquina e a capacidade cresce; retire uma para manutenção e o tráfego é escoado com suavidade — nenhum pedido é descartado.

No Kubernetes, os workers são descobertos automaticamente à medida que escalam, pelo que uma quinta com escalonamento automático não precisa de edições manuais do conjunto. Todo o parque permanece observável a partir do painel incorporado e das métricas do Prometheus.

O que o Gateway trata por si

  • Balanceamento de carga — alternância cíclica, menor latência, menos ligações, ponderado ou fixo por cliente.
  • Encaminhamento consciente do modelo — os pedidos vão para uma máquina que já tem o modelo pedido carregado.
  • Comutação por falha — um worker com falha é repetido num saudável antes de o cliente sequer notar.
  • Lançamentos canary — envie uma fatia constante do tráfego para as máquinas novas antes de confiar totalmente nelas.
  • Contrapressão — quando todos os workers estão saturados, quem chama recebe um honesto «tente novamente em breve» em vez de um tempo esgotado.
  • Atualizações sem tempo de inatividade — esvazie um worker, atualize-o e devolva-o ao conjunto.
EDIÇÕES E NÍVEIS

Comece grátis. Cresça quando a sua equipa crescer.

O nível gratuito é um produto a sério, não uma avaliação: um servidor de IA local completo para todas as aplicações da AI Suite na sua própria máquina, para sempre. Os níveis pagos começam exatamente onde o valor ultrapassa as fronteiras de uma máquina.

Grátis

Um servidor de IA local completo na sua própria máquina. Utilização ilimitada por cada aplicação da AI Suite nessa máquina; os clientes genéricos compatíveis com OpenAI têm limite de taxa.

Pro Personal

Sirva os seus próprios dispositivos pela sua rede: serviço em LAN, execução como serviço do sistema, chaves de API para o seu portátil e telemóvel, clientes genéricos ilimitados e um pequeno conjunto de gateway.

Pro Commercial

Sirva outras pessoas: utilização comercial, chaves de API ilimitadas, governação completa (quotas, orçamentos, assinatura de auditoria) e uma quinta de gateway de produção com lançamentos canary e descoberta automática de workers.

Enterprise

Parques ilimitados, inscrição de organização com o AI Admin Console, funcionamento offline e isolado da rede, e suporte prioritário. Licenciado por parque — fale connosco.

PRIVADO POR ARQUITETURA

Os seus prompts nunca saem da sua rede — porque não têm para onde ir

O AI Server não é um proxy para uma API na nuvem. Os modelos correm no seu hardware; os pedidos viajam das suas aplicações para o seu servidor e de volta, dentro do seu perímetro. O funcionamento offline e isolado da rede são modos de implementação suportados, não exceções especiais.

  • Nenhuma nuvem de fornecedor no caminho dos dados. Prompts, documentos e conteúdo gerado ficam entre os seus clientes e o seu servidor.
  • Registos sem conteúdo. As análises de utilização e os registos de auditoria anotam quem chamou o quê e quando — nunca o texto de um prompt ou de uma resposta.
  • Licenciamento à prova de falhas. Se o nosso serviço de licenças ficar alguma vez inacessível, a sua frota licenciada continua a servir. A sua disponibilidade não depende da nossa.
  • As suas chaves, as suas regras. As chaves de API são emitidas e revogadas por si, no seu servidor — não contas na nuvem de outra pessoa.

Dúvidas sobre o AI Server ou o AI Gateway?

Para ajuda na implementação, conselhos de dimensionamento, questões de Kubernetes ou licenciamento, escreva para [email protected] — ou use o formulário de contacto e escolha «Produto».

Subscreva atualizações de produto

Novos produtos de IA gratuitos, atualizações importantes e lançamentos disponíveis apenas neste site. Sem spam.