AI Server

A plataforma de IA privada para equipas. Um servidor executa os modelos — cada aplicação e cada dispositivo simplesmente os utiliza. O AI Server fornece chat, embeddings, geração de imagens, voz e visão a partir do seu próprio hardware, através de APIs compatíveis com OpenAI, a toda a AI Suite e a qualquer ferramenta compatível.

Comece grátis na sua própria máquina. Quando a sua equipa cresce, sirva a sua rede; quando uma máquina não chega, o modo AI Gateway transforma vários servidores num único ponto de acesso com balanceamento de carga — na sua LAN, no Docker ou no Kubernetes. Sem nuvem de fornecedor no caminho dos dados, em momento algum.

Obtenha na Microsoft Store Veja o que faz ↓ Licenciamento e preços

O QUE O AI SERVER FAZ

Uma implementação que alimenta tudo

Sem um servidor, cada PC descarrega os seus próprios modelos, precisa da sua própria GPU e é configurado e atualizado separadamente. Com o AI Server, os modelos são descarregados uma vez, correm no melhor hardware que tiver e servem toda a gente.

APIs de IA universais

Endpoints compatíveis com OpenAI para chat, embeddings, geração de imagens, voz para texto (incluindo transmissão em direto), texto para voz, clonagem de voz e visão — tudo servido a partir do seu hardware. Aponte qualquer ferramenta compatível ou o seu próprio código para ele.

Alimenta toda a AI Suite

Cada aplicação da AI Suite descobre o servidor e delega-lhe o seu trabalho de IA — sem qualquer configuração. Notas, PDFs, tradução, ditado, imagens, e-mail e muito mais, todos a partilhar um único conjunto de modelos numa só máquina.

Governação incorporada

Chaves de API com planos por chave, limites de taxa, quotas e orçamentos, análises de utilização por aplicação e modelo, e registos de auditoria sem conteúdo com exportação assinada. Os controlos que a área de TI espera, sem um fornecedor de nuvem pelo meio.

Escala com o AI Gateway

Ative um interruptor e vários servidores passam a ser um único ponto de acesso: balanceamento de carga com verificação de estado, encaminhamento consciente do modelo que prefere máquinas que já o têm carregado, lançamentos canary e atualizações sem tempo de inatividade.

Corre em qualquer lugar

Uma aplicação de ambiente de trabalho para a máquina debaixo da secretária; contentores, manifestos de Kubernetes e um chart de Helm para o rack ou a nuvem. Mesmo produto, mesmas APIs, mesma licença — de um portátil a uma quinta de GPU.

Observável por conceção

Cada servidor aloja o seu próprio painel em direto e métricas nativas do Prometheus: saúde da frota, latência, utilização e capacidade num relance — sem uma pilha de monitorização adicional para começar.

AI GATEWAY

De um servidor a uma quinta — sem alterar um único cliente

O AI Gateway é o AI Server a correr no seu modo de front-end de quinta. Os clientes ligam-se a ele exatamente como se fosse um único AI Server; por trás, um conjunto de servidores de trabalho (workers) faz a inferência propriamente dita. Adicione uma máquina e a capacidade cresce; retire uma para manutenção e o tráfego é escoado com suavidade — nenhum pedido é descartado.

No Kubernetes, os workers são descobertos automaticamente à medida que escalam, pelo que uma quinta com escalonamento automático não precisa de edições manuais do conjunto. Todo o parque permanece observável a partir do painel incorporado e das métricas do Prometheus.

O que o Gateway trata por si

  • Balanceamento de carga — alternância cíclica, menor latência, menos ligações, ponderado ou fixo por cliente.
  • Encaminhamento consciente do modelo — os pedidos vão para uma máquina que já tem o modelo pedido carregado.
  • Comutação por falha — um worker com falha é repetido num saudável antes de o cliente sequer notar.
  • Lançamentos canary — envie uma fatia constante do tráfego para as máquinas novas antes de confiar totalmente nelas.
  • Contrapressão — quando todos os workers estão saturados, quem chama recebe um honesto «tente novamente em breve» em vez de um tempo esgotado.
  • Atualizações sem tempo de inatividade — esvazie um worker, atualize-o e devolva-o ao conjunto.
EDIÇÕES E NÍVEIS

Comece grátis. Cresça quando a sua equipa crescer.

O nível gratuito é um produto a sério, não uma avaliação: um servidor de IA local completo para todas as aplicações da AI Suite na sua própria máquina, para sempre. Os níveis pagos começam exatamente onde o valor ultrapassa as fronteiras de uma máquina.

Grátis

Um servidor de IA local completo na sua própria máquina. Utilização ilimitada por cada aplicação da AI Suite nessa máquina; os clientes genéricos compatíveis com OpenAI têm limite de taxa.

Pro Personal

Sirva os seus próprios dispositivos pela sua rede: serviço em LAN, execução como serviço do sistema, chaves de API para o seu portátil e telemóvel, clientes genéricos ilimitados e um pequeno conjunto de gateway.

Pro Commercial

Sirva outras pessoas: utilização comercial, chaves de API ilimitadas, governação completa (quotas, orçamentos, assinatura de auditoria) e uma quinta de gateway de produção com lançamentos canary e descoberta automática de workers.

Enterprise

Parques ilimitados, inscrição de organização com o AI Admin Console, funcionamento offline e isolado da rede, e suporte prioritário. Licenciado por parque — fale connosco.

Comprar Pro na nossa Loja → Licenciamento e preços Fale connosco sobre a versão Enterprise

Instale gratuitamente a aplicação a partir do respetivo marketplace. Uma subscrição direta Personal ou Commercial inclui uma chave de produto válida em todas as plataformas suportadas.

CASOS DE UTILIZAÇÃO

Uma plataforma de IA privada, vários padrões de implementação

Centralize modelos dispendiosos e governação enquanto as equipas mantêm apps familiares e ferramentas compatíveis com OpenAI.

Escritórios e equipas de conhecimento

Partilhe modelos aprovados de chat, tradução, reescrita, RAG documental, imagem e voz a partir de uma máquina gerida em vez de cada posto.

Ler o padrão de implementação →

Cargas reguladas e sensíveis

Dê IA a equipas jurídicas, de saúde, financeiras, públicas e de investigação mantendo prompts, ficheiros, acesso e auditoria no limite escolhido.

Ler o padrão de implementação →

Programadores e plataforma API interna

Ligue apps compatíveis OpenAI, agentes e avaliações CI a um endpoint interno. A plataforma controla modelos e capacidade sem chave do fornecedor por projeto.

Ler o padrão de implementação →

Filiais, failover e farms GPU

Coloque AI Gateway à frente de workers distribuídos para routing por estado, afinidade de modelos quentes, manutenção progressiva e expansão sem reconfigurar clientes.

Ler o padrão de implementação →
COMECE PEQUENO

Planeie a primeira implementação à volta de um fluxo real

Comprove trabalho útil e o limite de privacidade numa máquina antes de adicionar utilizadores, políticas ou uma farm de servidores.

1. Escolha a carga de trabalho

Escolha uma tarefa delimitada, como conversa privada, perguntas sobre documentos, tradução ou transcrição, e as pessoas que a vão avaliar.

2. Ajuste o hardware

Selecione modelo e máquina para o contexto, tempo de resposta e utilizadores simultâneos esperados. Valide primeiro em CPU ou acrescente GPU quando necessário.

3. Teste o limite

Confirme que clientes, modelos, registos e rotas de rede são permitidos. Mantenha instruções e ficheiros dentro do limite escolhido.

4. Acrescente controlo ao crescer

Passe ao serviço em rede, chaves API e quotas; depois inscreva o ambiente no AI Admin Console ou adicione workers do AI Gateway quando a procura o justificar.

IMPLEMENTE NA SUA CLOUD

Entrega certificada para Azure e AWS

O AI Server está disponível como aplicação Kubernetes gratuita/BYOL no Microsoft Marketplace e AWS Marketplace. A infraestrutura é faturada pelo fornecedor; a mesma licença AI Server Commercial ou Enterprise ativa gateway e workers.

Microsoft Azure

Instale a aplicação Kubernetes certificada num cluster AKS existente. Comece com um nó CPU para validar e adicione workers NVIDIA GPU para inferência real.

Encontrar no Microsoft Marketplace

Amazon Web Services

Implemente o pacote Helm do AWS Marketplace no Amazon EKS. Um pequeno pool de nós de sistema e workers GPU separados estabiliza os serviços e facilita a expansão.

Encontrar no AWS Marketplace
PRIVADO POR ARQUITETURA

Os seus prompts nunca saem da sua rede — porque não têm para onde ir

O AI Server não é um proxy para uma API na nuvem. Os modelos correm no seu hardware; os pedidos viajam das suas aplicações para o seu servidor e de volta, dentro do seu perímetro. O funcionamento offline e isolado da rede são modos de implementação suportados, não exceções especiais.

  • Nenhuma nuvem de fornecedor no caminho dos dados. Prompts, documentos e conteúdo gerado ficam entre os seus clientes e o seu servidor.
  • Registos sem conteúdo. As análises de utilização e os registos de auditoria anotam quem chamou o quê e quando — nunca o texto de um prompt ou de uma resposta.
  • Licenciamento à prova de falhas. Se o nosso serviço de licenças ficar alguma vez inacessível, a sua frota licenciada continua a servir. A sua disponibilidade não depende da nossa.
  • As suas chaves, as suas regras. As chaves de API são emitidas e revogadas por si, no seu servidor — não contas na nuvem de outra pessoa.
Revise a matriz atual de confiança e controle

Dúvidas sobre o AI Server ou o AI Gateway?

Para ajuda na implementação, conselhos de dimensionamento, questões de Kubernetes ou licenciamento, escreva para [email protected] — ou use o formulário de contacto e escolha «Produto».

Subscreva atualizações de produto

Novos produtos de IA gratuitos, atualizações importantes e lançamentos disponíveis apenas neste site. Sem spam.