Desenhe a sua implementação de IA privada
Crie uma topologia para piloto, equipa ou produção resiliente. Veja como AI Gateway, workers, Kubernetes e licenças se conjugam antes de criar recursos cloud.
Parâmetros de implementação
Gateway com pool gerido de workers
Estimativa de planeamento, não uma proposta. As tarifas são preços públicos em 21 de agosto de 2026. Excluem transferência, IPv4 público, balanceadores, ingestão de monitorização, cópias, suporte, descontos, capacidade reservada ou Spot, impostos e requisitos dos modelos.
Valide o desenho com segurança e plataforma, teste os modelos, confirme quota GPU e SKU regionais e calcule a arquitetura final no fornecedor.
Um ponto de partida prático
Piloto
Use um worker CPU para validar rede, chaves, clientes e operações. Demonstra a implementação, não a velocidade de produção.
Equipa
Comece com dois workers GPU atrás do AI Gateway. Mantenha um enquanto o outro serve tráfego e aumente capacidade sem mudar clientes.
Produção
Use três ou mais workers entre domínios de falha, SLA de produção, limites de autoescala, armazenamento persistente, entrada TLS e observabilidade padrão.