Progetta la tua distribuzione AI privata
Crea una topologia per un progetto pilota, un team o una farm di produzione resiliente. Scopri come AI Gateway, worker, Kubernetes e licenze interagiscono prima di creare risorse cloud.
Parametri di distribuzione
Gateway con pool di worker gestito
Stima di pianificazione, non un preventivo. Le tariffe sono un’istantanea dei prezzi pubblici del 21 agosto 2026. Sono esclusi trasferimento dati, IPv4 pubblico, load balancer, acquisizione monitoraggio, backup, supporto, sconti, capacità riservata o Spot, imposte e requisiti specifici dei modelli.
Convalida il progetto con sicurezza e piattaforma, misura i modelli, conferma quota GPU e SKU regionali, quindi calcola l’architettura finale con il provider.
Un punto di partenza pratico
Pilota
Usa un worker CPU per convalidare rete, chiavi, compatibilità client e operazioni. Dimostra la distribuzione, non la velocità di produzione.
Team
Inizia con due worker GPU dietro AI Gateway. Puoi manutenere uno mentre l’altro serve il traffico e aggiungere capacità senza modificare i client.
Produzione
Usa almeno tre worker tra domini di errore, SLA di produzione, limiti di autoscaling, storage persistente, ingresso TLS e il tuo stack di osservabilità.