Concevez votre déploiement d’IA privée
Créez une topologie pour un pilote, une équipe ou une ferme de production résiliente. Visualisez le rôle d’AI Gateway, des workers, de Kubernetes et des licences avant de créer des ressources cloud.
Paramètres du déploiement
Passerelle avec pool de workers géré
Estimation de planification, pas un devis. Les tarifs sont un instantané des prix publics au 21 août 2026. Sont exclus : transfert de données, IPv4 publique, équilibreurs, ingestion de supervision, sauvegardes, support, remises, capacité réservée ou Spot, taxes et exigences propres aux modèles.
Validez la conception avec les équipes sécurité et plateforme, mesurez vos modèles, confirmez le quota GPU et la disponibilité régionale des SKU, puis chiffrez l’architecture finale dans le calculateur du fournisseur.
Un point de départ pratique
Pilote
Utilisez un worker CPU pour valider réseau, clés, compatibilité client et exploitation. Cela valide le déploiement, pas la vitesse d’inférence en production.
Équipe
Commencez avec deux workers GPU derrière AI Gateway. Entretenez l’un pendant que l’autre sert le trafic et ajoutez de la capacité sans modifier les clients.
Production
Utilisez au moins trois workers répartis entre domaines de panne, un SLA de production, des garde-fous d’auto-scaling, un stockage persistant, une entrée TLS et votre observabilité standard.