La plateforme d'IA privée pour les équipes. Un serveur exécute les modèles — chaque application et chaque appareil les utilise, tout simplement. AI Server fournit chat, embeddings, génération d'images, parole et vision depuis votre propre matériel, via des API compatibles OpenAI, à toute l'AI Suite et à n'importe quel outil compatible.
Commencez gratuitement sur votre propre machine. Quand votre équipe grandit, desservez votre réseau ; quand une machine ne suffit plus, le mode AI Gateway transforme plusieurs serveurs en un seul point d'accès à charge répartie — sur votre LAN, dans Docker ou sur Kubernetes. Aucun cloud fournisseur dans le chemin des données, à aucun moment.
Télécharger sur le Microsoft Store Voir ce qu'il fait ↓ Licences & tarifs
Sans serveur, chaque PC télécharge ses propres modèles, exige son propre GPU, et se configure et se met à jour séparément. Avec AI Server, les modèles se téléchargent une seule fois, s'exécutent sur le meilleur matériel dont vous disposez, et servent tout le monde.
Des points de terminaison compatibles OpenAI pour le chat, les embeddings, la génération d'images, la reconnaissance vocale (y compris en flux continu), la synthèse vocale, le clonage de voix et la vision — le tout servi depuis votre matériel. Pointez-y n'importe quel outil compatible ou votre propre code.
Chaque application de l'AI Suite découvre le serveur et lui délègue son travail d'IA — sans aucune configuration. Notes, PDF, traduction, dictée, images, e-mail et plus encore, partageant tous un même jeu de modèles sur une seule machine.
Des clés API avec des plans par clé, des limites de débit, des quotas et des budgets, des analyses d'utilisation par application et par modèle, et des journaux d'audit sans contenu avec export signé. Les contrôles qu'attend la DSI, sans fournisseur cloud dans la boucle.
Un seul interrupteur et plusieurs serveurs deviennent un point d'accès unique : répartition de charge avec contrôle de santé, routage tenant compte du modèle qui privilégie les machines où le modèle est déjà chargé, déploiements canari et mises à niveau sans interruption.
Une application de bureau pour la machine sous le bureau ; des conteneurs, des manifestes Kubernetes et un chart Helm pour le rack ou le cloud. Même produit, mêmes API, même licence — du portable à la ferme de GPU.
Chaque serveur héberge son propre tableau de bord en direct et des métriques Prometheus natives : santé du parc, latence, utilisation et capacité en un coup d'œil — sans pile de supervision supplémentaire pour démarrer.
AI Gateway, c'est AI Server exécuté dans son mode frontal de ferme. Les clients s'y connectent exactement comme s'il s'agissait d'un unique AI Server ; derrière lui, un pool de serveurs de travail (workers) effectue l'inférence réelle. Ajoutez une machine et la capacité augmente ; retirez-en une pour la maintenance et le trafic se draine en douceur — aucune requête n'est abandonnée.
Sur Kubernetes, les workers sont découverts automatiquement à mesure qu'ils montent en charge, si bien qu'une ferme à mise à l'échelle automatique ne nécessite aucune modification manuelle du pool. L'ensemble du parc reste observable depuis le tableau de bord intégré et les métriques Prometheus.
Le niveau gratuit est un vrai produit, pas un essai : un serveur d'IA local complet pour toutes les applications de l'AI Suite sur votre propre machine, pour toujours. Les niveaux payants commencent précisément là où la valeur franchit les frontières d'une machine.
Un serveur d'IA local complet sur votre propre machine. Utilisation illimitée par chaque application de l'AI Suite sur cette machine ; les clients génériques compatibles OpenAI sont soumis à une limite de débit.
Desservez vos propres appareils sur votre réseau : diffusion sur le LAN, exécution en tant que service du système, clés API pour votre portable et votre téléphone, clients génériques illimités et un petit pool de passerelle.
Desservez d'autres personnes : usage commercial, clés API illimitées, gouvernance complète (quotas, budgets, signature d'audit) et une ferme de passerelle de production avec déploiements canari et découverte automatique des workers.
Parcs illimités, enrôlement d'organisation avec AI Admin Console, fonctionnement hors ligne et en isolement réseau, et support prioritaire. Licence par parc — parlons-en.
AI Server n'est pas un proxy vers une API cloud. Les modèles s'exécutent sur votre matériel ; les requêtes voyagent de vos applications à votre serveur et reviennent, à l'intérieur de votre périmètre. Le fonctionnement hors ligne et en isolement réseau sont des modes de déploiement pris en charge, pas des exceptions.
Pour de l'aide au déploiement, des conseils de dimensionnement, des questions sur Kubernetes ou les licences, écrivez à [email protected] — ou utilisez le formulaire de contact et choisissez « Produit ».