La plataforma de IA privada para equipos. Un servidor ejecuta los modelos — cada aplicación y cada dispositivo simplemente los usa. AI Server ofrece chat, embeddings, generación de imágenes, voz y visión desde tu propio hardware, mediante API compatibles con OpenAI, a toda la AI Suite y a cualquier herramienta compatible.
Empieza gratis en tu propia máquina. Cuando tu equipo crece, da servicio a tu red; cuando una máquina no basta, el modo AI Gateway convierte varios servidores en un único punto de acceso con balanceo de carga — en tu LAN, en Docker o en Kubernetes. Sin nube de proveedor en la ruta de datos en ningún momento.
Consíguelo en Microsoft Store Mira lo que hace ↓ Licencias y precios
Sin un servidor, cada PC descarga sus propios modelos, necesita su propia GPU y se configura y actualiza por separado. Con AI Server, los modelos se descargan una vez, se ejecutan en el mejor hardware que tengas y dan servicio a todos.
Puntos de acceso compatibles con OpenAI para chat, embeddings, generación de imágenes, voz a texto (incluida la transmisión en directo), texto a voz, clonación de voz y visión — todo servido desde tu hardware. Apunta a él cualquier herramienta compatible o tu propio código.
Cada aplicación de la AI Suite descubre el servidor y le delega su trabajo de IA — sin configuración alguna. Notas, PDF, traducción, dictado, imágenes, correo y más, todo compartiendo un mismo conjunto de modelos en una sola máquina.
Claves API con planes por clave, límites de tasa, cuotas y presupuestos, análisis de uso por aplicación y modelo, y registros de auditoría sin contenido con exportación firmada. Los controles que espera TI, sin un proveedor de nube de por medio.
Activa un interruptor y varios servidores se convierten en un único punto de acceso: balanceo de carga con comprobación de estado, enrutamiento consciente del modelo que prefiere las máquinas que ya lo tienen cargado, despliegues canary y actualizaciones sin tiempo de inactividad.
Una aplicación de escritorio para la máquina bajo el escritorio; contenedores, manifiestos de Kubernetes y un chart de Helm para el rack o la nube. Mismo producto, mismas API, misma licencia — de un portátil a una granja de GPU.
Cada servidor aloja su propio panel en vivo y métricas nativas de Prometheus: salud del parque, latencia, uso y capacidad de un vistazo — sin una pila de monitorización adicional para empezar.
AI Gateway es AI Server ejecutándose en su modo de frontal de granja. Los clientes se conectan a él exactamente como si fuera un único AI Server; detrás, un grupo de servidores de trabajo (workers) realiza la inferencia real. Añade una máquina y la capacidad crece; retira una para mantenimiento y el tráfico se drena con suavidad — no se descarta la solicitud de nadie.
En Kubernetes, los workers se descubren automáticamente a medida que escalan, así que una granja con autoescalado no necesita ediciones manuales del grupo. Todo el parque sigue siendo observable desde el panel integrado y las métricas de Prometheus.
El nivel gratuito es un producto real, no una prueba: un servidor de IA local completo para todas las aplicaciones de la AI Suite en tu propia máquina, para siempre. Los niveles de pago comienzan justo donde el valor cruza los límites de una máquina.
Un servidor de IA local completo en tu propia máquina. Uso ilimitado por cada aplicación de la AI Suite en esa máquina; los clientes genéricos compatibles con OpenAI tienen límite de tasa.
Da servicio a tus propios dispositivos por tu red: servicio en LAN, ejecución como servicio del sistema, claves API para tu portátil y tu teléfono, clientes genéricos ilimitados y un pequeño grupo de puerta de enlace.
Da servicio a otras personas: uso comercial, claves API ilimitadas, gobernanza completa (cuotas, presupuestos, firma de auditoría) y una granja de puerta de enlace de producción con despliegues canary y descubrimiento automático de workers.
Parques ilimitados, inscripción de organización con AI Admin Console, funcionamiento sin conexión y aislado de la red, y soporte prioritario. Con licencia por parque — habla con nosotros.
AI Server no es un proxy a una API en la nube. Los modelos se ejecutan en tu hardware; las solicitudes viajan de tus aplicaciones a tu servidor y de vuelta, dentro de tu perímetro. El funcionamiento sin conexión y aislado de la red son modos de implementación admitidos, no excepciones especiales.
Para ayuda con la implementación, consejos de dimensionamiento, preguntas sobre Kubernetes o licencias, escribe a [email protected] — o usa el formulario de contacto y elige «Producto».