AI Server

La plataforma de IA privada para equipos. Un servidor ejecuta los modelos — cada aplicación y cada dispositivo simplemente los usa. AI Server ofrece chat, embeddings, generación de imágenes, voz y visión desde tu propio hardware, mediante API compatibles con OpenAI, a toda la AI Suite y a cualquier herramienta compatible.

Empieza gratis en tu propia máquina. Cuando tu equipo crece, da servicio a tu red; cuando una máquina no basta, el modo AI Gateway convierte varios servidores en un único punto de acceso con balanceo de carga — en tu LAN, en Docker o en Kubernetes. Sin nube de proveedor en la ruta de datos en ningún momento.

Consíguelo en Microsoft Store Mira lo que hace ↓ Licencias y precios

QUÉ HACE AI SERVER

Una sola instalación que impulsa todo

Sin un servidor, cada PC descarga sus propios modelos, necesita su propia GPU y se configura y actualiza por separado. Con AI Server, los modelos se descargan una vez, se ejecutan en el mejor hardware que tengas y dan servicio a todos.

API de IA universales

Puntos de acceso compatibles con OpenAI para chat, embeddings, generación de imágenes, voz a texto (incluida la transmisión en directo), texto a voz, clonación de voz y visión — todo servido desde tu hardware. Apunta a él cualquier herramienta compatible o tu propio código.

Impulsa toda la AI Suite

Cada aplicación de la AI Suite descubre el servidor y le delega su trabajo de IA — sin configuración alguna. Notas, PDF, traducción, dictado, imágenes, correo y más, todo compartiendo un mismo conjunto de modelos en una sola máquina.

Gobernanza integrada

Claves API con planes por clave, límites de tasa, cuotas y presupuestos, análisis de uso por aplicación y modelo, y registros de auditoría sin contenido con exportación firmada. Los controles que espera TI, sin un proveedor de nube de por medio.

Escala con AI Gateway

Activa un interruptor y varios servidores se convierten en un único punto de acceso: balanceo de carga con comprobación de estado, enrutamiento consciente del modelo que prefiere las máquinas que ya lo tienen cargado, despliegues canary y actualizaciones sin tiempo de inactividad.

Funciona en cualquier lugar

Una aplicación de escritorio para la máquina bajo el escritorio; contenedores, manifiestos de Kubernetes y un chart de Helm para el rack o la nube. Mismo producto, mismas API, misma licencia — de un portátil a una granja de GPU.

Observable por diseño

Cada servidor aloja su propio panel en vivo y métricas nativas de Prometheus: salud del parque, latencia, uso y capacidad de un vistazo — sin una pila de monitorización adicional para empezar.

AI GATEWAY

De un servidor a una granja — sin cambiar un solo cliente

AI Gateway es AI Server ejecutándose en su modo de frontal de granja. Los clientes se conectan a él exactamente como si fuera un único AI Server; detrás, un grupo de servidores de trabajo (workers) realiza la inferencia real. Añade una máquina y la capacidad crece; retira una para mantenimiento y el tráfico se drena con suavidad — no se descarta la solicitud de nadie.

En Kubernetes, los workers se descubren automáticamente a medida que escalan, así que una granja con autoescalado no necesita ediciones manuales del grupo. Todo el parque sigue siendo observable desde el panel integrado y las métricas de Prometheus.

Lo que la puerta de enlace gestiona por ti

  • Balanceo de carga — por turnos, menor latencia, menos conexiones, ponderado o fijo por cliente.
  • Enrutamiento consciente del modelo — las solicitudes van a una máquina que ya tiene cargado el modelo solicitado.
  • Conmutación por error — un worker que falla se reintenta en uno sano antes de que el cliente lo note.
  • Despliegues canary — envía una porción constante del tráfico a las máquinas nuevas antes de confiar plenamente en ellas.
  • Contrapresión — cuando todos los workers están saturados, quien llama recibe un honesto «reinténtalo en breve» en lugar de un tiempo de espera agotado.
  • Actualizaciones sin tiempo de inactividad — drena un worker, actualízalo y devuélvelo al grupo.
EDICIONES Y NIVELES

Empieza gratis. Crece cuando lo haga tu equipo.

El nivel gratuito es un producto real, no una prueba: un servidor de IA local completo para todas las aplicaciones de la AI Suite en tu propia máquina, para siempre. Los niveles de pago comienzan justo donde el valor cruza los límites de una máquina.

Gratis

Un servidor de IA local completo en tu propia máquina. Uso ilimitado por cada aplicación de la AI Suite en esa máquina; los clientes genéricos compatibles con OpenAI tienen límite de tasa.

Pro Personal

Da servicio a tus propios dispositivos por tu red: servicio en LAN, ejecución como servicio del sistema, claves API para tu portátil y tu teléfono, clientes genéricos ilimitados y un pequeño grupo de puerta de enlace.

Pro Commercial

Da servicio a otras personas: uso comercial, claves API ilimitadas, gobernanza completa (cuotas, presupuestos, firma de auditoría) y una granja de puerta de enlace de producción con despliegues canary y descubrimiento automático de workers.

Enterprise

Parques ilimitados, inscripción de organización con AI Admin Console, funcionamiento sin conexión y aislado de la red, y soporte prioritario. Con licencia por parque — habla con nosotros.

PRIVADO POR ARQUITECTURA

Tus prompts nunca salen de tu red — porque no hay adónde ir

AI Server no es un proxy a una API en la nube. Los modelos se ejecutan en tu hardware; las solicitudes viajan de tus aplicaciones a tu servidor y de vuelta, dentro de tu perímetro. El funcionamiento sin conexión y aislado de la red son modos de implementación admitidos, no excepciones especiales.

  • Ninguna nube de proveedor en la ruta de datos. Los prompts, los documentos y el contenido generado se quedan entre tus clientes y tu servidor.
  • Registros sin contenido. Los análisis de uso y los registros de auditoría anotan quién llamó a qué y cuándo — nunca el texto de un prompt o de una respuesta.
  • Licencias que fallan de forma segura. Si nuestro servicio de licencias alguna vez no está disponible, tu parque con licencia sigue dando servicio. Tu disponibilidad no depende de la nuestra.
  • Tus claves, tus reglas. Las claves API las emites y revocas tú, en tu servidor — no cuentas en la nube de otro.

¿Preguntas sobre AI Server o AI Gateway?

Para ayuda con la implementación, consejos de dimensionamiento, preguntas sobre Kubernetes o licencias, escribe a [email protected] — o usa el formulario de contacto y elige «Producto».

Suscríbete a las novedades

Nuevos productos de IA gratuitos, actualizaciones importantes y algunos lanzamientos disponibles solo en este sitio. Sin spam.