Die private KI-Plattform für Teams. Ein Server betreibt die Modelle — jede App und jedes Gerät nutzt sie einfach. AI Server stellt Chat, Embeddings, Bildgenerierung, Sprache und Vision von Ihrer eigenen Hardware über OpenAI-kompatible APIs bereit — für die gesamte AI Suite und jedes kompatible Tool.
Starten Sie kostenlos auf Ihrem eigenen Rechner. Wenn Ihr Team wächst, stellen Sie es im Netzwerk bereit; wenn ein Rechner nicht mehr reicht, macht der AI Gateway-Modus aus mehreren Servern einen einzigen lastverteilten Endpunkt — in Ihrem LAN, in Docker oder auf Kubernetes. Zu keinem Zeitpunkt eine Anbieter-Cloud im Datenpfad.
Im Microsoft Store herunterladen Sehen, was es kann ↓ Lizenzierung & Preise
Ohne Server lädt jeder PC seine eigenen Modelle herunter, braucht seine eigene GPU und wird einzeln konfiguriert und aktualisiert. Mit AI Server werden Modelle einmal heruntergeladen, laufen auf der besten verfügbaren Hardware und stehen allen zur Verfügung.
OpenAI-kompatible Endpunkte für Chat, Embeddings, Bildgenerierung, Sprache-zu-Text (auch Live-Streaming), Text-zu-Sprache, Stimmklonen und Vision — alles von Ihrer Hardware bereitgestellt. Richten Sie jedes kompatible Tool oder Ihren eigenen Code darauf aus.
Jede AI-Suite-App erkennt den Server und lagert ihre KI-Arbeit an ihn aus — ganz ohne Konfiguration. Notizen, PDFs, Übersetzung, Diktat, Bilder, E-Mail und mehr, alle mit einem Satz Modelle auf einem Rechner.
API-Schlüssel mit Plänen pro Schlüssel, Ratenbegrenzungen, Kontingenten und Budgets, Nutzungsanalysen nach App und Modell sowie inhaltsfreie Audit-Protokolle mit signiertem Export. Die Kontrollen, die die IT erwartet — ohne Cloud-Anbieter dazwischen.
Ein Schalter genügt und aus mehreren Servern wird ein einziger Endpunkt: geprüfte Lastverteilung, modellbewusstes Routing, das Rechner mit bereits geladenem Modell bevorzugt, Canary-Rollouts und Upgrades ohne Ausfallzeit.
Eine Desktop-App für den Rechner unter dem Schreibtisch; Container, Kubernetes-Manifeste und ein Helm-Chart für das Rack oder die Cloud. Gleiches Produkt, gleiche APIs, gleiche Lizenz — vom Laptop bis zur GPU-Farm.
Jeder Server bringt sein eigenes Live-Dashboard und native Prometheus-Metriken mit: Flottenzustand, Latenz, Nutzung und Kapazität auf einen Blick — ohne zusätzlichen Monitoring-Stack für den Einstieg.
AI Gateway ist AI Server im Farm-Frontend-Modus. Clients verbinden sich damit genau so, als wäre es ein einzelner AI Server; dahinter erledigt ein Pool von Worker-Servern die eigentliche Inferenz. Fügen Sie einen Rechner hinzu und die Kapazität wächst; nehmen Sie einen für die Wartung heraus und der Traffic wird sanft abgeleitet — keine Anfrage geht verloren.
Unter Kubernetes werden Worker beim Skalieren automatisch erkannt, sodass eine autoskalierende Farm keine manuellen Pool-Änderungen braucht. Der gesamte Bestand bleibt über das integrierte Dashboard und Prometheus-Metriken beobachtbar.
Die kostenlose Stufe ist ein echtes Produkt, keine Testversion: ein vollständiger lokaler KI-Server für alle AI-Suite-Apps auf Ihrem eigenen Rechner, für immer. Kostenpflichtige Stufen beginnen genau dort, wo der Nutzen Rechnergrenzen überschreitet.
Ein vollständiger lokaler KI-Server auf Ihrem eigenen Rechner. Unbegrenzte Nutzung durch jede AI-Suite-App auf diesem Rechner; generische OpenAI-kompatible Clients sind ratenbegrenzt.
Stellen Sie Ihre eigenen Geräte im Netzwerk bereit: LAN-Serving, Betrieb als OS-Dienst, API-Schlüssel für Laptop und Telefon, unbegrenzte generische Clients und ein kleiner Gateway-Pool.
Stellen Sie für andere bereit: kommerzielle Nutzung, unbegrenzte API-Schlüssel, vollständige Governance (Kontingente, Budgets, Audit-Signierung) und eine produktive Gateway-Farm mit Canary-Rollouts und automatischer Worker-Erkennung.
Unbegrenzte Bestände, Organisations-Enrollment mit AI Admin Console, Offline- und Air-Gap-Betrieb sowie Priority-Support. Lizenziert pro Bestand — sprechen Sie mit uns.
AI Server ist kein Proxy zu einer Cloud-API. Die Modelle laufen auf Ihrer Hardware; Anfragen wandern von Ihren Apps zu Ihrem Server und zurück, innerhalb Ihres Perimeters. Offline- und Air-Gap-Betrieb sind unterstützte Bereitstellungsmodi, keine Sonderfälle.
Für Hilfe bei der Bereitstellung, Dimensionierungsberatung, Kubernetes-Fragen oder Lizenzierung schreiben Sie an [email protected] — oder nutzen Sie das Kontaktformular und wählen "Produkt".