Die private KI-Plattform für Teams. Ein Server betreibt die Modelle — jede App und jedes Gerät nutzt sie einfach. AI Server stellt Chat, Embeddings, Bildgenerierung, Sprache und Vision von Ihrer eigenen Hardware über OpenAI-kompatible APIs bereit — für die gesamte AI Suite und jedes kompatible Tool.
Starten Sie kostenlos auf Ihrem eigenen Rechner. Wenn Ihr Team wächst, stellen Sie es im Netzwerk bereit; wenn ein Rechner nicht mehr reicht, macht der AI Gateway-Modus aus mehreren Servern einen einzigen lastverteilten Endpunkt — in Ihrem LAN, in Docker oder auf Kubernetes. Zu keinem Zeitpunkt eine Anbieter-Cloud im Datenpfad.
Im Microsoft Store herunterladen Sehen, was es kann ↓ Lizenzierung & Preise
Ohne Server lädt jeder PC seine eigenen Modelle herunter, braucht seine eigene GPU und wird einzeln konfiguriert und aktualisiert. Mit AI Server werden Modelle einmal heruntergeladen, laufen auf der besten verfügbaren Hardware und stehen allen zur Verfügung.
OpenAI-kompatible Endpunkte für Chat, Embeddings, Bildgenerierung, Sprache-zu-Text (auch Live-Streaming), Text-zu-Sprache, Stimmklonen und Vision — alles von Ihrer Hardware bereitgestellt. Richten Sie jedes kompatible Tool oder Ihren eigenen Code darauf aus.
Jede AI-Suite-App erkennt den Server und lagert ihre KI-Arbeit an ihn aus — ganz ohne Konfiguration. Notizen, PDFs, Übersetzung, Diktat, Bilder, E-Mail und mehr, alle mit einem Satz Modelle auf einem Rechner.
API-Schlüssel mit Plänen pro Schlüssel, Ratenbegrenzungen, Kontingenten und Budgets, Nutzungsanalysen nach App und Modell sowie inhaltsfreie Audit-Protokolle mit signiertem Export. Die Kontrollen, die die IT erwartet — ohne Cloud-Anbieter dazwischen.
Ein Schalter genügt und aus mehreren Servern wird ein einziger Endpunkt: geprüfte Lastverteilung, modellbewusstes Routing, das Rechner mit bereits geladenem Modell bevorzugt, Canary-Rollouts und Upgrades ohne Ausfallzeit.
Eine Desktop-App für den Rechner unter dem Schreibtisch; Container, Kubernetes-Manifeste und ein Helm-Chart für das Rack oder die Cloud. Gleiches Produkt, gleiche APIs, gleiche Lizenz — vom Laptop bis zur GPU-Farm.
Jeder Server bringt sein eigenes Live-Dashboard und native Prometheus-Metriken mit: Flottenzustand, Latenz, Nutzung und Kapazität auf einen Blick — ohne zusätzlichen Monitoring-Stack für den Einstieg.
AI Gateway ist AI Server im Farm-Frontend-Modus. Clients verbinden sich damit genau so, als wäre es ein einzelner AI Server; dahinter erledigt ein Pool von Worker-Servern die eigentliche Inferenz. Fügen Sie einen Rechner hinzu und die Kapazität wächst; nehmen Sie einen für die Wartung heraus und der Traffic wird sanft abgeleitet — keine Anfrage geht verloren.
Unter Kubernetes werden Worker beim Skalieren automatisch erkannt, sodass eine autoskalierende Farm keine manuellen Pool-Änderungen braucht. Der gesamte Bestand bleibt über das integrierte Dashboard und Prometheus-Metriken beobachtbar.
Die kostenlose Stufe ist ein echtes Produkt, keine Testversion: ein vollständiger lokaler KI-Server für alle AI-Suite-Apps auf Ihrem eigenen Rechner, für immer. Kostenpflichtige Stufen beginnen genau dort, wo der Nutzen Rechnergrenzen überschreitet.
Ein vollständiger lokaler KI-Server auf Ihrem eigenen Rechner. Unbegrenzte Nutzung durch jede AI-Suite-App auf diesem Rechner; generische OpenAI-kompatible Clients sind ratenbegrenzt.
Stellen Sie Ihre eigenen Geräte im Netzwerk bereit: LAN-Serving, Betrieb als OS-Dienst, API-Schlüssel für Laptop und Telefon, unbegrenzte generische Clients und ein kleiner Gateway-Pool.
Stellen Sie für andere bereit: kommerzielle Nutzung, unbegrenzte API-Schlüssel, vollständige Governance (Kontingente, Budgets, Audit-Signierung) und eine produktive Gateway-Farm mit Canary-Rollouts und automatischer Worker-Erkennung.
Unbegrenzte Bestände, Organisations-Enrollment mit AI Admin Console, Offline- und Air-Gap-Betrieb sowie Priority-Support. Lizenziert pro Bestand — sprechen Sie mit uns.
Installieren Sie die App kostenlos über den jeweiligen Marktplatz. Ein direktes Personal- oder Commercial-Abo umfasst einen Produktschlüssel, der auf jeder unterstützten Plattform funktioniert.
Zentralisieren Sie teure Modelle und Governance, während Teams vertraute Apps und OpenAI-kompatible Werkzeuge behalten.
Teilen Sie freigegebene Chat-, Übersetzungs-, Text-, Dokument-RAG-, Bild- und Sprachmodelle von einem verwalteten Rechner statt je Arbeitsplatz.
Bereitstellungsmuster lesen →Geben Sie Recht, Gesundheit, Finanzen, Behörden und Forschung nützliche KI, während Prompts, Dateien, Modellzugriff und Audit in der gewählten Grenze bleiben.
Bereitstellungsmuster lesen →Verbinden Sie OpenAI-kompatible Apps, Agenten und CI-Tests mit einem internen Endpunkt. Plattformteams steuern Modelle und Kapazität ohne Vendor-Key je Projekt.
Bereitstellungsmuster lesen →AI Gateway vor Workern über Rechner oder Fehlerdomänen ermöglicht zustandsbasiertes Routing, Warmmodell-Affinität, rollende Wartung und Skalierung ohne Clientänderung.
Bereitstellungsmuster lesen →Belegen Sie Nutzen und Datenschutzgrenze zunächst auf einer Maschine, bevor Sie Benutzer, Richtlinien oder eine Serverfarm hinzufügen.
Wählen Sie eine klar begrenzte Aufgabe wie privaten Chat, Dokumentfragen, Übersetzung oder Transkription sowie die Personen, die sie bewerten.
Wählen Sie Modell und Maschine für erwarteten Kontext, Antwortzeit und gleichzeitige Benutzer. Zuerst auf CPU validieren und bei Bedarf GPU-Kapazität ergänzen.
Bestätigen Sie erlaubte Clients, Modelle, Protokolle und Netzwerkwege. Prompts und Dateien bleiben innerhalb der gewählten Grenze.
Erweitern Sie auf Netzwerkbereitstellung, API-Schlüssel und Quoten. Registrieren Sie die Umgebung bei Bedarf in AI Admin Console oder fügen Sie AI-Gateway-Worker hinzu.
AI Server ist als kostenlose/BYOL-Kubernetes-Anwendung im Microsoft Marketplace und AWS Marketplace verfügbar. Die Cloud-Infrastruktur rechnet Ihr Anbieter ab; dieselbe AI Server Commercial- oder Enterprise-Lizenz aktiviert Gateway und Worker.
Installieren Sie die zertifizierte Kubernetes-Anwendung in einem vorhandenen AKS-Cluster. Validieren Sie die Bereitstellung zunächst mit einem CPU-Knoten und ergänzen Sie dann NVIDIA-GPU-Worker für reale Inferenzlasten.
Im Microsoft Marketplace findenStellen Sie das Helm-Paket aus dem AWS Marketplace auf Amazon EKS bereit. Ein kleiner System-Knotenpool und separate GPU-Worker halten Clusterdienste stabil und machen Inferenzkapazität einfach skalierbar.
Im AWS Marketplace findenAI Server ist kein Proxy zu einer Cloud-API. Die Modelle laufen auf Ihrer Hardware; Anfragen wandern von Ihren Apps zu Ihrem Server und zurück, innerhalb Ihres Perimeters. Offline- und Air-Gap-Betrieb sind unterstützte Bereitstellungsmodi, keine Sonderfälle.
Für Hilfe bei der Bereitstellung, Dimensionierungsberatung, Kubernetes-Fragen oder Lizenzierung schreiben Sie an [email protected] — oder nutzen Sie das Kontaktformular und wählen "Produkt".