AI Server

Die private KI-Plattform für Teams. Ein Server betreibt die Modelle — jede App und jedes Gerät nutzt sie einfach. AI Server stellt Chat, Embeddings, Bildgenerierung, Sprache und Vision von Ihrer eigenen Hardware über OpenAI-kompatible APIs bereit — für die gesamte AI Suite und jedes kompatible Tool.

Starten Sie kostenlos auf Ihrem eigenen Rechner. Wenn Ihr Team wächst, stellen Sie es im Netzwerk bereit; wenn ein Rechner nicht mehr reicht, macht der AI Gateway-Modus aus mehreren Servern einen einzigen lastverteilten Endpunkt — in Ihrem LAN, in Docker oder auf Kubernetes. Zu keinem Zeitpunkt eine Anbieter-Cloud im Datenpfad.

Im Microsoft Store herunterladen Sehen, was es kann ↓ Lizenzierung & Preise

WAS AI SERVER LEISTET

Eine Installation für alles

Ohne Server lädt jeder PC seine eigenen Modelle herunter, braucht seine eigene GPU und wird einzeln konfiguriert und aktualisiert. Mit AI Server werden Modelle einmal heruntergeladen, laufen auf der besten verfügbaren Hardware und stehen allen zur Verfügung.

Universelle KI-APIs

OpenAI-kompatible Endpunkte für Chat, Embeddings, Bildgenerierung, Sprache-zu-Text (auch Live-Streaming), Text-zu-Sprache, Stimmklonen und Vision — alles von Ihrer Hardware bereitgestellt. Richten Sie jedes kompatible Tool oder Ihren eigenen Code darauf aus.

Betreibt die gesamte AI Suite

Jede AI-Suite-App erkennt den Server und lagert ihre KI-Arbeit an ihn aus — ganz ohne Konfiguration. Notizen, PDFs, Übersetzung, Diktat, Bilder, E-Mail und mehr, alle mit einem Satz Modelle auf einem Rechner.

Governance integriert

API-Schlüssel mit Plänen pro Schlüssel, Ratenbegrenzungen, Kontingenten und Budgets, Nutzungsanalysen nach App und Modell sowie inhaltsfreie Audit-Protokolle mit signiertem Export. Die Kontrollen, die die IT erwartet — ohne Cloud-Anbieter dazwischen.

Skaliert mit AI Gateway

Ein Schalter genügt und aus mehreren Servern wird ein einziger Endpunkt: geprüfte Lastverteilung, modellbewusstes Routing, das Rechner mit bereits geladenem Modell bevorzugt, Canary-Rollouts und Upgrades ohne Ausfallzeit.

Läuft überall

Eine Desktop-App für den Rechner unter dem Schreibtisch; Container, Kubernetes-Manifeste und ein Helm-Chart für das Rack oder die Cloud. Gleiches Produkt, gleiche APIs, gleiche Lizenz — vom Laptop bis zur GPU-Farm.

Auf Beobachtbarkeit ausgelegt

Jeder Server bringt sein eigenes Live-Dashboard und native Prometheus-Metriken mit: Flottenzustand, Latenz, Nutzung und Kapazität auf einen Blick — ohne zusätzlichen Monitoring-Stack für den Einstieg.

AI GATEWAY

Von einem Server zur Farm — ohne einen einzigen Client zu ändern

AI Gateway ist AI Server im Farm-Frontend-Modus. Clients verbinden sich damit genau so, als wäre es ein einzelner AI Server; dahinter erledigt ein Pool von Worker-Servern die eigentliche Inferenz. Fügen Sie einen Rechner hinzu und die Kapazität wächst; nehmen Sie einen für die Wartung heraus und der Traffic wird sanft abgeleitet — keine Anfrage geht verloren.

Unter Kubernetes werden Worker beim Skalieren automatisch erkannt, sodass eine autoskalierende Farm keine manuellen Pool-Änderungen braucht. Der gesamte Bestand bleibt über das integrierte Dashboard und Prometheus-Metriken beobachtbar.

Was das Gateway für Sie übernimmt

  • Lastverteilung — Round-Robin, geringste Latenz, wenigste Verbindungen, gewichtet oder pro Client fest.
  • Modellbewusstes Routing — Anfragen gehen an einen Rechner, der das angeforderte Modell bereits geladen hat.
  • Failover — ein ausfallender Worker wird auf einem gesunden erneut versucht, bevor der Client etwas merkt.
  • Canary-Rollouts — senden Sie einen konstanten Teil des Traffics an neue Rechner, bevor Sie ihnen ganz vertrauen.
  • Backpressure — wenn jeder Worker ausgelastet ist, erhalten Aufrufer ein ehrliches "gleich erneut versuchen" statt eines Timeouts.
  • Upgrades ohne Ausfallzeit — einen Worker leeren, aktualisieren und in den Pool zurückgeben.
EDITIONEN & STUFEN

Kostenlos starten. Mitwachsen, wenn Ihr Team wächst.

Die kostenlose Stufe ist ein echtes Produkt, keine Testversion: ein vollständiger lokaler KI-Server für alle AI-Suite-Apps auf Ihrem eigenen Rechner, für immer. Kostenpflichtige Stufen beginnen genau dort, wo der Nutzen Rechnergrenzen überschreitet.

Kostenlos

Ein vollständiger lokaler KI-Server auf Ihrem eigenen Rechner. Unbegrenzte Nutzung durch jede AI-Suite-App auf diesem Rechner; generische OpenAI-kompatible Clients sind ratenbegrenzt.

Pro Personal

Stellen Sie Ihre eigenen Geräte im Netzwerk bereit: LAN-Serving, Betrieb als OS-Dienst, API-Schlüssel für Laptop und Telefon, unbegrenzte generische Clients und ein kleiner Gateway-Pool.

Pro Commercial

Stellen Sie für andere bereit: kommerzielle Nutzung, unbegrenzte API-Schlüssel, vollständige Governance (Kontingente, Budgets, Audit-Signierung) und eine produktive Gateway-Farm mit Canary-Rollouts und automatischer Worker-Erkennung.

Enterprise

Unbegrenzte Bestände, Organisations-Enrollment mit AI Admin Console, Offline- und Air-Gap-Betrieb sowie Priority-Support. Lizenziert pro Bestand — sprechen Sie mit uns.

PRIVAT DURCH ARCHITEKTUR

Ihre Prompts verlassen niemals Ihr Netzwerk — weil es kein Ziel dafür gibt

AI Server ist kein Proxy zu einer Cloud-API. Die Modelle laufen auf Ihrer Hardware; Anfragen wandern von Ihren Apps zu Ihrem Server und zurück, innerhalb Ihres Perimeters. Offline- und Air-Gap-Betrieb sind unterstützte Bereitstellungsmodi, keine Sonderfälle.

  • Keine Anbieter-Cloud im Datenpfad. Prompts, Dokumente und generierte Inhalte bleiben zwischen Ihren Clients und Ihrem Server.
  • Inhaltsfreie Aufzeichnungen. Nutzungsanalysen und Audit-Protokolle erfassen, wer wann was aufgerufen hat — nie den Text eines Prompts oder einer Antwort.
  • Lizenzierung, die sicher ausfällt. Sollte unser Lizenzdienst je nicht erreichbar sein, arbeitet Ihre lizenzierte Flotte weiter. Ihre Verfügbarkeit hängt nicht von unserer ab.
  • Ihre Schlüssel, Ihre Regeln. API-Schlüssel werden von Ihnen auf Ihrem Server ausgestellt und widerrufen — keine Konten in fremder Cloud.

Fragen zu AI Server oder AI Gateway?

Für Hilfe bei der Bereitstellung, Dimensionierungsberatung, Kubernetes-Fragen oder Lizenzierung schreiben Sie an [email protected] — oder nutzen Sie das Kontaktformular und wählen "Produkt".

Produkt-Updates abonnieren

Neue kostenlose KI-Produkte, größere Updates und Releases, die nur über diese Seite verfügbar sind. Kein Spam.