AI Server

Het private AI-platform voor teams. Eén server draait de modellen — elke app en elk apparaat gebruikt ze gewoon. AI Server levert chat, embeddings, beeldgeneratie, spraak en vision vanaf je eigen hardware, via OpenAI-compatibele API's, aan de hele AI Suite en aan elk compatibel hulpmiddel.

Begin gratis op je eigen machine. Als je team groeit, bedien je je netwerk; als één machine niet genoeg is, maakt de AI Gateway-modus van meerdere servers één load-balanced eindpunt — op je LAN, in Docker of op Kubernetes. Op geen enkel moment een cloud van een leverancier in het datapad.

Download in de Microsoft Store Zie wat het doet ↓ Licenties & prijzen

WAT AI SERVER DOET

Eén installatie die alles aandrijft

Zonder server downloadt elke pc zijn eigen modellen, heeft zijn eigen GPU nodig en wordt afzonderlijk geconfigureerd en bijgewerkt. Met AI Server worden modellen één keer gedownload, draaien ze op de beste hardware die je hebt en bedienen ze iedereen.

Universele AI-API's

OpenAI-compatibele eindpunten voor chat, embeddings, beeldgeneratie, spraak-naar-tekst (inclusief live streaming), tekst-naar-spraak, stemklonen en vision — alles geleverd vanaf je eigen hardware. Richt er elk compatibel hulpmiddel of je eigen code op.

Drijft de hele AI Suite aan

Elke AI Suite-app ontdekt de server en besteedt zijn AI-werk eraan uit — zonder enige configuratie. Notities, pdf's, vertaling, dictaat, afbeeldingen, e-mail en meer, allemaal met één set modellen op één machine.

Governance ingebouwd

API-sleutels met plannen per sleutel, snelheidslimieten, quota's en budgetten, gebruiksanalyses per app en model, en inhoudsvrije auditlogboeken met ondertekende export. De controles die IT verwacht, zonder een cloudleverancier ertussen.

Schaalt met AI Gateway

Zet één schakelaar om en meerdere servers worden één eindpunt: load balancing met gezondheidscontroles, modelbewuste routering die machines verkiest waar het model al warm is, canary-uitrol en upgrades zonder downtime.

Draait overal

Een desktop-app voor de machine onder het bureau; containers, Kubernetes-manifests en een Helm-chart voor het rack of de cloud. Zelfde product, zelfde API's, zelfde licentie — van één laptop tot een GPU-farm.

Observeerbaar van opzet

Elke server host zijn eigen live dashboard en native Prometheus-metrics: gezondheid van de vloot, latentie, gebruik en capaciteit in één oogopslag — zonder extra monitoringstack om te beginnen.

AI GATEWAY

Van één server naar een farm — zonder ook maar één client te wijzigen

AI Gateway is AI Server in zijn farm-frontendmodus. Clients maken er verbinding mee precies alsof het één AI Server is; erachter doet een pool van worker-servers het eigenlijke inferentiewerk. Voeg een machine toe en de capaciteit groeit; haal er een weg voor onderhoud en het verkeer wordt soepel afgevoerd — niemands verzoek wordt gedropt.

Op Kubernetes worden workers automatisch ontdekt naarmate ze schalen, zodat een automatisch schalende farm geen handmatige poolaanpassingen nodig heeft. De hele omgeving blijft observeerbaar vanuit het ingebouwde dashboard en Prometheus-metrics.

Wat de Gateway voor je afhandelt

  • Load balancing — round-robin, laagste latentie, minste verbindingen, gewogen of sticky per client.
  • Modelbewuste routering — verzoeken gaan naar een machine die het gevraagde model al warm heeft.
  • Failover — een falende worker wordt opnieuw geprobeerd op een gezonde voordat de client het merkt.
  • Canary-uitrol — stuur een consistent deel van het verkeer naar nieuwe machines voordat je ze volledig vertrouwt.
  • Backpressure — als elke worker verzadigd is, krijgen aanroepers een eerlijk "probeer het zo opnieuw" in plaats van een time-out.
  • Upgrades zonder downtime — leeg een worker, werk hem bij en zet hem terug in de pool.
EDITIES & NIVEAUS

Begin gratis. Groei mee met je team.

Het gratis niveau is een echt product, geen proefversie: een volledige lokale AI-server voor alle AI Suite-apps op je eigen machine, voor altijd. Betaalde niveaus beginnen precies waar de waarde de grenzen van een machine overschrijdt.

Gratis

Een volledige lokale AI-server op je eigen machine. Onbeperkt gebruik door elke AI Suite-app op die machine; generieke OpenAI-compatibele clients zijn snelheidsbeperkt.

Pro Personal

Bedien je eigen apparaten over je netwerk: LAN-serving, draaien als een OS-service, API-sleutels voor je laptop en telefoon, onbeperkte generieke clients en een kleine gateway-pool.

Pro Commercial

Bedien anderen: commercieel gebruik, onbeperkte API-sleutels, volledige governance (quota's, budgetten, audit-ondertekening) en een productie-gatewayfarm met canary-uitrol en automatische worker-ontdekking.

Enterprise

Onbeperkte omgevingen, organisatie-inschrijving met AI Admin Console, offline en air-gapped gebruik, en prioriteitsondersteuning. Gelicentieerd per omgeving — neem contact met ons op.

Koop Pro in onze Store → Licenties & prijzen Praat met ons over Enterprise

Installeer de app gratis vanuit de bijbehorende marktplaats. Een rechtstreeks Personal- of Commercial-abonnement bevat één productsleutel die op elk ondersteund platform werkt.

TOEPASSINGEN

Eén private-AI-platform, meerdere implementatiepatronen

Centraliseer kostbare modellen en governance terwijl teams vertrouwde apps en OpenAI-compatibele tools blijven gebruiken.

Kantoor- en kennisteams

Deel goedgekeurde chat-, vertaal-, herschrijf-, document-RAG-, beeld- en spraakmodellen vanaf één beheerde machine in plaats van elke werkplek.

Implementatiepatroon lezen →

Gereguleerde en gevoelige workloads

Geef juridische, zorg-, financiële, overheids- en onderzoeksteams AI terwijl prompts, bestanden, modeltoegang en audit binnen de gekozen grens blijven.

Implementatiepatroon lezen →

Ontwikkelaars en intern API-platform

Verbind OpenAI-compatibele apps, agents en CI-evaluatie met een intern endpoint. Platformteams beheren modellen en capaciteit zonder vendorsleutel per project.

Implementatiepatroon lezen →

Vestigingen, failover en GPU-farms

Plaats AI Gateway voor verspreide workers voor statusroutering, warm-model-affiniteit, rollend onderhoud en groei zonder clientherconfiguratie.

Implementatiepatroon lezen →
BEGIN KLEIN

Plan de eerste implementatie rond één echte workflow

Bewijs nuttig werk en de privacygrens op één machine voordat u gebruikers, beleid of een serverfarm toevoegt.

1. Kies de werklast

Kies één begrensde taak, zoals privéchat, vragen over documenten, vertaling of transcriptie, plus de mensen die deze beoordelen.

2. Stem de hardware af

Kies model en machine voor de verwachte context, reactietijd en gelijktijdige gebruikers. Valideer eerst op CPU of voeg GPU-capaciteit toe wanneer nodig.

3. Test de grens

Bevestig welke clients, modellen, logboeken en netwerkroutes zijn toegestaan. Houd prompts en bestanden binnen de gekozen grens.

4. Voeg controle toe bij groei

Ga naar netwerkbediening, API-sleutels en quota en registreer de omgeving daarna in AI Admin Console of voeg AI Gateway-workers toe wanneer de vraag dat rechtvaardigt.

IMPLEMENTEER IN UW CLOUD

Gecertificeerde levering voor Azure en AWS

AI Server is als gratis/BYOL Kubernetes-app beschikbaar in Microsoft Marketplace en AWS Marketplace. Uw provider factureert de cloudinfrastructuur; dezelfde AI Server Commercial- of Enterprise-licentie activeert gateway en workers.

Microsoft Azure

Installeer de gecertificeerde Kubernetes-app in een bestaand AKS-cluster. Begin met een CPU-node voor validatie en voeg NVIDIA GPU-workers toe voor echte inferentieworkloads.

Zoek in Microsoft Marketplace

Amazon Web Services

Implementeer het Helm-pakket uit AWS Marketplace op Amazon EKS. Een kleine pool systeemnodes en aparte GPU-workers houden clusterdiensten stabiel en maken schalen eenvoudig.

Zoek in AWS Marketplace
PRIVÉ DOOR ARCHITECTUUR

Je prompts verlaten nooit je netwerk — want er is nergens voor ze om heen te gaan

AI Server is geen proxy naar een cloud-API. De modellen draaien op je hardware; verzoeken reizen van je apps naar je server en terug, binnen je perimeter. Offline en air-gapped gebruik zijn ondersteunde implementatiemodi, geen speciale uitzonderingen.

  • Geen cloud van een leverancier in het datapad. Prompts, documenten en gegenereerde inhoud blijven tussen je clients en je server.
  • Inhoudsvrije registraties. Gebruiksanalyses en auditlogboeken registreren wie wat wanneer aanriep — nooit de tekst van een prompt of een antwoord.
  • Licenties die veilig falen. Als onze licentiedienst ooit onbereikbaar is, blijft je gelicentieerde vloot bedienen. Jouw uptime hangt niet af van de onze.
  • Jouw sleutels, jouw regels. API-sleutels worden door jou uitgegeven en ingetrokken, op je eigen server — geen accounts in andermans cloud.
Bekijk de huidige vertrouwens- en controlematrix

Vragen over AI Server of AI Gateway?

Voor hulp bij implementatie, adviezen over sizing, Kubernetes-vragen of licenties, schrijf naar [email protected] — of gebruik het contactformulier en kies "Product".

Abonneer op productupdates

Nieuwe gratis AI-producten, belangrijke updates en releases die alleen via deze site beschikbaar zijn. Geen spam.