Prywatna platforma AI dla zespołów. Jeden serwer uruchamia modele — każda aplikacja i każde urządzenie po prostu z nich korzysta. AI Server udostępnia czat, osadzenia (embeddings), generowanie obrazów, mowę i wizję z Twojego własnego sprzętu, przez API zgodne z OpenAI, całemu pakietowi AI Suite i dowolnemu zgodnemu narzędziu.
Zacznij za darmo na własnej maszynie. Gdy zespół rośnie, obsłuż swoją sieć; gdy jedna maszyna to za mało, tryb AI Gateway zmienia kilka serwerów w jeden punkt końcowy z równoważeniem obciążenia — w Twojej sieci LAN, w Dockerze lub na Kubernetes. Na żadnym etapie żadnej chmury dostawcy w ścieżce danych.
Pobierz w Microsoft Store Zobacz, co potrafi ↓ Licencje i ceny
Bez serwera każdy komputer pobiera własne modele, potrzebuje własnego GPU oraz jest konfigurowany i aktualizowany osobno. Z AI Server modele pobierasz raz, działają na najlepszym sprzęcie, jaki masz, i obsługują wszystkich.
Punkty końcowe zgodne z OpenAI dla czatu, osadzeń, generowania obrazów, mowy na tekst (w tym strumieniowania na żywo), tekstu na mowę, klonowania głosu i wizji — wszystko udostępniane z Twojego sprzętu. Skieruj na nie dowolne zgodne narzędzie lub własny kod.
Każda aplikacja AI Suite wykrywa serwer i przekazuje mu swoją pracę AI — bez żadnej konfiguracji. Notatki, pliki PDF, tłumaczenie, dyktowanie, obrazy, poczta i więcej — wszystkie korzystają z jednego zestawu modeli na jednej maszynie.
Klucze API z planami dla każdego klucza, limity szybkości, przydziały i budżety, analityka użycia według aplikacji i modelu oraz pozbawione treści dzienniki audytu z podpisanym eksportem. Kontrole, których oczekuje IT, bez dostawcy chmury w obiegu.
Przełącz jeden przełącznik, a wiele serwerów staje się jednym punktem końcowym: równoważenie obciążenia z kontrolą stanu, routing świadomy modelu, który preferuje maszyny z już rozgrzanym modelem, wdrożenia canary i aktualizacje bez przestojów.
Aplikacja desktopowa na maszynę pod biurkiem; kontenery, manifesty Kubernetes i chart Helm na szafę serwerową lub chmurę. Ten sam produkt, te same API, ta sama licencja — od jednego laptopa po farmę GPU.
Każdy serwer udostępnia własny pulpit na żywo oraz natywne metryki Prometheus: kondycja floty, opóźnienie, użycie i przepustowość na pierwszy rzut oka — bez dodatkowego stosu monitoringu na start.
AI Gateway to AI Server działający w trybie frontonu farmy. Klienci łączą się z nim dokładnie tak, jakby był pojedynczym AI Server; za nim pula serwerów roboczych (workerów) wykonuje właściwą inferencję. Dodaj maszynę, a przepustowość rośnie; wyłącz jedną na czas konserwacji, a ruch płynnie się wycofuje — niczyje żądanie nie zostaje odrzucone.
Na Kubernetes workery są wykrywane automatycznie w miarę skalowania, więc farma z autoskalowaniem nie wymaga ręcznych zmian puli. Cała infrastruktura pozostaje obserwowalna z wbudowanego pulpitu i metryk Prometheus.
Poziom darmowy to prawdziwy produkt, a nie wersja próbna: pełny lokalny serwer AI dla wszystkich aplikacji AI Suite na Twojej własnej maszynie, na zawsze. Poziomy płatne zaczynają się dokładnie tam, gdzie wartość przekracza granice maszyny.
Pełny lokalny serwer AI na Twojej własnej maszynie. Nieograniczone użycie przez każdą aplikację AI Suite na tej maszynie; ogólni klienci zgodni z OpenAI mają ograniczoną szybkość.
Obsłuż własne urządzenia w swojej sieci: udostępnianie w LAN, uruchamianie jako usługa systemu, klucze API dla laptopa i telefonu, nieograniczeni klienci ogólni oraz mała pula bramy.
Obsługuj innych: użycie komercyjne, nieograniczone klucze API, pełne zarządzanie (przydziały, budżety, podpisywanie audytu) oraz produkcyjna farma bramy z wdrożeniami canary i automatycznym wykrywaniem workerów.
Nieograniczone środowiska, rejestracja organizacji za pomocą AI Admin Console, praca offline i w trybie odizolowanym od sieci oraz wsparcie priorytetowe. Licencja na środowisko — porozmawiaj z nami.
AI Server nie jest serwerem proxy do chmurowego API. Modele działają na Twoim sprzęcie; żądania podróżują z Twoich aplikacji do Twojego serwera i z powrotem, w obrębie Twojego perymetru. Praca offline i w trybie odizolowanym od sieci to obsługiwane tryby wdrożenia, a nie specjalne wyjątki.
W sprawie pomocy przy wdrożeniu, doradztwa co do rozmiaru, pytań o Kubernetes lub licencjonowania napisz na [email protected] — albo użyj formularza kontaktowego i wybierz „Produkt”.