為團隊而設的私有 AI 平台。一部伺服器運行模型 — 每個應用程式、每部裝置直接使用它們。AI Server 從你自己的硬件出發,透過與 OpenAI 相容的 API,向整個 AI Suite 以及任何相容工具提供聊天、嵌入、圖像生成、語音和視覺能力。
在你自己的機器上免費開始。當團隊壯大時,為你的網絡提供服務;當一部機器不夠用時,AI Gateway 模式會把多部伺服器變成單一的負載平衡端點 — 無論是在你的區域網絡、Docker 還是 Kubernetes 上。任何環節都不會有供應商雲端進入資料路徑。
沒有伺服器時,每部電腦都要下載自己的模型、需要自己的 GPU,並且要單獨設定和更新。有了 AI Server,模型只需下載一次,在你擁有的最佳硬件上運行,並為所有人提供服務。
與 OpenAI 相容的端點,涵蓋聊天、嵌入、圖像生成、語音轉文字(包括即時串流)、文字轉語音、語音複製和視覺 — 全部由你的硬件提供。將任何相容工具或你自己的程式碼指向它即可。
每個 AI Suite 應用程式都會發現該伺服器並把 AI 工作卸載給它 — 零設定。筆記、PDF、翻譯、聽寫、圖像、電郵等等,全部在一部機器上共用同一組模型。
具備按金鑰方案的 API 金鑰、速率限制、配額與預算、按應用程式和模型的使用分析,以及具簽署匯出的無內容審計日誌。IT 期望的各項管控,毋須雲端供應商介入。
撥動一個開關,多部伺服器即成為單一端點:經健康檢查的負載平衡、優先選擇已預熱該模型的機器的模型感知路由、金絲雀發布,以及零停機升級。
為枱底機器而設的桌面應用程式;為機架或雲端而設的容器、Kubernetes 資訊清單和 Helm chart。相同的產品、相同的 API、相同的授權 — 由一部手提電腦到一整個 GPU 農場。
每部伺服器都自備即時儀表板和原生 Prometheus 指標:一眼即可掌握叢集健康、延遲、使用情況和容量 — 毋須額外的監控堆疊即可上手。
AI Gateway 就是以農場前端模式運行的 AI Server。用戶端連接它的方式與連接單一 AI Server 完全相同;在它背後,一組工作伺服器(worker)執行實際推論。加入一部機器,容量隨之增長;為維護而下線一部時,流量會平順排走 — 不會丟棄任何人的請求。
在 Kubernetes 上,worker 會在擴縮時被自動發現,因此自動擴縮的農場毋須手動編輯池。整個叢集仍可透過內置儀表板和 Prometheus 指標進行觀測。
免費層是一款真正的產品,而非試用:一部完整的本機 AI 伺服器,永久為你自己機器上的所有 AI Suite 應用程式服務。付費層恰好由價值跨越機器邊界之處開始。
在你自己機器上的一部完整本機 AI 伺服器。該機器上的每個 AI Suite 應用程式都可無限使用;通用的 OpenAI 相容用戶端會受到速率限制。
跨網絡為你自己的裝置提供服務:區域網絡服務、作為作業系統服務運行、為手提電腦和手機提供 API 金鑰、無限的通用用戶端,以及一個小型閘道池。
為他人提供服務:商業用途、無限 API 金鑰、完整管治(配額、預算、審計簽署),以及具金絲雀發布和自動 worker 發現的生產級閘道農場。
無限規模的部署、透過 AI Admin Console 進行組織註冊、離線與氣隙運行,以及優先支援。按部署規模授權 — 歡迎與我們聯絡。
AI Server 並非通往雲端 API 的代理。模型在你的硬件上運行;請求在你的範圍內,由你的應用程式前往你的伺服器再返回。離線與氣隙運行是受支援的部署模式,而非特殊例外。
如需部署協助、規模建議、Kubernetes 相關問題或授權查詢,請寫信至 [email protected] — 或使用聯絡表單並選擇「產品」。