チーム向けのプライベート AI プラットフォーム。 1 台のサーバーがモデルを実行し — すべてのアプリとすべてのデバイスがそれを利用するだけです。AI Server は、チャット、埋め込み、画像生成、音声、ビジョンを、あなた自身のハードウェアから OpenAI 互換 API を通じて、AI Suite 全体とあらゆる互換ツールに提供します。
自分のマシンで無料で始められます。チームが大きくなればネットワークに提供し、1 台では足りなくなれば AI Gateway モードが複数のサーバーを 1 つの負荷分散エンドポイントにまとめます — LAN でも、Docker でも、Kubernetes でも。どの段階でもデータ経路にベンダーのクラウドは入りません。
サーバーがなければ、各 PC は自分のモデルをダウンロードし、自分の GPU を必要とし、個別に構成・更新されます。AI Server なら、モデルは一度ダウンロードするだけで、手持ちの最良のハードウェアで動作し、全員に提供されます。
チャット、埋め込み、画像生成、音声認識(ライブストリーミングを含む)、音声合成、ボイスクローン、ビジョンに対応した OpenAI 互換エンドポイント — すべてあなたのハードウェアから提供されます。互換ツールや自作コードをそこに向けてください。
AI Suite の各アプリはサーバーを検出し、AI 処理をそこにオフロードします — 設定は不要です。メモ、PDF、翻訳、ディクテーション、画像、メールなど、すべてが 1 台のマシン上で 1 組のモデルを共有します。
キーごとのプランを設定できる API キー、レート制限、クォータと予算、アプリ・モデル別の使用状況分析、そして署名付きエクスポートに対応した内容を含まない監査ログ。クラウドベンダーを介さずに、IT が求める管理機能を実現します。
スイッチを 1 つ入れるだけで、複数のサーバーが 1 つのエンドポイントになります。ヘルスチェック付きの負荷分散、モデルがすでに温まっているマシンを優先するモデル対応ルーティング、カナリアロールアウト、そしてダウンタイムのないアップグレード。
机の下のマシン向けのデスクトップアプリ、ラックやクラウド向けのコンテナ、Kubernetes マニフェスト、Helm チャート。同じ製品、同じ API、同じライセンス — 1 台のノート PC から GPU ファームまで。
各サーバーは独自のライブダッシュボードとネイティブの Prometheus メトリクスを備えています。フリートの健全性、レイテンシ、使用状況、キャパシティが一目でわかり — 始めるのに追加の監視スタックは不要です。
AI Gateway は、ファームのフロントエンドモードで動作する AI Server です。クライアントは単一の AI Server であるかのように接続し、その背後ではワーカーサーバーのプールが実際の推論を行います。マシンを追加すればキャパシティが増え、保守のために 1 台を停止してもトラフィックは緩やかにドレインされ — 誰のリクエストも失われません。
Kubernetes では、スケールに応じてワーカーが自動的に検出されるため、自動スケーリングするファームでは手動のプール編集は不要です。全体は、組み込みのダッシュボードと Prometheus メトリクスから引き続き監視できます。
無料階層は試用版ではなく本物の製品です。自分のマシン上のすべての AI Suite アプリのための、完全なローカル AI サーバーを、ずっと無料で。有料階層は、価値がマシンの境界を越えるまさにその地点から始まります。
自分のマシン上の完全なローカル AI サーバー。そのマシン上のすべての AI Suite アプリで無制限に利用できます。汎用の OpenAI 互換クライアントにはレート制限があります。
自分のデバイスをネットワーク越しに提供します。LAN 配信、OS サービスとしての実行、ノート PC とスマートフォン向けの API キー、無制限の汎用クライアント、そして小規模なゲートウェイプール。
他の人に提供します。商用利用、無制限の API キー、完全なガバナンス(クォータ、予算、監査署名)、そしてカナリアロールアウトとワーカーの自動検出を備えた本番用ゲートウェイファーム。
無制限の環境、AI Admin Console による組織登録、オフラインおよびエアギャップ運用、優先サポート。環境単位のライセンス — ぜひご相談ください。
アプリは各マーケットプレイスから無料でインストールできます。Personal または Commercial の直接サブスクリプションには、対応するすべてのプラットフォームで使える製品キーが 1 つ含まれます。
高価なモデルとガバナンスを集中管理しながら、各チームは使い慣れたアプリと OpenAI 互換ツールを継続できます。
OpenAI 互換アプリ、エージェント、CI 評価ツールを社内エンドポイントへ接続。各プロジェクトにベンダーキーを埋め込まず、基盤チームがモデルと容量を管理します。
導入パターンを読む →複数マシンや障害ドメインのワーカー前段に AI Gateway を置き、正常性ルーティング、ウォームモデル優先、ローリング保守、クライアント変更なしの拡張を実現します。
導入パターンを読む →ユーザー、ポリシー、サーバーファームを増やす前に、1台のマシンで有用性とプライバシー境界を検証します。
プライベートチャット、文書への質問、翻訳、文字起こしなど範囲の明確な一つの作業と、評価する担当者を決めます。
想定するコンテキスト、応答時間、同時ユーザー数に合わせてモデルとマシンを選びます。まず CPU で検証し、必要なら GPU 容量を追加します。
許可するクライアント、モデル、ログ、ネットワーク経路を確認し、プロンプトとファイルを選んだ境界内に保ちます。
ネットワーク提供、API キー、クォータへ進み、需要に応じて AI Admin Console への登録や AI Gateway ワーカーの追加を行います。
AI Server は Microsoft Marketplace と AWS Marketplace で無料/BYOL の Kubernetes アプリとして提供されています。クラウド基盤の料金はプロバイダーから請求され、同じ AI Server Commercial または Enterprise ライセンスでゲートウェイとワーカーを有効化できます。
認定 Kubernetes アプリを既存の AKS クラスターへインストールします。まず CPU ノードで導入を検証し、実運用の推論には NVIDIA GPU ワーカーを追加します。
Microsoft Marketplace で探すAWS Marketplace の Helm パッケージを Amazon EKS に導入します。小規模なシステムノードプールと独立した GPU ワーカーにより、クラスターサービスを安定させながら推論能力を容易に拡張できます。
AWS Marketplace で探すAI Server はクラウド API へのプロキシではありません。モデルはあなたのハードウェアで動作し、リクエストはあなたのアプリからサーバーへ、そして戻ってくるまで、あなたの境界内を移動します。オフラインおよびエアギャップ運用は、特別な例外ではなくサポートされた展開モードです。
展開の支援、サイジングの助言、Kubernetes に関する質問、ライセンスについては、[email protected] までご連絡ください — またはお問い合わせフォームで「製品」を選択してください。