ワンクリックデプロイ
オープンソースLLMを選んでワンクリックでデプロイ。モデル・推論基盤・GPU環境が自動的に構築されます。
LLM as a Service
ワンクリックデプロイ・専用GPU環境
あらゆるオープンソースLLMを、スケーラブルなGPU環境にワンクリックでデプロイし、本番利用に対応したAPIエンドポイントを取得できます。お客様専用のシステムであり、完全に分離・保護されます。他のテナントと共有されることはありません。
概要
LLM as a Serviceは、お客様の組織専用のオープンソースLLM環境を提供するサービスです。モデルを選び、GPU容量を決めれば、お客様専用のインフラ上に本番利用可能なAPIが自動的に構築されます。
オープンソースLLMを選んでワンクリックでデプロイ。モデル・推論基盤・GPU環境が自動的に構築されます。
GPU台数を固定するか、ワークロードに合わせて容量を自動スケーリングするかを選択できます。
デプロイごとに、本番トラフィックに対応したAPIエンドポイントが発行されます。初日からアプリケーションに接続できます。
シングルテナントで完全に隔離された環境です。ハードウェア・モデル層のいずれにおいても、他のお客様と共有されることはありません。
仕組み
DevOpsも、GPUの調達も、モデルサービスのエンジニアリングも不要です。インフラはプラットフォームが担い、お客様のチームはアプリケーションに集中できます。
カタログから任意のオープンソースLLMを選択します。お持ち込みのモデルにも対応します。
GPU台数を固定するか、需要に合わせて自動スケーリングを有効にします。
環境・モデル・推論基盤が、お客様専用として自動的に構築されます。
本番利用のAPIエンドポイントが発行され、チームはすぐに統合を始められます。
日本国内で稼働する、お客様専用システム
お客様のモデルは、日本各地のデータセンターに展開されたGPU上で、お客様の組織専用の環境として動作します。
推論は日本各地のデータセンターに展開されたGPU容量上で実行されます。プロンプトとレスポンスは国内に留まります。
お客様のAPIはプライベートエンドポイント経由で提供され、お客様のネットワークからのみアクセスできます。
すべてのレイヤーでシングルテナント隔離を実現します。モデルもデータもトラフィックも、他のお客様からは見えません。
課金とコントロール
実際に使用したGPU容量に対して、GPU秒単位で課金されます。支出・利用の上限はお客様自身で設定できます。
実際に消費したGPU容量に対してのみ、GPU秒単位で課金されます。アイドル時間の課金も、想定外の請求もありません。
支出・利用の上限をお客様自身で設定できます。デプロイメントは、お客様が定めた範囲内で動作します。
ファイナンスダッシュボードで利用状況と支出をリアルタイムに確認でき、経理向けの請求書もダウンロードできます。
エンタープライズ機能
セキュリティ・コンプライアンス部門が必要とする機能を、最初から設計に組み込んでいます。
パブリックインターネットを経由せず、お客様のネットワークから接続できます。
モデル利用状況とアクセスの詳細な監査証跡を記録し、コンプライアンス部門向けに出力できます。
チーム単位・アプリケーション単位の利用状況を確認でき、社内チャージバックや監視に活用できます。
高い可用性をSLAとして文書で保証し、専任のオンボーディングチームが支援します。
対象となるお客様
LLM as a Serviceは、機密性の高いデータを扱いながら、自社専用の生成AI基盤を持ちたい組織のために設計されています。
契約書・申込書・書簡の抽出と要約を、お客様専用の環境で国内実行できます。
社内ナレッジに対する回答エンジン。コンプライアンス部門がレビューできるアクセス制御と監査可能性を備えています。
カスタマーデータをお客様の境界内に保ったまま、支援・自動化された応答を提供します。
お客様のモデル。お客様のデータ。お客様の環境。お客様のコントロール。
モデルの要件、想定ワークロード、コンプライアンス上の制約をお聞かせください。1営業日以内に、次のステップと技術的なウォークスルーをご案内いたします。