Research
専用容量で研究開発を始める研究室・MLチーム向け。
環境込み、GPU利用量を秒単位で計上
- 専用GPU環境
- 60秒未満のワンクリッククラスター起動
- 日本国内でのデータレジデンシー
- 営業時間内のテクニカルサポート
料金
2つのサービスラインと、GPU秒単位・トークン単位・ノード時間単位の透明な課金モデル。規制ワークロードにはそれぞれエンタープライズ契約をご用意しています。最終条件はサービス契約書にて合意します。
GPUプラン
日本国内の専用・分離されたGPUインフラで、学習・推論に対応します。課金はプランによって異なり、最終的な構成と条件はワークロードに応じて決定します。
専用容量で研究開発を始める研究室・MLチーム向け。
環境込み、GPU利用量を秒単位で計上
分離とサポートが必要な本番の学習・推論ワークロード向け。
予約容量をノード時間単位で請求
固有のコンプライアンス・アーキテクチャ要件がある銀行・規制企業向け。
容量・契約条件は個別にご相談
課金の詳細はサービス契約書にて確定します。
LLMサービス
モデルの利用方法は2つ。GPU秒単位の専用デプロイか、トークン単位の共有エンドポイントか。いずれもOpenAI互換の単一APIからご利用いただけます。
オープンウェイトモデル
オープンウェイトモデルをTara Cloud自社のGPUインフラ上でホスト。すべてのプロンプトとレスポンスは日本国内に留まります。
共有エンドポイントはトークン単位、専用デプロイはGPU秒単位
フロンティアモデル
公式APIを同じ条件で利用しながら、Tara Cloud経由の円建て一括請求をご利用いただけます。OpenAI・Anthropicの公式モデルは各ベンダーの公式API経由で提供されるため、推論が日本国外で実行される場合があります。
トークン単位の課金、円建ての月次請求書