フレキシブルティア
中断可能、大幅割引
一時停止と再開が可能なジョブ(バッチ処理、実験、事前学習など)は、空き容量を利用して大幅な割引で実行できます。容量があるときにスケジュールされ、ないときは安全に中断・再開されます。
- 大幅割引のコンピュート
- 容量に応じて一時停止・再開
- バッチ・研究・事前学習に最適
AIプラットフォーム
AIプラットフォームは、サーバーの管理ではなく、お客様のコンテナジョブをそのまま投入できる、すぐに使える実行環境です。各ジョブは、中断可能な作業向けの大幅割引フレキシブルティアか、本番向けのプロダクションティアのどちらかをお選びいただき、運用はすべてKubernetesのオーケストレーションが担います。
ティアの仕組み
コストと確実性のどちらを優先するかを、ジョブごとにお客様が決められます。あとはプラットフォームにお任せください。
中断可能、大幅割引
一時停止と再開が可能なジョブ(バッチ処理、実験、事前学習など)は、空き容量を利用して大幅な割引で実行できます。容量があるときにスケジュールされ、ないときは安全に中断・再開されます。
最上位パフォーマンス、優先実行を保証
必ず期限内に完了させたいジョブ(本番推論や顧客向けワークロードなど)には、プロダクションティアが容量を確保し、スケジューリングを優先します。安定したパフォーマンスをお約束します。
仕組み
サーバーの調達もクラスターの管理も不要です。チームはこれまでと同じように、コンテナでソフトウェアを作り続けるだけです。
01
ワークロードを標準のコンテナイメージとして構築します。エンジニアが日頃使っているのと同じ形式です。
02
プラットフォームにジョブを送信し、ティアを選択します。キャパシティ計画もインフラの申請も不要です。
03
KubernetesベースのオーケストレーションがGPU容量にジョブをスケジュールし、必要に応じて自動スケーリング、障害時には自動復旧します。
料金モデル
利用量はメータリングされ、選択したティアに応じて課金されます。コスト重視の実験ジョブはフレキシブルティアで、確実性が必要な本番ジョブはプロダクションティアで。ファイナンスダッシュボードでリアルタイムに確認できます。
各ジョブは実行されたティアに応じて課金されます。
使っていない間の課金はありません。ジョブが実際に使用したコンピュート分だけお支払いいただきます。
利用量と支出をリアルタイムで確認でき、予算上限の設定や請求書のダウンロードも可能です。
ユースケース
実験から本番まで、作り直しなしでスケールできるひとつのプラットフォームです。
長時間のジョブをフレキシブルティアで実行。空き容量に合わせてスケジュールされ、大幅な割引が適用されます。
顧客向けワークロードをプロダクションティアで実行。優先スケジューリングと安定したパフォーマンスを実現します。
素早い試行錯誤と自動化されたモデル評価。インフラ管理なしでジョブを立ち上げたり終了したりできます。
次のステップ
AIプラットフォームはTara Cloudの製品のひとつです。他のサービスとのつながりもご覧ください。
ワークロード、実行するコンテナイメージ、パフォーマンス要件をお聞かせください。シニアメンバーが1営業日以内にご返信いたします。