メインコンテンツへスキップ
営業に問い合わせる

ベンチマーク

性能を、一目で比較。

独立系ベンチマークBenchLMのスコアを、フロンティアモデルとオープンウェイトモデルで比較できます。モデル名ではなく、業務への適合でお選びいただけます。

13
比較対象モデル
84.4
最高スコア(BenchLM)
1.05M
最大コンテキスト

フロンティアモデル

OpenAI・Anthropicの公式モデルを、Tara Cloudが再販にて提供。

公式APIを同じ条件で利用しながら、Tara Cloud経由の円建て一括請求と、請求書1枚での管理を実現します。

  1. 01

    Claude Fable 5.1

    Anthropic

    84.4

    コンテキスト

    1M

  2. 02

    GPT-6 Astra

    OpenAI

    84.1

    コンテキスト

    1.05M

  3. 03

    Claude Opus 5

    Anthropic

    81.6

    コンテキスト

  4. 04

    GPT-5.6 Sol

    OpenAI

    80.5

    コンテキスト

    1.05M

  5. 05

    GPT-5.4

    OpenAI

    70.8

    コンテキスト

    1.05M

  6. 06

    Claude Sonnet 5

    Anthropic

    69.8

    コンテキスト

    1M

Tara Cloudによる公式APIの再販です。円建ての一括請求をご利用いただけます。

業務に応じた性能選定

ワークロードに合ったモデルを。

最高峰モデルの85%の性能

Qwen3.8 Maxは、最高峰モデルの85%のベンチマーク性能に1Mのコンテキストを備え、大量処理の本番ワークロードに適しています。

最高峰モデルの78%の性能

GLM-5.3-Flashは、最高峰モデルの78%の性能をコンパクトな構成で実現し、スループット重視のパイプラインに適しています。

オープンウェイトモデル

Tara CloudのGPUで、日本国内から提供。

オープンウェイトモデルをTara Cloud自社のGPUインフラ上でホスト。すべてのプロンプトとレスポンスは日本国内に留まります。

  1. 01

    Qwen3.8 Max

    Alibaba

    71.6

    コンテキスト

    1M

  2. 02

    GLM-5.3

    Z.AI

    68.3

    コンテキスト

    1M

  3. 03

    GLM-5.3-Flash

    Z.AI

    66.0

    コンテキスト

    1M

  4. 04

    Kimi K2.6

    Moonshot AI

    65.4

    コンテキスト

    256K

  5. 05

    MiniMax M3

    MiniMax

    61.5

    コンテキスト

    1M

  6. 06

    DeepSeek V3.2

    DeepSeek

    56.9

    コンテキスト

    128K

  7. 07

    GPT-OSS 120B

    OpenAI

    45.7

    コンテキスト

    128K

すべてのデータは日本国内に保持されます。

ベンチマークデータ:BenchLM(benchlm.ai)、2026年9月8日時点のスナップショット。スコアは目安であり、定期的に更新されます。 benchlm.ai

モデル選定は、Tara Cloudにお任せください。

ワークロードについてお聞かせいただければ、オープンウェイトとフロンティアモデルの最適な組み合わせをご提案します。通常2営業日以内にご回答します。