LLM Pricing
価格ランキングツールプロバイダーリリースガイド

© 2026 LLM Pricing

About
·Contact
·Privacy
·RSS

ランキング

データ:Artificial Analysis · 知能指数 v? · 0 モデルにデータあり

コスパ・フロンティア →

Artificial Analysis 知能指数。スコアは「代表ティア」(モデルごとに最高スコアの推論ティア)を採用。

各ランキングの上位

各ランキングの上位 8 件と、その順位を決める指標です。モデルを開くと全提供元での価格を確認できます。

知能ランキング

  • Claude Opus 5.5AA 57.6
  • Claude Sonnet 5.5AA 56
  • Claude Fable 5.1AA 53.4
  • GPT-6 AstraAA 52.7
  • GPT-6.1 SolAA 51.8
  • Claude Opus 5AA 50.8
  • Claude Fable 5AA 49.6
  • Muse Spark 1.3AA 48.1

コーディング

  • Claude Fable 5.181.6
  • Claude Opus 578
  • GPT-5.6 Sol77.4
  • GPT-6 Astra76.9
  • Grok 4.676.8
  • GPT-5.6 Terra76.7
  • Claude Fable 576.5
  • Gemini 3.8 Flash76.3

エージェント

  • Claude Fable 5.157.9
  • Claude Opus 556.5
  • Qwen3.8 Max56
  • Muse Spark 1.355.5
  • Qwen3.8 Flash Next53.6
  • GLM-5.353.1
  • Grok 4.653
  • GPT-6 Astra51

コスパ

  • Ling 3.0 Flash638
  • DeepSeek V4 Flash 0731381
  • Qwen3.8 Flash Next318
  • MiMo-V2.6-Flash276
  • GLM-5.3-Flash257
  • DeepSeek V4.1 Flash226
  • Ling 3.0 Flash VL221
  • Ling 3.0 Flash Fin203

タスク単価

  • Ministral 3 3B$0.0078
  • Ministral 3 8B$0.011
  • Mistral Small 4$0.015
  • nvidia-nemotron-3-nano-30b-a3b$0.017
  • Ministral 3 14B$0.019
  • Granite 4.2 8B$0.024
  • Mistral Large 3$0.031
  • Mistral Small 3.1$0.035

速度

  • Celeris 11767 tok/s
  • Mercury 2739 tok/s
  • Mercury 2.5661 tok/s
  • Gemini 2.5 Flash-Lite358 tok/s
  • Ling 3.0 Flash347 tok/s
  • Trinity Large Thinking342 tok/s
  • Ling 3.0 Flash Fin338 tok/s
  • Gemini 3.5 Flash Lite335 tok/s

人気

  • DeepSeek V4.1 Flash65891487.6M
  • GLM-5.3-Flash54949891.7M
  • Space Bunny Alpha52519697.21M
  • Hy4 preview49294711.59M
  • GPT-5.6 Luna45645078.06M
  • DeepSeek V4 Flash 073139154880.07M
  • Nemotron 3 Ultra (free)20450891.31M
  • DeepSeek V4 Flash 042316003722.78M

GPQA Diamond

  • GPT-6 Astra96.1%
  • Gemini 3.8 Flash95.3%
  • Grok 4.694.9%
  • GPT-5.6 Sol94.1%
  • Gemini 3.1 Pro Preview94.1%
  • Claude Fable 5.193.7%
  • Kimi K393.5%
  • GPT-5.593.5%

ランキングの読み方

各ランキングは同じカタログを異なる軸で並べます。素の知能、Artificial Analysis によるコーディングとエージェント能力のスコア、出力速度、タスクあたりのコスト、直近30日の実利用量、そしてコストパフォーマンスです。価値ランキングは知能をブレンド単価で割り、知能の下限を設けることで、安価でも能力の低いモデルが価格だけで首位に立たないようにしています。

価格基準を切り替えられるのは、最安のチャネルがほぼ常に第三者ゲートウェイである一方、公式の定価は第一者の料金を反映するためです。タスクあたりのコストは順位を大きく入れ替えることがあります。単価が低い推論モデルでも、回答ごとに多くの思考トークンを出力すれば請求は高額になります。