LLM Pricing
价格榜单工具服务商模型发布教程

© 2026 LLM Pricing

关于
·联系
·隐私政策
·RSS

榜单

数据来自 Artificial Analysis · 智能指数 v? · 0 个模型有数据

性价比前沿 →

Artificial Analysis 智能指数。分数取「代表档位」(同一模型取最高分的推理档位)。

各榜前列

每个榜单的前 8 名及其排名指标。点开任意模型可查看它在各家服务商的完整报价。

智能榜

  • Claude Opus 5.5AA 57.6
  • Claude Sonnet 5.5AA 56
  • Claude Fable 5.1AA 53.4
  • GPT-6 AstraAA 52.7
  • GPT-6.1 SolAA 51.8
  • Claude Opus 5AA 50.8
  • Claude Fable 5AA 49.6
  • Muse Spark 1.3AA 48.1

编码榜

  • Claude Fable 5.181.6
  • Claude Opus 578
  • GPT-5.6 Sol77.4
  • GPT-6 Astra76.9
  • Grok 4.676.8
  • GPT-5.6 Terra76.7
  • Claude Fable 576.5
  • Gemini 3.8 Flash76.3

Agent 榜

  • Claude Fable 5.157.9
  • Claude Opus 556.5
  • Qwen3.8 Max56
  • Muse Spark 1.355.5
  • Qwen3.8 Flash Next53.6
  • GLM-5.353.1
  • Grok 4.653
  • GPT-6 Astra51

性价比榜

  • Ling 3.0 Flash638
  • DeepSeek V4 Flash 0731381
  • Qwen3.8 Flash Next318
  • MiMo-V2.6-Flash276
  • GLM-5.3-Flash257
  • DeepSeek V4.1 Flash226
  • Ling 3.0 Flash VL221
  • Ling 3.0 Flash Fin203

每任务成本榜

  • Ministral 3 3BUS$0.0078
  • Ministral 3 8BUS$0.011
  • Mistral Small 4US$0.015
  • nvidia-nemotron-3-nano-30b-a3bUS$0.017
  • Ministral 3 14BUS$0.019
  • Granite 4.2 8BUS$0.024
  • Mistral Large 3US$0.031
  • Mistral Small 3.1US$0.035

速度榜

  • Celeris 11767 tok/s
  • Mercury 2739 tok/s
  • Mercury 2.5661 tok/s
  • Gemini 2.5 Flash-Lite358 tok/s
  • Ling 3.0 Flash347 tok/s
  • Trinity Large Thinking342 tok/s
  • Ling 3.0 Flash Fin338 tok/s
  • Gemini 3.5 Flash Lite335 tok/s

热度榜

  • DeepSeek V4.1 Flash65891487.6M
  • GLM-5.3-Flash54949891.7M
  • Space Bunny Alpha52519697.21M
  • Hy4 preview49294711.59M
  • GPT-5.6 Luna45645078.06M
  • DeepSeek V4 Flash 073139154880.07M
  • Nemotron 3 Ultra (free)20450891.31M
  • DeepSeek V4 Flash 042316003722.78M

GPQA Diamond

  • GPT-6 Astra96.1%
  • Gemini 3.8 Flash95.3%
  • Grok 4.694.9%
  • GPT-5.6 Sol94.1%
  • Gemini 3.1 Pro Preview94.1%
  • Claude Fable 5.193.7%
  • Kimi K393.5%
  • GPT-5.593.5%

榜单说明

每个榜单都按不同维度给同一份目录排名:原始智能分、Artificial Analysis 的编码与 Agent 能力分、输出速度、每任务成本、近 30 天真实用量,以及性价比。性价比榜用智能分除以综合单价,并设了智能分下限,避免便宜但能力弱的模型仅凭低价登顶。

价格基准可切换,因为最低价渠道几乎都是第三方网关,而官方牌价反映的是第一方价格。每任务成本会大幅改变排名:单价低的推理模型,若每次作答吐出大量思考 token,账单仍会很高。