LLM Pricing
价格榜单工具服务商模型发布教程

© 2026 LLM Pricing

关于
·联系
·隐私政策
·RSS

大模型价格一览

一处比齐主流大模型的价格、能力与各家服务商报价

1,920 个模型 · 213 家服务商 · 7,617 条报价 · 数据同步于 2026-09-09

⌕

筛选

模型类型

类型由 family + 输出模态推导。默认只看对话模型。

能力

输入模态

权重

上下文窗口

不限

最低输入单价 (USD/1M)

不限

生命周期

实验室 (0)

服务商 (0)

显示 0 / 0 个模型

探索模型

从智能水平、价格、上下文窗口与可用性四个维度浏览 1,920 个大语言模型。点开任意模型可查看它在各家服务商的完整报价。

智能最高

  • Claude Fable 5.1AA 65.7
  • Claude Opus 5AA 63.1
  • Claude Fable 5AA 62.1
  • GPT-5.6 SolAA 60.9
  • Grok 4.6AA 60.9
  • Kimi K3AA 59.7
  • GLM-5.3AA 59.5
  • Qwen3.8 MaxAA 58.1
  • Qwen3.8 2.4T A95BAA 57.7
  • GLM-5.3-FlashAA 57.5
  • Claude Opus 4.8AA 57.3
  • Muse Spark 1.2AA 56.8

综合单价最低

  • Llama 3.2 1B Instruct$0.010
  • Google Gemma 2$0.015
  • Llama 3.2 3B Instruct$0.020
  • E5 Mistral 7B$0.020
  • PaddleOCR-VL$0.020
  • Mistral Nemo$0.022
  • Llama 3.1 8B (decentralized)$0.022
  • Meta Llama 3.1 8B Instruct Turbo$0.022
  • GLM-5.3-Flash$0.024
  • Llama-3.1-8B-Instruct$0.025
  • DeepSeek OCR 2$0.030
  • DeepSeek OCR$0.030

上下文窗口最大

  • Pokee-Isaac 28B1M
  • Qwen Long1M
  • Llama 4 Scout 17B Instruct (US)3.5M
  • Gemini 2.0 Pro 02052.1M
  • Gemini 2.0 Pro 12062.1M
  • Gemini 2.0 Flash-Lite2M
  • Grok 4.202M
  • grok-4-fast-non-reasoning2M
  • grok-4-fast-reasoning2M
  • Auto Router2M
  • X-Ai/Grok 4.1 Fast Non Reasoning2M
  • X-Ai/Grok 4.1 Fast Reasoning2M

托管服务商最多

  • GLM-5.2101 家
  • GPT OSS 120B83 家
  • DeepSeek V4 Flash80 家
  • DeepSeek V4 Pro79 家
  • Kimi K372 家
  • Kimi K2.7 Code64 家
  • GLM-5.3-Flash54 家
  • DeepSeek V4 Flash 073151 家
  • GPT-5.549 家
  • Claude Sonnet 4.649 家
  • GLM-5.349 家
  • Claude Opus 4.847 家

对比方法说明

这里的每个数字都是各服务商公开的按 token API 价格,统一折算成美元每百万 tokens。同一个模型由多家服务商托管时,表格保留各家自己的报价而不做平均,因为同一模型在不同宿主之间的价格、上下文窗口和能力标记往往并不一致。

综合单价用一个数字给模型排序:输入价 ×0.75 加输出价 ×0.25,对应输入与输出 3:1 的用量假设。最低付费渠道不计 $0 档,因为免费访问通常带速率限制、也没有服务等级保证。质量分(如有显示)来自 Artificial Analysis;多数模型没有独立质量数据,这些行只显示价格。

价格与能力数据归并自 models.dev,质量与速度数据来自 Artificial Analysis。数字仅供参考、可能变动,选定某个渠道前请以服务商官方页面为准。

常见问题

2026 年最便宜的大语言模型 API 是哪个?
根据我们对 1920+ 个模型的比较,来自 Inference 的 Llama 3.2 1B Instruct 综合单价最低,每百万 tokens 约 $0.010。
如何估算大语言模型 API 的成本?
将输入 tokens 数乘以模型每百万 tokens 的输入价格,输出 tokens 同理,然后相加。用内置成本计算器可快速估算任意模型/渠道的总成本。
哪个大语言模型的上下文窗口最大?
来自 misc 的 Pokee-Isaac 28B 支持最大的上下文窗口,最高可达 10,000,000 tokens。
这里比较了哪些服务商和模型?
本站比较了 1920+ 个模型,覆盖 Alibaba, OpenAI, Anthropic, Google, Zhipu AI, Mistral 等服务商,含每百万 tokens 的输入、输出与缓存价格,以及质量榜单。