← 返回工具

API · MCP 接口

本站背后归一化的价格、能力与榜单数据以纯静态 JSON 开放,免费拉取、无需密钥。可以让你的代码或 agent 直接读取。

端点

全部模型:canonical 条目、官方 + 最低渠道价、综合单价、上下文、能力、Artificial Analysis 分数与 30 天用量。

全部服务商:名称、分层(第一方 / 云平台 / 网关)、模型数、SDK、API base 与文档。

面向 AI 抓取的纯文本站点摘要(llms.txt 约定)。

以静态文件经 CDN 提供,没有速率限制。仍请缓存响应,不要每次请求都重新拉取。数据在每次构建时刷新。

关键字段(models.json)

id, name, lab, kindCanonical id、展示名、实验室与模型类型。
reference / cheapest参考(官方/牌价)与最低付费渠道,各含每 1M token 的输入/输出/缓存读价。
blendedRef / blendedMin / blendedTrusted综合单价(输入×0.75 + 输出×0.25),分参考、最低、最低可信(排除网关)三种渠道。
context, outputLimit, capabilities上下文窗口、最大输出,以及三态能力位(true/false/null)。
aa (idx, coding, agentic, speed, taskCost)Artificial Analysis 智能、编码、Agent 指数、输出速度与每任务成本(无数据为 null)。
usage (rank, tokens, share)OpenRouter 30 天用量排名、总 token 与占比(未追踪为 null)。
hostCount, spread有多少家服务商托管该模型,以及跨平台价差。

示例

用 curl + jq 取综合单价最低的 5 个模型:

curl -s https://llmpricing.dev/api/models.json \
  | jq '.models
        | map(select(.blendedMin != null))
        | sort_by(.blendedMin)[:5]
        | .[] | {name, blendedMin, cheapest: .cheapest.provider}'

JavaScript(fetch):

const res = await fetch("https://llmpricing.dev/api/models.json");
const { meta, models } = await res.json();

// 5 cheapest by blended price (input x0.75 + output x0.25)
const cheapest = models
  .filter((m) => m.blendedMin != null)
  .sort((a, b) => a.blendedMin - b.blendedMin)
  .slice(0, 5);

console.log(meta.syncedAt, cheapest);

Python(requests):

import requests

data = requests.get("https://llmpricing.dev/api/models.json").json()
models = data["models"]

# highest Artificial Analysis intelligence with a public price
ranked = sorted(
    (m for m in models if m["aa"] and m["aa"]["idx"] is not None),
    key=lambda m: m["aa"]["idx"],
    reverse=True,
)
for m in ranked[:5]:
    print(m["name"], m["aa"]["idx"], m["blendedMin"])

端点带 Access-Control-Allow-Origin: *,浏览器里也能直接跨域取用。

MCP server

由于数据是 HTTPS 上的干净 JSON,任何具备 fetch 能力的 MCP server 都能把它暴露给 agent。例如官方参考的 fetch server:

{
  "mcpServers": {
    "llm-pricing": {
      "command": "uvx",
      "args": ["mcp-server-fetch"]
    }
  }
}

然后让 agent 读取 https://llmpricing.dev/api/models.json 并在其上推理:预算内最便宜的模型、每美元智能分最高的模型、某个模型有哪些服务商托管。

带类型化工具(search_models、cheapest、compare)的第一方 MCP server 已排进路线图。在那之前,上面的 JSON 端点就是稳定接口。

许可与署名

数据归并自 models.dev(MIT)、Artificial Analysis 与 OpenRouter。可按 CC BY 4.0 复用,请保留对 LLM Pricing 与上游来源的署名。