API · MCP
이 사이트가 사용하는 정규화된 가격·기능·순위 데이터는 정적 JSON으로 공개되며, API 키 없이 무료로 가져갈 수 있습니다. 코드나 에이전트가 바로 참조할 수 있습니다.
엔드포인트
전체 모델: canonical 항목, 공식 + 최저 채널 가격, 종합 단가, 컨텍스트, 능력, Artificial Analysis 점수, 30일 사용량.
전체 제공업체: 이름, 계층(자사 / 클라우드 / 게이트웨이), 모델 수, SDK, API 베이스, 문서.
AI 크롤러용 일반 텍스트 사이트 요약(llms.txt 관례).
CDN에서 정적 파일로 제공하므로 속도 제한이 없습니다. 그래도 요청마다 다시 가져오기보다는 응답을 캐시해 주세요. 데이터는 빌드마다 갱신됩니다.
주요 필드(models.json)
id, name, lab, kindcanonical id, 표시 이름, 랩, 모델 종류.reference / cheapest레퍼런스(공식/정가)와 최저 유료 채널, 각각 1M 토큰당 입력/출력/캐시 읽기.blendedRef / blendedMin / blendedTrusted종합 단가(입력×0.75 + 출력×0.25)를 레퍼런스, 최저, 최저 신뢰(게이트웨이 제외) 채널에 대해.context, outputLimit, capabilities컨텍스트 창, 최대 출력, 3값 능력 플래그(true/false/null).aa (idx, coding, agentic, speed, taskCost)Artificial Analysis 지능·코딩·에이전트 지수, 출력 속도, 작업당 비용(미포함 시 null).usage (rank, tokens, share)OpenRouter 30일 사용량 순위, 총 토큰, 비중(미추적 시 null).hostCount, spread몇 개 제공업체가 모델을 호스팅하는지와 플랫폼 간 가격 편차.예시
curl과 jq로 통합 단가가 가장 낮은 5개 모델 가져오기:
curl -s https://llmpricing.dev/api/models.json \
| jq '.models
| map(select(.blendedMin != null))
| sort_by(.blendedMin)[:5]
| .[] | {name, blendedMin, cheapest: .cheapest.provider}'JavaScript(fetch):
const res = await fetch("https://llmpricing.dev/api/models.json");
const { meta, models } = await res.json();
// 5 cheapest by blended price (input x0.75 + output x0.25)
const cheapest = models
.filter((m) => m.blendedMin != null)
.sort((a, b) => a.blendedMin - b.blendedMin)
.slice(0, 5);
console.log(meta.syncedAt, cheapest);Python(requests):
import requests
data = requests.get("https://llmpricing.dev/api/models.json").json()
models = data["models"]
# highest Artificial Analysis intelligence with a public price
ranked = sorted(
(m for m in models if m["aa"] and m["aa"]["idx"] is not None),
key=lambda m: m["aa"]["idx"],
reverse=True,
)
for m in ranked[:5]:
print(m["name"], m["aa"]["idx"], m["blendedMin"])엔드포인트는 Access-Control-Allow-Origin: *를 보내므로 브라우저에서도 동작합니다.
MCP 서버
데이터가 HTTPS 상의 깔끔한 JSON이므로, fetch가 가능한 MCP 서버라면 어떤 것이든 에이전트에 노출할 수 있습니다. 예를 들어 레퍼런스 fetch 서버:
{
"mcpServers": {
"llm-pricing": {
"command": "uvx",
"args": ["mcp-server-fetch"]
}
}
}그다음 에이전트에게 https://llmpricing.dev/api/models.json을 읽고 추론하도록 요청하세요. 예산 안에서 가장 저렴한 모델, 1달러당 지능이 가장 높은 모델, 특정 모델을 어떤 제공업체가 호스팅하는지 등을 물을 수 있습니다.
라이선스 및 출처 표기
데이터는 models.dev(MIT), Artificial Analysis, OpenRouter를 취합한 것입니다. CC BY 4.0에 따라 재사용할 수 있으며, LLM Pricing과 원본 출처에 대한 표기를 유지해 주세요.