LLM Pricing
가격순위도구제공업체출시가이드

© 2026 LLM Pricing

About
·Contact
·Privacy
·RSS

LLM 가격 한눈에

주요 LLM의 가격·기능·각 제공업체 견적을 한곳에서 비교

1,920개 모델 · 213개 제공업체 · 7,617건 견적 · 동기화 2026-09-09

⌕

필터

모델 유형

유형은 family + 출력 모달리티로 추론됩니다. 기본은 챗 모델만.

기능

입력 모달리티

가중치

컨텍스트 창

제한 없음

최저 입력 단가 (USD/1M)

제한 없음

수명 주기

랩 (0)

제공업체 (0)

0 / 0개 모델 표시

Explore models

Browse 1,920 large language models by intelligence, price, context window and availability. Open any model for its full pricing across every provider.

Highest intelligence

  • Claude Fable 5.1AA 65.7
  • Claude Opus 5AA 63.1
  • Claude Fable 5AA 62.1
  • GPT-5.6 SolAA 60.9
  • Grok 4.6AA 60.9
  • Kimi K3AA 59.7
  • GLM-5.3AA 59.5
  • Qwen3.8 MaxAA 58.1
  • Qwen3.8 2.4T A95BAA 57.7
  • GLM-5.3-FlashAA 57.5
  • Claude Opus 4.8AA 57.3
  • Muse Spark 1.2AA 56.8

Lowest blended price

  • Llama 3.2 1B Instruct$0.010
  • Google Gemma 2$0.015
  • Llama 3.2 3B Instruct$0.020
  • E5 Mistral 7B$0.020
  • PaddleOCR-VL$0.020
  • Mistral Nemo$0.022
  • Llama 3.1 8B (decentralized)$0.022
  • Meta Llama 3.1 8B Instruct Turbo$0.022
  • GLM-5.3-Flash$0.024
  • Llama-3.1-8B-Instruct$0.025
  • DeepSeek OCR 2$0.030
  • DeepSeek OCR$0.030

Largest context window

  • Pokee-Isaac 28B1M
  • Qwen Long1M
  • Llama 4 Scout 17B Instruct (US)3.5M
  • Gemini 2.0 Pro 02052.1M
  • Gemini 2.0 Pro 12062.1M
  • Gemini 2.0 Flash-Lite2M
  • Grok 4.202M
  • grok-4-fast-non-reasoning2M
  • grok-4-fast-reasoning2M
  • Auto Router2M
  • X-Ai/Grok 4.1 Fast Non Reasoning2M
  • X-Ai/Grok 4.1 Fast Reasoning2M

Most providers

  • GLM-5.2101 hosts
  • GPT OSS 120B83 hosts
  • DeepSeek V4 Flash80 hosts
  • DeepSeek V4 Pro79 hosts
  • Kimi K372 hosts
  • Kimi K2.7 Code64 hosts
  • GLM-5.3-Flash54 hosts
  • DeepSeek V4 Flash 073151 hosts
  • GPT-5.549 hosts
  • Claude Sonnet 4.649 hosts
  • GLM-5.349 hosts
  • Claude Opus 4.847 hosts

이 비교의 작동 방식

여기의 모든 수치는 각 제공업체가 공개한 토큰당 API 요금이며, 100만 토큰당 미국 달러로 환산했습니다. 하나의 모델을 여러 제공업체가 호스팅할 때는 평균을 내지 않고 각 업체의 견적을 그대로 유지합니다. 같은 모델이라도 호스트마다 가격, 컨텍스트 창, 기능 지원이 다른 경우가 많기 때문입니다.

종합 단가는 하나의 숫자로 모델의 순위를 매깁니다. 입력 가격 ×0.75에 출력 가격 ×0.25를 더한 값으로, 입력과 출력을 3 대 1로 쓰는 사용 가정에 맞춥니다. 가장 저렴한 유료 채널은 $0 등급을 제외합니다. 무료 이용은 보통 속도 제한이 있고 서비스 수준 보장이 없기 때문입니다. 품질 점수는 표시될 경우 Artificial Analysis에서 가져온 것이며, 대부분의 모델은 독립적인 품질 데이터가 없어 해당 행에는 가격만 표시됩니다.

가격과 기능 데이터는 models.dev에서, 품질과 속도 데이터는 Artificial Analysis에서 집계합니다. 수치는 참고용이며 바뀔 수 있으므로, 채널을 정하기 전에는 제공업체의 공식 페이지가 최종 기준입니다.

자주 묻는 질문

2026년에 가장 저렴한 LLM API는 무엇인가요?
1920+개 모델을 비교한 결과, Inference의 Llama 3.2 1B Instruct이 1M 토큰당 약 $0.010로 가장 낮은 종합 단가를 제공합니다.
LLM API 비용은 어떻게 추정하나요?
입력 토큰 수에 모델의 1M 토큰당 입력 가격을 곱하고, 출력 토큰도 같은 방식으로 계산해 더합니다. 내장 비용 계산기로 어떤 모델과 제공업체든 총액을 추정할 수 있습니다.
어떤 LLM이 가장 큰 컨텍스트 창을 가지고 있나요?
misc의 Pokee-Isaac 28B이 최대 10,000,000 토큰까지 가장 큰 컨텍스트 창을 지원합니다.
여기서는 어떤 제공업체와 모델을 비교하나요?
이 사이트는 Alibaba, OpenAI, Anthropic, Google, Zhipu AI, Mistral 등 제공업체 전반의 1920+개 모델을 1M 토큰당 입력·출력·캐시 가격과 품질 순위와 함께 비교합니다.