LLM Pricing
PreçosRankingsFerramentasProvedoresLançamentosGuias

© 2026 LLM Pricing

About
·Contact
·Privacy
·RSS

Preços de LLM num relance

Compare preço, recursos e a cotação de cada provedor para os principais LLMs em um só lugar

Os dados são os preços e especificações de API publicados por cada provedor, com os preços normalizados em dólares americanos por milhão de tokens. Filtre por recurso, janela de contexto ou orçamento, ou abra qualquer modelo para comparar sua cotação em todos os provedores, com pontuações de qualidade e velocidade quando disponíveis.

1,922 modelos · 213 provedores · 7,692 cotações · sincronizado 2026-09-11

⌕

Filtros

Tipo de modelo

O tipo é derivado da família + modalidade de saída. Por padrão, apenas modelos de chat.

Recurso

Modalidade de entrada

Pesos

Janela de contexto

Qualquer

Preço mín. de entrada (USD/1M)

Qualquer

Ciclo de vida

Labs (0)

Provedores (0)

Mostrando 0 / 0 modelos

Explore models

Browse 1,922 large language models by intelligence, price, context window and availability. Open any model for its full pricing across every provider.

Highest intelligence

  • Claude Fable 5.1AA 65.7
  • Claude Opus 5AA 63.1
  • Claude Fable 5AA 62.1
  • GPT-5.6 SolAA 60.9
  • Grok 4.6AA 60.9
  • Kimi K3AA 59.7
  • GLM-5.3AA 59.5
  • Qwen3.8 MaxAA 58.1
  • Qwen3.8 2.4T A95BAA 57.7
  • GLM-5.3-FlashAA 57.5
  • Claude Opus 4.8AA 57.3
  • Muse Spark 1.2AA 56.8

Lowest blended price

  • Llama 3.2 1B Instruct$0.010
  • Google Gemma 2$0.015
  • Llama 3.2 3B Instruct$0.020
  • E5 Mistral 7B$0.020
  • PaddleOCR-VL$0.020
  • Mistral Nemo$0.022
  • Llama 3.1 8B (decentralized)$0.022
  • Meta Llama 3.1 8B Instruct Turbo$0.022
  • GLM-5.3-Flash$0.024
  • Llama-3.1-8B-Instruct$0.025
  • DeepSeek OCR 2$0.030
  • DeepSeek OCR$0.030

Largest context window

  • Pokee-Isaac 28B1M
  • Qwen Long1M
  • Llama 4 Scout 17B Instruct (US)3.5M
  • Gemini 2.0 Pro 02052.1M
  • Gemini 2.0 Pro 12062.1M
  • Gemini 2.0 Flash-Lite2M
  • Grok 4.202M
  • grok-4-fast-non-reasoning2M
  • grok-4-fast-reasoning2M
  • Auto Router2M
  • X-Ai/Grok 4.1 Fast Non Reasoning2M
  • Grok 4.1 Fast Reasoning (Azure AI Foundry)2M

Most providers

  • GLM-5.2102 hosts
  • GPT OSS 120B82 hosts
  • DeepSeek V4 Pro79 hosts
  • DeepSeek V4 Flash77 hosts
  • Kimi K372 hosts
  • Kimi K2.7 Code64 hosts
  • GLM-5.3-Flash57 hosts
  • GLM-5.352 hosts
  • DeepSeek V4 Flash 073152 hosts
  • GPT-5.549 hosts
  • Claude Sonnet 4.649 hosts
  • Claude Opus 4.847 hosts

Como funciona esta comparação

Cada valor aqui é a tarifa de API por token publicada por cada provedor, normalizada em dólares americanos por milhão de tokens. Quando um modelo é hospedado por vários provedores, a tabela mantém a cotação de cada um em vez de tirar a média, porque o mesmo modelo costuma variar em preço, janela de contexto e recursos de um host para outro.

O preço combinado ordena os modelos por um único número: preço de entrada vezes 0,75 mais preço de saída vezes 0,25, seguindo uma suposição de uso de 3 para 1 entre entrada e saída. O canal pago mais barato exclui os níveis de $0, já que o acesso gratuito costuma ter limites de taxa e nenhuma garantia de serviço. As pontuações de qualidade, quando exibidas, vêm da Artificial Analysis; a maioria dos modelos não tem dados de qualidade independentes, então essas linhas mostram apenas o preço.

Os dados de preço e recursos são agregados do models.dev, e os de qualidade e velocidade da Artificial Analysis. Os valores são indicativos e podem mudar, por isso a página oficial do provedor é a autoridade final antes de você optar por um canal.

Perguntas frequentes

Qual é a API de LLM mais barata em 2026?
Com base na nossa comparação de 1922+ modelos, o Llama 3.2 1B Instruct da Inference oferece o menor preço combinado, cerca de $0.010 por 1M tokens.
Como estimar os custos de API de LLM?
Multiplique seus tokens de entrada pelo preço de entrada do modelo por 1M tokens, faça o mesmo para os tokens de saída e some. Use a calculadora de custos integrada para estimar totais para qualquer modelo e provedor.
Qual LLM tem a maior janela de contexto?
O Pokee-Isaac 28B da misc suporta a maior janela de contexto, até 10,000,000 tokens.
Quais provedores e modelos são comparados aqui?
Este site compara 1922+ modelos entre provedores como Alibaba, OpenAI, Anthropic, Google, Zhipu AI, Mistral, com preços de entrada, saída e cache por 1M tokens além de rankings de qualidade.