LLM Pricing
PreçosRankingsFerramentasProvedoresLançamentosGuias

© 2026 LLM Pricing

About
·Contact
·Privacy
·RSS

Preços de LLM num relance

Compare preço, recursos e a cotação de cada provedor para os principais LLMs em um só lugar

Os dados são os preços e especificações de API publicados por cada provedor, com os preços normalizados por milhão de tokens e expressos em dólares americanos, conversíveis para uma moeda local pela cotação mais recente. Filtre por recurso, janela de contexto ou orçamento, ou abra qualquer modelo para comparar sua cotação em todos os provedores, com pontuações de qualidade e velocidade quando disponíveis.

2,025 modelos · 226 provedores · 8,389 cotações · sincronizado 2026-10-05

⌕

Filtros

Tipo de modelo

O tipo é derivado da família + modalidade de saída. Por padrão, apenas modelos de chat.

Recurso

Modalidade de entrada

Pesos

Janela de contexto

Qualquer

Preço mín. de entrada (USD/1M)

Qualquer

Ciclo de vida

Labs (0)

Provedores (0)

Mostrando 0 / 0 modelos

Explore models

Browse 2,025 large language models by intelligence, price, context window and availability. Open any model for its full pricing across every provider.

Highest intelligence

  • Claude Opus 5.5AA 57.6
  • Claude Sonnet 5.5AA 56
  • Claude Fable 5.1AA 53.4
  • GPT-6 AstraAA 52.7
  • GPT-6.1 SolAA 51.8
  • Claude Opus 5AA 50.8
  • Claude Fable 5AA 49.6
  • Muse Spark 1.3AA 48.1
  • GPT-6 SolAA 47.6
  • GPT-5.6 SolAA 47
  • Grok 4.7AA 46.4
  • MiMo-V2.6-ProAA 46.3

Lowest blended price

  • Mistral NemoUS$ 0,022
  • DeepSeek-OCRUS$ 0,03
  • Ling 3.0 Flash VLUS$ 0,031
  • Ling 3.0 FlashUS$ 0,032
  • Ministral 3BUS$ 0,04
  • qwen3.5-2bUS$ 0,04
  • Granite 4.0 MicroUS$ 0,041
  • DeepSeek V4 Flash 0731US$ 0,044
  • Nex AGI: Nex-N2.5-MiniUS$ 0,044
  • GLM-5.3-FlashUS$ 0,048
  • Qwen3.5 4BUS$ 0,048
  • Qwen3.7 FlashUS$ 0,049

Largest context window

  • Grok 4.1 Fast (Non-Reasoning)2M
  • Grok 4.202M
  • grok-4-fast-non-reasoning2M
  • grok-4-fast-reasoning2M
  • GPT-5.51.05M
  • GPT-5.41.05M
  • GPT-5.6 Luna1.05M
  • GPT-5.6 Sol1.05M
  • GPT-5.6 Terra1.05M
  • GPT-6 Astra1.05M
  • GPT-6 Luna1.05M
  • GPT-6 Sol1.05M

Most providers

  • GLM-5.2102 hosts
  • Kimi K388 hosts
  • GPT OSS 120B84 hosts
  • GLM-5.381 hosts
  • GLM-5.3-Flash80 hosts
  • DeepSeek V4.1 Flash73 hosts
  • DeepSeek V4 Flash 073154 hosts
  • Claude Sonnet 4.650 hosts
  • GPT-5.549 hosts
  • Claude Opus 4.848 hosts
  • Claude Opus 4.747 hosts
  • Qwen3.8 27B46 hosts

Como funciona esta comparação

Cada valor aqui é a tarifa de API por token publicada por cada provedor, normalizada por milhão de tokens e expressa em dólares americanos. As outras moedas são convertidas desse valor em dólares por uma cotação diária, portanto são valores de referência e não o que o provedor publica. Quando um modelo é hospedado por vários provedores, a tabela mantém a cotação de cada um em vez de tirar a média, porque o mesmo modelo costuma variar em preço, janela de contexto e recursos de um host para outro.

O preço combinado ordena os modelos por um único número: preço de entrada vezes 0,75 mais preço de saída vezes 0,25, seguindo uma suposição de uso de 3 para 1 entre entrada e saída. O canal pago mais barato exclui os níveis de $0, já que o acesso gratuito costuma ter limites de taxa e nenhuma garantia de serviço. As pontuações de qualidade, quando exibidas, vêm da Artificial Analysis; a maioria dos modelos não tem dados de qualidade independentes, então essas linhas mostram apenas o preço.

Os dados de preço e recursos são agregados do models.dev, e os de qualidade e velocidade da Artificial Analysis. Os valores são indicativos e podem mudar, por isso a página oficial do provedor é a autoridade final antes de você optar por um canal.

Perguntas frequentes

Qual é a API de LLM mais barata em 2026?
Com base na nossa comparação de 2025+ modelos, o Mistral Nemo da OpenRouter oferece o menor preço combinado, cerca de $0.022 por 1M tokens.
Como estimar os custos de API de LLM?
Multiplique seus tokens de entrada pelo preço de entrada do modelo por 1M tokens, faça o mesmo para os tokens de saída e some. Use a calculadora de custos integrada para estimar totais para qualquer modelo e provedor.
Qual LLM tem a maior janela de contexto?
Grok 4.1 Fast (Non-Reasoning) da xai declara a maior janela de contexto, até 2,000,000 tokens. Seus provedores informam limites diferentes, de 128,000 a 2,000,000 tokens, portanto a janela utilizável depende do provedor escolhido.
Quais provedores e modelos são comparados aqui?
Este site compara 2025+ modelos entre provedores como OpenAI, Alibaba, Anthropic, Google, Zhipu AI, Mistral, com preços de entrada, saída e cache por 1M tokens além de rankings de qualidade.