LLM Pricing
PreçosRankingsFerramentasProvedoresLançamentosGuias

© 2026 LLM Pricing

About
·Contact
·Privacy
·RSS

Rankings

Dados da Artificial Analysis · Intelligence Index v? · 0 modelos com dados

Fronteira de custo-benefício →

Artificial Analysis Intelligence Index. A pontuação usa a “faixa representativa” (a faixa de raciocínio de maior pontuação por modelo).

Líderes de cada tabela

Os 8 primeiros de cada tabela, com a métrica que os ordena. Abra qualquer modelo para ver seu preço completo em todos os fornecedores.

Inteligência

  • Claude Opus 5.5AA 57.6
  • Claude Sonnet 5.5AA 56
  • Claude Fable 5.1AA 53.4
  • GPT-6 AstraAA 52.7
  • GPT-6.1 SolAA 51.8
  • Claude Opus 5AA 50.8
  • Claude Fable 5AA 49.6
  • Muse Spark 1.3AA 48.1

Programação

  • Claude Fable 5.181.6
  • Claude Opus 578
  • GPT-5.6 Sol77.4
  • GPT-6 Astra76.9
  • Grok 4.676.8
  • GPT-5.6 Terra76.7
  • Claude Fable 576.5
  • Gemini 3.8 Flash76.3

Agêntico

  • Claude Fable 5.157.9
  • Claude Opus 556.5
  • Qwen3.8 Max56
  • Muse Spark 1.355.5
  • Qwen3.8 Flash Next53.6
  • GLM-5.353.1
  • Grok 4.653
  • GPT-6 Astra51

Custo-benefício

  • Ling 3.0 Flash638
  • DeepSeek V4 Flash 0731381
  • Qwen3.8 Flash Next318
  • MiMo-V2.6-Flash276
  • GLM-5.3-Flash257
  • DeepSeek V4.1 Flash226
  • Ling 3.0 Flash VL221
  • Ling 3.0 Flash Fin203

Custo por tarefa

  • Ministral 3 3BUS$ 0,0078
  • Ministral 3 8BUS$ 0,011
  • Mistral Small 4US$ 0,015
  • nvidia-nemotron-3-nano-30b-a3bUS$ 0,017
  • Ministral 3 14BUS$ 0,019
  • Granite 4.2 8BUS$ 0,024
  • Mistral Large 3US$ 0,031
  • Mistral Small 3.1US$ 0,035

Velocidade

  • Celeris 11767 tok/s
  • Mercury 2739 tok/s
  • Mercury 2.5661 tok/s
  • Gemini 2.5 Flash-Lite358 tok/s
  • Ling 3.0 Flash347 tok/s
  • Trinity Large Thinking342 tok/s
  • Ling 3.0 Flash Fin338 tok/s
  • Gemini 3.5 Flash Lite335 tok/s

Uso

  • DeepSeek V4.1 Flash65891487.6M
  • GLM-5.3-Flash54949891.7M
  • Space Bunny Alpha52519697.21M
  • Hy4 preview49294711.59M
  • GPT-5.6 Luna45645078.06M
  • DeepSeek V4 Flash 073139154880.07M
  • Nemotron 3 Ultra (free)20450891.31M
  • DeepSeek V4 Flash 042316003722.78M

GPQA Diamond

  • GPT-6 Astra96.1%
  • Gemini 3.8 Flash95.3%
  • Grok 4.694.9%
  • GPT-5.6 Sol94.1%
  • Gemini 3.1 Pro Preview94.1%
  • Claude Fable 5.193.7%
  • Kimi K393.5%
  • GPT-5.593.5%

Como ler as classificações

Cada classificação ordena o mesmo catálogo por um eixo diferente: inteligência bruta, pontuações de programação e agênticas da Artificial Analysis, velocidade de saída, custo por tarefa, uso real de 30 dias e custo-benefício. A classificação de valor divide a inteligência pelo preço combinado, com um piso de inteligência para que um modelo barato mas fraco não lidere apenas pelo preço.

A base de preço é alternável porque o canal mais barato é quase sempre um gateway de terceiros, enquanto o preço de tabela oficial reflete a tarifa de origem. O custo por tarefa pode reordenar a classificação de forma acentuada: um modelo de raciocínio com preço unitário baixo ainda acumula uma conta alta quando emite muitos tokens de raciocínio por resposta.