LLM Pricing
PreçosRankingsFerramentasProvedoresLançamentosGuias

© 2026 LLM Pricing

About
·Contact
·Privacy
·RSS

Rankings

Dados da Artificial Analysis · Intelligence Index v? · 0 modelos com dados

Fronteira de custo-benefício →

Artificial Analysis Intelligence Index. A pontuação usa a “faixa representativa” (a faixa de raciocínio de maior pontuação por modelo).

Líderes de cada tabela

Os 8 primeiros de cada tabela, com a métrica que os ordena. Abra qualquer modelo para ver seu preço completo em todos os fornecedores.

Inteligência

  • Claude Fable 5.1AA 65.7
  • Claude Opus 5AA 63.1
  • Claude Fable 5AA 62.1
  • GPT-5.6 SolAA 60.9
  • Grok 4.6AA 60.9
  • Kimi K3AA 59.7
  • GLM-5.3AA 59.5
  • Qwen3.8 MaxAA 58.1

Programação

  • Claude Fable 5.181.6
  • Claude Opus 578
  • GPT-5.6 Sol77.4
  • Grok 4.676.8
  • GPT-5.6 Terra76.7
  • Claude Fable 576.5
  • Kimi K376.2
  • Gemini 3.7 Flash76.1

Agêntico

  • Claude Fable 5.161.3
  • Claude Opus 559.2
  • GLM-5.359.1
  • Grok 4.658.7
  • Qwen3.8 Max58.4
  • GLM-5.3-Flash58.2
  • GPT-5.6 Sol57.8
  • Qwen3.8 2.4T A95B57.1

Custo-benefício

  • DeepSeek V4 Flash 0731576
  • GLM-5.3-Flash484
  • DeepSeek V4 Flash453
  • Ling 3.0 Flash420
  • GPT OSS 120B371
  • Hy3 preview300
  • Qwen3.8 Flash Next294
  • MiMo-V2.5217

Custo por tarefa

  • Command A$0
  • North Mini Code$0
  • Gemma 3 27B$0
  • LFM2.5 2.6B$0
  • ling-3.0-tiny$0
  • MiMo-V2.5$0.0104
  • Llama 4 Scout$0.0106
  • Granite 4.2 8B$0.0158

Velocidade

  • Celeris 11520 tok/s
  • Mercury 2684 tok/s
  • Gemini 2.5 Flash-Lite374 tok/s
  • Ling 3.0 Flash374 tok/s
  • Gemini 3.5 Flash Lite347 tok/s
  • Gemini 3.1 Flash Lite319 tok/s
  • Trinity Large Thinking309 tok/s
  • Nemotron 3.5 Lightning309 tok/s

Uso

  • DeepSeek V4 Flash72338026.75M
  • GPT-5.6 Luna36050464.38M
  • Hy330854181.24M
  • MiMo-V2.526575141.53M
  • Hy4 preview21063069.75M
  • GLM-5.3-Flash20373327.98M
  • Nemotron 3 Ultra (free)16774070.18M
  • MiniMax-M314795557.17M

Como ler as classificações

Cada classificação ordena o mesmo catálogo por um eixo diferente: inteligência bruta, pontuações de programação e agênticas da Artificial Analysis, velocidade de saída, custo por tarefa, uso real de 30 dias e custo-benefício. A classificação de valor divide a inteligência pelo preço combinado, com um piso de inteligência para que um modelo barato mas fraco não lidere apenas pelo preço.

A base de preço é alternável porque o canal mais barato é quase sempre um gateway de terceiros, enquanto o preço de tabela oficial reflete a tarifa de origem. O custo por tarefa pode reordenar a classificação de forma acentuada: um modelo de raciocínio com preço unitário baixo ainda acumula uma conta alta quando emite muitos tokens de raciocínio por resposta.