LLM Pricing
TarifsClassementsOutilsFournisseursSortiesGuides

© 2026 LLM Pricing

About
·Contact
·Privacy
·RSS

Tarifs des LLM en un coup d'œil

Comparez prix, capacités et l'offre de chaque fournisseur pour les principaux LLM au même endroit

Les données sont les tarifs et spécifications d'API publiés par chaque fournisseur, les prix étant normalisés en dollars américains par million de tokens. Filtrez par capacité, fenêtre de contexte ou budget, ou ouvrez n'importe quel modèle pour comparer son offre chez tous les fournisseurs, avec les scores de qualité et de vitesse lorsqu'ils sont disponibles.

1,922 modèles · 213 fournisseurs · 7,692 cotations · synchronisé le 2026-09-11

⌕

Filtres

Type de modèle

Le type est déduit de la famille + modalité de sortie. Modèles de chat uniquement par défaut.

Capacité

Modalité d'entrée

Poids

Fenêtre de contexte

Illimité

Prix mini entrée (USD/1M)

Illimité

Cycle de vie

Labos (0)

Fournisseurs (0)

Affichage de 0 / 0 modèles

Explore models

Browse 1,922 large language models by intelligence, price, context window and availability. Open any model for its full pricing across every provider.

Highest intelligence

  • Claude Fable 5.1AA 65.7
  • Claude Opus 5AA 63.1
  • Claude Fable 5AA 62.1
  • GPT-5.6 SolAA 60.9
  • Grok 4.6AA 60.9
  • Kimi K3AA 59.7
  • GLM-5.3AA 59.5
  • Qwen3.8 MaxAA 58.1
  • Qwen3.8 2.4T A95BAA 57.7
  • GLM-5.3-FlashAA 57.5
  • Claude Opus 4.8AA 57.3
  • Muse Spark 1.2AA 56.8

Lowest blended price

  • Llama 3.2 1B Instruct$0.010
  • Google Gemma 2$0.015
  • Llama 3.2 3B Instruct$0.020
  • E5 Mistral 7B$0.020
  • PaddleOCR-VL$0.020
  • Mistral Nemo$0.022
  • Llama 3.1 8B (decentralized)$0.022
  • Meta Llama 3.1 8B Instruct Turbo$0.022
  • GLM-5.3-Flash$0.024
  • Llama-3.1-8B-Instruct$0.025
  • DeepSeek OCR 2$0.030
  • DeepSeek OCR$0.030

Largest context window

  • Pokee-Isaac 28B1M
  • Qwen Long1M
  • Llama 4 Scout 17B Instruct (US)3.5M
  • Gemini 2.0 Pro 02052.1M
  • Gemini 2.0 Pro 12062.1M
  • Gemini 2.0 Flash-Lite2M
  • Grok 4.202M
  • grok-4-fast-non-reasoning2M
  • grok-4-fast-reasoning2M
  • Auto Router2M
  • X-Ai/Grok 4.1 Fast Non Reasoning2M
  • Grok 4.1 Fast Reasoning (Azure AI Foundry)2M

Most providers

  • GLM-5.2102 hosts
  • GPT OSS 120B82 hosts
  • DeepSeek V4 Pro79 hosts
  • DeepSeek V4 Flash77 hosts
  • Kimi K372 hosts
  • Kimi K2.7 Code64 hosts
  • GLM-5.3-Flash57 hosts
  • GLM-5.352 hosts
  • DeepSeek V4 Flash 073152 hosts
  • GPT-5.549 hosts
  • Claude Sonnet 4.649 hosts
  • Claude Opus 4.847 hosts

Comment fonctionne cette comparaison

Chaque chiffre ici correspond au tarif d'API par token publié par chaque fournisseur, normalisé en dollars américains par million de tokens. Lorsqu'un modèle est hébergé par plusieurs fournisseurs, le tableau conserve la cotation propre à chacun au lieu d'en faire la moyenne, car le même modèle diffère souvent en prix, en fenêtre de contexte et en capacités d'un hôte à l'autre.

Le prix combiné classe les modèles sur un seul chiffre : prix d'entrée fois 0,75 plus prix de sortie fois 0,25, selon une hypothèse d'usage de 3 pour 1 entre entrée et sortie. Le canal payant le moins cher exclut les paliers à $0, car l'accès gratuit s'accompagne généralement de limites de débit et d'aucune garantie de service. Les scores de qualité, lorsqu'ils sont affichés, proviennent d'Artificial Analysis ; la plupart des modèles n'ont pas de données de qualité indépendantes, ces lignes n'indiquent donc que le prix.

Les données de prix et de capacités sont agrégées depuis models.dev, et celles de qualité et de vitesse depuis Artificial Analysis. Les chiffres sont indicatifs et peuvent changer ; la page officielle du fournisseur fait donc foi avant de vous engager sur un canal.

Questions fréquentes

Quelle est l'API LLM la moins chère en 2026 ?
D'après notre comparaison de 1922+ modèles, Llama 3.2 1B Instruct de Inference offre le prix mixte le plus bas, à environ 0.010 $ par 1M de tokens.
Comment estimer les coûts d'une API LLM ?
Multiplie tes tokens d'entrée par le prix d'entrée du modèle par 1M de tokens, fais de même pour les tokens de sortie, puis additionne. Utilise le calculateur de coûts intégré pour estimer les totaux de n'importe quel modèle et fournisseur.
Quel LLM a la plus grande fenêtre de contexte ?
Pokee-Isaac 28B de misc prend en charge la plus grande fenêtre de contexte, jusqu'à 10,000,000 tokens.
Quels fournisseurs et modèles sont comparés ici ?
Ce site compare 1922+ modèles chez des fournisseurs comme Alibaba, OpenAI, Anthropic, Google, Zhipu AI, Mistral, avec les prix d'entrée, de sortie et de cache par 1M de tokens ainsi que des classements de qualité.