LLM Pricing
TarifsClassementsOutilsFournisseursSortiesGuides

© 2026 LLM Pricing

About
·Contact
·Privacy
·RSS

Tarifs des LLM en un coup d'œil

Comparez prix, capacités et l'offre de chaque fournisseur pour les principaux LLM au même endroit

1,920 modèles · 213 fournisseurs · 7,617 cotations · synchronisé le 2026-09-09

⌕

Filtres

Type de modèle

Le type est déduit de la famille + modalité de sortie. Modèles de chat uniquement par défaut.

Capacité

Modalité d'entrée

Poids

Fenêtre de contexte

Illimité

Prix mini entrée (USD/1M)

Illimité

Cycle de vie

Labos (0)

Fournisseurs (0)

Affichage de 0 / 0 modèles

Explore models

Browse 1,920 large language models by intelligence, price, context window and availability. Open any model for its full pricing across every provider.

Highest intelligence

  • Claude Fable 5.1AA 65.7
  • Claude Opus 5AA 63.1
  • Claude Fable 5AA 62.1
  • GPT-5.6 SolAA 60.9
  • Grok 4.6AA 60.9
  • Kimi K3AA 59.7
  • GLM-5.3AA 59.5
  • Qwen3.8 MaxAA 58.1
  • Qwen3.8 2.4T A95BAA 57.7
  • GLM-5.3-FlashAA 57.5
  • Claude Opus 4.8AA 57.3
  • Muse Spark 1.2AA 56.8

Lowest blended price

  • Llama 3.2 1B Instruct$0.010
  • Google Gemma 2$0.015
  • Llama 3.2 3B Instruct$0.020
  • E5 Mistral 7B$0.020
  • PaddleOCR-VL$0.020
  • Mistral Nemo$0.022
  • Llama 3.1 8B (decentralized)$0.022
  • Meta Llama 3.1 8B Instruct Turbo$0.022
  • GLM-5.3-Flash$0.024
  • Llama-3.1-8B-Instruct$0.025
  • DeepSeek OCR 2$0.030
  • DeepSeek OCR$0.030

Largest context window

  • Pokee-Isaac 28B1M
  • Qwen Long1M
  • Llama 4 Scout 17B Instruct (US)3.5M
  • Gemini 2.0 Pro 02052.1M
  • Gemini 2.0 Pro 12062.1M
  • Gemini 2.0 Flash-Lite2M
  • Grok 4.202M
  • grok-4-fast-non-reasoning2M
  • grok-4-fast-reasoning2M
  • Auto Router2M
  • X-Ai/Grok 4.1 Fast Non Reasoning2M
  • X-Ai/Grok 4.1 Fast Reasoning2M

Most providers

  • GLM-5.2101 hosts
  • GPT OSS 120B83 hosts
  • DeepSeek V4 Flash80 hosts
  • DeepSeek V4 Pro79 hosts
  • Kimi K372 hosts
  • Kimi K2.7 Code64 hosts
  • GLM-5.3-Flash54 hosts
  • DeepSeek V4 Flash 073151 hosts
  • GPT-5.549 hosts
  • Claude Sonnet 4.649 hosts
  • GLM-5.349 hosts
  • Claude Opus 4.847 hosts

Comment fonctionne cette comparaison

Chaque chiffre ici correspond au tarif d'API par token publié par chaque fournisseur, normalisé en dollars américains par million de tokens. Lorsqu'un modèle est hébergé par plusieurs fournisseurs, le tableau conserve la cotation propre à chacun au lieu d'en faire la moyenne, car le même modèle diffère souvent en prix, en fenêtre de contexte et en capacités d'un hôte à l'autre.

Le prix combiné classe les modèles sur un seul chiffre : prix d'entrée fois 0,75 plus prix de sortie fois 0,25, selon une hypothèse d'usage de 3 pour 1 entre entrée et sortie. Le canal payant le moins cher exclut les paliers à $0, car l'accès gratuit s'accompagne généralement de limites de débit et d'aucune garantie de service. Les scores de qualité, lorsqu'ils sont affichés, proviennent d'Artificial Analysis ; la plupart des modèles n'ont pas de données de qualité indépendantes, ces lignes n'indiquent donc que le prix.

Les données de prix et de capacités sont agrégées depuis models.dev, et celles de qualité et de vitesse depuis Artificial Analysis. Les chiffres sont indicatifs et peuvent changer ; la page officielle du fournisseur fait donc foi avant de vous engager sur un canal.

Questions fréquentes

Quelle est l'API LLM la moins chère en 2026 ?
D'après notre comparaison de 1920+ modèles, Llama 3.2 1B Instruct de Inference offre le prix mixte le plus bas, à environ 0.010 $ par 1M de tokens.
Comment estimer les coûts d'une API LLM ?
Multiplie tes tokens d'entrée par le prix d'entrée du modèle par 1M de tokens, fais de même pour les tokens de sortie, puis additionne. Utilise le calculateur de coûts intégré pour estimer les totaux de n'importe quel modèle et fournisseur.
Quel LLM a la plus grande fenêtre de contexte ?
Pokee-Isaac 28B de misc prend en charge la plus grande fenêtre de contexte, jusqu'à 10,000,000 tokens.
Quels fournisseurs et modèles sont comparés ici ?
Ce site compare 1920+ modèles chez des fournisseurs comme Alibaba, OpenAI, Anthropic, Google, Zhipu AI, Mistral, avec les prix d'entrée, de sortie et de cache par 1M de tokens ainsi que des classements de qualité.