LLM Pricing
PreiseRanglistenToolsAnbieterReleasesAnleitungen

© 2026 LLM Pricing

About
·Contact
·Privacy
·RSS

LLM-Preise auf einen Blick

Vergleiche Preis, Fähigkeiten und die Angebote aller Anbieter der wichtigsten LLMs an einem Ort

1,920 Modelle · 213 Anbieter · 7,617 Angebote · synchronisiert am 2026-09-09

⌕

Filter

Modelltyp

Der Typ wird aus Familie + Ausgabemodalität abgeleitet. Standardmäßig nur Chat-Modelle.

Fähigkeit

Eingabemodalität

Gewichte

Kontextfenster

Beliebig

Min. Eingabepreis (USD/1M)

Beliebig

Lebenszyklus

Labs (0)

Anbieter (0)

Zeige 0 / 0 Modelle

Explore models

Browse 1,920 large language models by intelligence, price, context window and availability. Open any model for its full pricing across every provider.

Highest intelligence

  • Claude Fable 5.1AA 65.7
  • Claude Opus 5AA 63.1
  • Claude Fable 5AA 62.1
  • GPT-5.6 SolAA 60.9
  • Grok 4.6AA 60.9
  • Kimi K3AA 59.7
  • GLM-5.3AA 59.5
  • Qwen3.8 MaxAA 58.1
  • Qwen3.8 2.4T A95BAA 57.7
  • GLM-5.3-FlashAA 57.5
  • Claude Opus 4.8AA 57.3
  • Muse Spark 1.2AA 56.8

Lowest blended price

  • Llama 3.2 1B Instruct$0.010
  • Google Gemma 2$0.015
  • Llama 3.2 3B Instruct$0.020
  • E5 Mistral 7B$0.020
  • PaddleOCR-VL$0.020
  • Mistral Nemo$0.022
  • Llama 3.1 8B (decentralized)$0.022
  • Meta Llama 3.1 8B Instruct Turbo$0.022
  • GLM-5.3-Flash$0.024
  • Llama-3.1-8B-Instruct$0.025
  • DeepSeek OCR 2$0.030
  • DeepSeek OCR$0.030

Largest context window

  • Pokee-Isaac 28B1M
  • Qwen Long1M
  • Llama 4 Scout 17B Instruct (US)3.5M
  • Gemini 2.0 Pro 02052.1M
  • Gemini 2.0 Pro 12062.1M
  • Gemini 2.0 Flash-Lite2M
  • Grok 4.202M
  • grok-4-fast-non-reasoning2M
  • grok-4-fast-reasoning2M
  • Auto Router2M
  • X-Ai/Grok 4.1 Fast Non Reasoning2M
  • X-Ai/Grok 4.1 Fast Reasoning2M

Most providers

  • GLM-5.2101 hosts
  • GPT OSS 120B83 hosts
  • DeepSeek V4 Flash80 hosts
  • DeepSeek V4 Pro79 hosts
  • Kimi K372 hosts
  • Kimi K2.7 Code64 hosts
  • GLM-5.3-Flash54 hosts
  • DeepSeek V4 Flash 073151 hosts
  • GPT-5.549 hosts
  • Claude Sonnet 4.649 hosts
  • GLM-5.349 hosts
  • Claude Opus 4.847 hosts

So funktioniert dieser Vergleich

Jede Zahl hier ist der pro Token veröffentlichte API-Preis des jeweiligen Anbieters, normiert auf US-Dollar pro einer Million Tokens. Wird ein Modell von mehreren Anbietern gehostet, behält die Tabelle die jeweils eigene Preisangabe bei, statt sie zu mitteln, denn dasselbe Modell unterscheidet sich von Host zu Host oft in Preis, Kontextfenster und Fähigkeiten.

Der kombinierte Preis ordnet Modelle nach einer einzigen Zahl: Eingabepreis mal 0,75 plus Ausgabepreis mal 0,25, passend zu einer angenommenen Nutzung von 3 zu 1 zwischen Eingabe und Ausgabe. Der günstigste kostenpflichtige Kanal schließt $0-Stufen aus, da kostenloser Zugang meist Ratenbegrenzungen und keine Service-Garantie mit sich bringt. Qualitätswerte stammen, sofern angezeigt, von Artificial Analysis; die meisten Modelle haben keine unabhängigen Qualitätsdaten, daher zeigen diese Zeilen nur den Preis.

Preis- und Fähigkeitsdaten werden aus models.dev zusammengeführt, Qualitäts- und Geschwindigkeitsdaten von Artificial Analysis. Die Zahlen sind Richtwerte und können sich ändern, daher ist die offizielle Anbieterseite maßgeblich, bevor du dich auf einen Kanal festlegst.

Häufige Fragen

Was ist die günstigste LLM-API in 2026?
Basierend auf unserem Vergleich von 1920+ Modellen bietet Llama 3.2 1B Instruct von Inference den niedrigsten Mischpreis von etwa $0.010 pro 1M Tokens.
Wie schätze ich LLM-API-Kosten?
Multipliziere deine Eingabe-Tokens mit dem Eingabepreis des Modells pro 1M Tokens, mach dasselbe für Ausgabe-Tokens und addiere beides. Nutze den integrierten Kostenrechner, um die Gesamtsumme für jedes Modell und jeden Anbieter zu schätzen.
Welches LLM hat das größte Kontextfenster?
Pokee-Isaac 28B von misc unterstützt das größte Kontextfenster, bis zu 10,000,000 Tokens.
Welche Anbieter und Modelle werden hier verglichen?
Diese Seite vergleicht 1920+ Modelle über Anbieter wie Alibaba, OpenAI, Anthropic, Google, Zhipu AI, Mistral hinweg, mit Eingabe-, Ausgabe- und Cache-Preisen pro 1M Tokens sowie Qualitäts-Ranglisten.