LLM Pricing
PrezziClassificheStrumentiProviderUsciteGuide

© 2026 LLM Pricing

About
·Contact
·Privacy
·RSS

Prezzi degli LLM a colpo d’occhio

Confronta prezzo, funzionalità e le quotazioni di ogni provider per i principali LLM in un unico posto

I dati sono i prezzi e le specifiche API pubblicati da ciascun provider, con i prezzi normalizzati per milione di token ed espressi in dollari statunitensi, convertibili in una valuta locale al tasso di cambio più recente. Filtra per funzionalità, finestra di contesto o budget, oppure apri un modello qualsiasi per confrontarne la quotazione presso tutti i provider, con i punteggi di qualità e velocità quando disponibili.

2,025 modelli · 226 provider · 8,389 quotazioni · sincronizzato 2026-10-05

⌕

Filtri

Tipo di modello

Il tipo è derivato da famiglia + modalità di output. Per impostazione predefinita solo modelli di chat.

Funzionalità

Modalità di input

Pesi

Finestra di contesto

Qualsiasi

Prezzo input min (USD/1M)

Qualsiasi

Ciclo di vita

Lab (0)

Provider (0)

Mostrando 0 / 0 modelli

Explore models

Browse 2,025 large language models by intelligence, price, context window and availability. Open any model for its full pricing across every provider.

Highest intelligence

  • Claude Opus 5.5AA 57.6
  • Claude Sonnet 5.5AA 56
  • Claude Fable 5.1AA 53.4
  • GPT-6 AstraAA 52.7
  • GPT-6.1 SolAA 51.8
  • Claude Opus 5AA 50.8
  • Claude Fable 5AA 49.6
  • Muse Spark 1.3AA 48.1
  • GPT-6 SolAA 47.6
  • GPT-5.6 SolAA 47
  • Grok 4.7AA 46.4
  • MiMo-V2.6-ProAA 46.3

Lowest blended price

  • Mistral Nemo0,022 USD
  • DeepSeek-OCR0,03 USD
  • Ling 3.0 Flash VL0,031 USD
  • Ling 3.0 Flash0,032 USD
  • Ministral 3B0,04 USD
  • qwen3.5-2b0,04 USD
  • Granite 4.0 Micro0,041 USD
  • DeepSeek V4 Flash 07310,044 USD
  • Nex AGI: Nex-N2.5-Mini0,044 USD
  • GLM-5.3-Flash0,048 USD
  • Qwen3.5 4B0,048 USD
  • Qwen3.7 Flash0,049 USD

Largest context window

  • Grok 4.1 Fast (Non-Reasoning)2M
  • Grok 4.202M
  • grok-4-fast-non-reasoning2M
  • grok-4-fast-reasoning2M
  • GPT-5.51.05M
  • GPT-5.41.05M
  • GPT-5.6 Luna1.05M
  • GPT-5.6 Sol1.05M
  • GPT-5.6 Terra1.05M
  • GPT-6 Astra1.05M
  • GPT-6 Luna1.05M
  • GPT-6 Sol1.05M

Most providers

  • GLM-5.2102 hosts
  • Kimi K388 hosts
  • GPT OSS 120B84 hosts
  • GLM-5.381 hosts
  • GLM-5.3-Flash80 hosts
  • DeepSeek V4.1 Flash73 hosts
  • DeepSeek V4 Flash 073154 hosts
  • Claude Sonnet 4.650 hosts
  • GPT-5.549 hosts
  • Claude Opus 4.848 hosts
  • Claude Opus 4.747 hosts
  • Qwen3.8 27B46 hosts

Come funziona questo confronto

Ogni cifra qui è la tariffa API per token pubblicata da ciascun provider, normalizzata per milione di token ed espressa in dollari statunitensi. Le altre valute sono convertite da quell'importo in dollari a un tasso di cambio giornaliero, quindi sono valori di riferimento e non quanto pubblica il provider. Quando un modello è ospitato da più provider, la tabella mantiene la quotazione di ciascuno invece di farne la media, perché lo stesso modello spesso varia per prezzo, finestra di contesto e funzionalità da un host all'altro.

Il prezzo combinato ordina i modelli con un solo numero: prezzo di input per 0,75 più prezzo di output per 0,25, in linea con un'ipotesi d'uso di 3 a 1 tra input e output. Il canale a pagamento più economico esclude i livelli a $0, poiché l'accesso gratuito comporta di solito limiti di frequenza e nessuna garanzia sul livello di servizio. I punteggi di qualità, quando mostrati, provengono da Artificial Analysis; la maggior parte dei modelli non ha dati di qualità indipendenti, quindi quelle righe mostrano solo il prezzo.

I dati su prezzo e funzionalità sono aggregati da models.dev, mentre quelli su qualità e velocità da Artificial Analysis. Le cifre sono indicative e possono cambiare, perciò la pagina ufficiale del provider è l'autorità finale prima di scegliere un canale.

Domande frequenti

Qual è l’API LLM più economica nel 2026?
In base al nostro confronto di 2025+ modelli, Mistral Nemo di OpenRouter offre il prezzo combinato più basso, circa $0.022 per 1M token.
Come stimo i costi dell’API LLM?
Moltiplica i tuoi token di input per il prezzo di input del modello per 1M token, fai lo stesso per i token di output, poi somma. Usa il calcolatore di costi integrato per stimare i totali per qualsiasi modello e provider.
Quale LLM ha la finestra di contesto più grande?
Grok 4.1 Fast (Non-Reasoning) di xai dichiara la finestra di contesto più ampia, fino a 2,000,000 token. I suoi host riportano limiti diversi, da 128,000 a 2,000,000 token, quindi la finestra effettivamente utilizzabile dipende dal provider scelto.
Quali provider e modelli vengono confrontati qui?
Questo sito confronta 2025+ modelli tra provider come OpenAI, Alibaba, Anthropic, Google, Zhipu AI, Mistral, con prezzi di input, output e cache per 1M token oltre a classifiche di qualità.