LLM Pricing
PrezziClassificheStrumentiProviderUsciteGuide

© 2026 LLM Pricing

About
·Contact
·Privacy
·RSS

Prezzi degli LLM a colpo d’occhio

Confronta prezzo, funzionalità e le quotazioni di ogni provider per i principali LLM in un unico posto

I dati sono i prezzi e le specifiche API pubblicati da ciascun provider, con i prezzi normalizzati in dollari statunitensi per milione di token. Filtra per funzionalità, finestra di contesto o budget, oppure apri un modello qualsiasi per confrontarne la quotazione presso tutti i provider, con i punteggi di qualità e velocità quando disponibili.

1,922 modelli · 213 provider · 7,692 quotazioni · sincronizzato 2026-09-11

⌕

Filtri

Tipo di modello

Il tipo è derivato da famiglia + modalità di output. Per impostazione predefinita solo modelli di chat.

Funzionalità

Modalità di input

Pesi

Finestra di contesto

Qualsiasi

Prezzo input min (USD/1M)

Qualsiasi

Ciclo di vita

Lab (0)

Provider (0)

Mostrando 0 / 0 modelli

Explore models

Browse 1,922 large language models by intelligence, price, context window and availability. Open any model for its full pricing across every provider.

Highest intelligence

  • Claude Fable 5.1AA 65.7
  • Claude Opus 5AA 63.1
  • Claude Fable 5AA 62.1
  • GPT-5.6 SolAA 60.9
  • Grok 4.6AA 60.9
  • Kimi K3AA 59.7
  • GLM-5.3AA 59.5
  • Qwen3.8 MaxAA 58.1
  • Qwen3.8 2.4T A95BAA 57.7
  • GLM-5.3-FlashAA 57.5
  • Claude Opus 4.8AA 57.3
  • Muse Spark 1.2AA 56.8

Lowest blended price

  • Llama 3.2 1B Instruct$0.010
  • Google Gemma 2$0.015
  • Llama 3.2 3B Instruct$0.020
  • E5 Mistral 7B$0.020
  • PaddleOCR-VL$0.020
  • Mistral Nemo$0.022
  • Llama 3.1 8B (decentralized)$0.022
  • Meta Llama 3.1 8B Instruct Turbo$0.022
  • GLM-5.3-Flash$0.024
  • Llama-3.1-8B-Instruct$0.025
  • DeepSeek OCR 2$0.030
  • DeepSeek OCR$0.030

Largest context window

  • Pokee-Isaac 28B1M
  • Qwen Long1M
  • Llama 4 Scout 17B Instruct (US)3.5M
  • Gemini 2.0 Pro 02052.1M
  • Gemini 2.0 Pro 12062.1M
  • Gemini 2.0 Flash-Lite2M
  • Grok 4.202M
  • grok-4-fast-non-reasoning2M
  • grok-4-fast-reasoning2M
  • Auto Router2M
  • X-Ai/Grok 4.1 Fast Non Reasoning2M
  • Grok 4.1 Fast Reasoning (Azure AI Foundry)2M

Most providers

  • GLM-5.2102 hosts
  • GPT OSS 120B82 hosts
  • DeepSeek V4 Pro79 hosts
  • DeepSeek V4 Flash77 hosts
  • Kimi K372 hosts
  • Kimi K2.7 Code64 hosts
  • GLM-5.3-Flash57 hosts
  • GLM-5.352 hosts
  • DeepSeek V4 Flash 073152 hosts
  • GPT-5.549 hosts
  • Claude Sonnet 4.649 hosts
  • Claude Opus 4.847 hosts

Come funziona questo confronto

Ogni cifra qui è la tariffa API per token pubblicata da ciascun provider, normalizzata in dollari statunitensi per milione di token. Quando un modello è ospitato da più provider, la tabella mantiene la quotazione di ciascuno invece di farne la media, perché lo stesso modello spesso varia per prezzo, finestra di contesto e funzionalità da un host all'altro.

Il prezzo combinato ordina i modelli con un solo numero: prezzo di input per 0,75 più prezzo di output per 0,25, in linea con un'ipotesi d'uso di 3 a 1 tra input e output. Il canale a pagamento più economico esclude i livelli a $0, poiché l'accesso gratuito comporta di solito limiti di frequenza e nessuna garanzia sul livello di servizio. I punteggi di qualità, quando mostrati, provengono da Artificial Analysis; la maggior parte dei modelli non ha dati di qualità indipendenti, quindi quelle righe mostrano solo il prezzo.

I dati su prezzo e funzionalità sono aggregati da models.dev, mentre quelli su qualità e velocità da Artificial Analysis. Le cifre sono indicative e possono cambiare, perciò la pagina ufficiale del provider è l'autorità finale prima di scegliere un canale.

Domande frequenti

Qual è l’API LLM più economica nel 2026?
In base al nostro confronto di 1922+ modelli, Llama 3.2 1B Instruct di Inference offre il prezzo combinato più basso, circa $0.010 per 1M token.
Come stimo i costi dell’API LLM?
Moltiplica i tuoi token di input per il prezzo di input del modello per 1M token, fai lo stesso per i token di output, poi somma. Usa il calcolatore di costi integrato per stimare i totali per qualsiasi modello e provider.
Quale LLM ha la finestra di contesto più grande?
Pokee-Isaac 28B di misc supporta la finestra di contesto più grande, fino a 10,000,000 token.
Quali provider e modelli vengono confrontati qui?
Questo sito confronta 1922+ modelli tra provider come Alibaba, OpenAI, Anthropic, Google, Zhipu AI, Mistral, con prezzi di input, output e cache per 1M token oltre a classifiche di qualità.