LLM Pricing
PreciosRankingsHerramientasProveedoresLanzamientosGuías

© 2026 LLM Pricing

About
·Contact
·Privacy
·RSS

Precios de LLM de un vistazo

Compara precio, capacidad y la oferta de cada proveedor de los principales LLM en un solo lugar

1,920 modelos · 213 proveedores · 7,617 cotizaciones · sincronizado 2026-09-09

⌕

Filtros

Tipo de modelo

El tipo se deriva de la familia + modalidad de salida. Solo modelos de chat por defecto.

Capacidad

Modalidad de entrada

Pesos

Ventana de contexto

Cualquiera

Precio mín. entrada (USD/1M)

Cualquiera

Ciclo de vida

Labs (0)

Proveedores (0)

Mostrando 0 / 0 modelos

Explore models

Browse 1,920 large language models by intelligence, price, context window and availability. Open any model for its full pricing across every provider.

Highest intelligence

  • Claude Fable 5.1AA 65.7
  • Claude Opus 5AA 63.1
  • Claude Fable 5AA 62.1
  • GPT-5.6 SolAA 60.9
  • Grok 4.6AA 60.9
  • Kimi K3AA 59.7
  • GLM-5.3AA 59.5
  • Qwen3.8 MaxAA 58.1
  • Qwen3.8 2.4T A95BAA 57.7
  • GLM-5.3-FlashAA 57.5
  • Claude Opus 4.8AA 57.3
  • Muse Spark 1.2AA 56.8

Lowest blended price

  • Llama 3.2 1B Instruct$0.010
  • Google Gemma 2$0.015
  • Llama 3.2 3B Instruct$0.020
  • E5 Mistral 7B$0.020
  • PaddleOCR-VL$0.020
  • Mistral Nemo$0.022
  • Llama 3.1 8B (decentralized)$0.022
  • Meta Llama 3.1 8B Instruct Turbo$0.022
  • GLM-5.3-Flash$0.024
  • Llama-3.1-8B-Instruct$0.025
  • DeepSeek OCR 2$0.030
  • DeepSeek OCR$0.030

Largest context window

  • Pokee-Isaac 28B1M
  • Qwen Long1M
  • Llama 4 Scout 17B Instruct (US)3.5M
  • Gemini 2.0 Pro 02052.1M
  • Gemini 2.0 Pro 12062.1M
  • Gemini 2.0 Flash-Lite2M
  • Grok 4.202M
  • grok-4-fast-non-reasoning2M
  • grok-4-fast-reasoning2M
  • Auto Router2M
  • X-Ai/Grok 4.1 Fast Non Reasoning2M
  • X-Ai/Grok 4.1 Fast Reasoning2M

Most providers

  • GLM-5.2101 hosts
  • GPT OSS 120B83 hosts
  • DeepSeek V4 Flash80 hosts
  • DeepSeek V4 Pro79 hosts
  • Kimi K372 hosts
  • Kimi K2.7 Code64 hosts
  • GLM-5.3-Flash54 hosts
  • DeepSeek V4 Flash 073151 hosts
  • GPT-5.549 hosts
  • Claude Sonnet 4.649 hosts
  • GLM-5.349 hosts
  • Claude Opus 4.847 hosts

Cómo funciona esta comparación

Cada cifra aquí es la tarifa de API por token que publica cada proveedor, normalizada a dólares estadounidenses por millón de tokens. Cuando un modelo está alojado por varios proveedores, la tabla conserva la cotización propia de cada uno en lugar de promediarlas, porque el mismo modelo suele diferir en precio, ventana de contexto y capacidades de un host a otro.

El precio combinado ordena los modelos con un solo número: precio de entrada por 0,75 más precio de salida por 0,25, según un supuesto de uso de 3 a 1 entre entrada y salida. El canal de pago más barato excluye los niveles de $0, ya que el acceso gratuito suele tener límites de tasa y ninguna garantía de servicio. Las puntuaciones de calidad, cuando se muestran, provienen de Artificial Analysis; la mayoría de los modelos no tienen datos de calidad independientes, así que esas filas solo muestran precio.

Los datos de precio y capacidad se agregan de models.dev, y los de calidad y velocidad de Artificial Analysis. Las cifras son orientativas y pueden cambiar, por lo que la página oficial del proveedor es la autoridad final antes de decidirte por un canal.

Preguntas frecuentes

¿Cuál es la API LLM más barata en 2026?
Según nuestra comparación de 1920+ modelos, Llama 3.2 1B Instruct de Inference ofrece el precio mixto más bajo, unos 0.010 $ por 1M de tokens.
¿Cómo estimo los costes de una API LLM?
Multiplica tus tokens de entrada por el precio de entrada del modelo por 1M de tokens, haz lo mismo con los de salida y súmalos. Usa la calculadora de costes integrada para estimar los totales de cualquier modelo y proveedor.
¿Qué LLM tiene la ventana de contexto más grande?
Pokee-Isaac 28B de misc admite la ventana de contexto más grande, hasta 10,000,000 tokens.
¿Qué proveedores y modelos se comparan aquí?
Este sitio compara 1920+ modelos de proveedores como Alibaba, OpenAI, Anthropic, Google, Zhipu AI, Mistral, con precios de entrada, salida y caché por 1M de tokens además de clasificaciones de calidad.