LLM Pricing
ЦеныРейтингиИнструментыПровайдерыРелизыРуководства

© 2026 LLM Pricing

About
·Contact
·Privacy
·RSS

Цены LLM с одного взгляда

Сравните цену, возможности и предложения всех провайдеров по основным LLM в одном месте

1,920 моделей · 213 провайдеров · 7,617 предложений · синхронизировано 2026-09-09

⌕

Фильтры

Тип модели

Тип выводится из семейства + модальности вывода. По умолчанию только чат-модели.

Возможности

Модальность ввода

Веса

Окно контекста

Любой

Мин. цена ввода (USD/1M)

Любая

Жизненный цикл

Лаборатории (0)

Провайдеры (0)

Показано 0 / 0 моделей

Explore models

Browse 1,920 large language models by intelligence, price, context window and availability. Open any model for its full pricing across every provider.

Highest intelligence

  • Claude Fable 5.1AA 65.7
  • Claude Opus 5AA 63.1
  • Claude Fable 5AA 62.1
  • GPT-5.6 SolAA 60.9
  • Grok 4.6AA 60.9
  • Kimi K3AA 59.7
  • GLM-5.3AA 59.5
  • Qwen3.8 MaxAA 58.1
  • Qwen3.8 2.4T A95BAA 57.7
  • GLM-5.3-FlashAA 57.5
  • Claude Opus 4.8AA 57.3
  • Muse Spark 1.2AA 56.8

Lowest blended price

  • Llama 3.2 1B Instruct$0.010
  • Google Gemma 2$0.015
  • Llama 3.2 3B Instruct$0.020
  • E5 Mistral 7B$0.020
  • PaddleOCR-VL$0.020
  • Mistral Nemo$0.022
  • Llama 3.1 8B (decentralized)$0.022
  • Meta Llama 3.1 8B Instruct Turbo$0.022
  • GLM-5.3-Flash$0.024
  • Llama-3.1-8B-Instruct$0.025
  • DeepSeek OCR 2$0.030
  • DeepSeek OCR$0.030

Largest context window

  • Pokee-Isaac 28B1M
  • Qwen Long1M
  • Llama 4 Scout 17B Instruct (US)3.5M
  • Gemini 2.0 Pro 02052.1M
  • Gemini 2.0 Pro 12062.1M
  • Gemini 2.0 Flash-Lite2M
  • Grok 4.202M
  • grok-4-fast-non-reasoning2M
  • grok-4-fast-reasoning2M
  • Auto Router2M
  • X-Ai/Grok 4.1 Fast Non Reasoning2M
  • X-Ai/Grok 4.1 Fast Reasoning2M

Most providers

  • GLM-5.2101 hosts
  • GPT OSS 120B83 hosts
  • DeepSeek V4 Flash80 hosts
  • DeepSeek V4 Pro79 hosts
  • Kimi K372 hosts
  • Kimi K2.7 Code64 hosts
  • GLM-5.3-Flash54 hosts
  • DeepSeek V4 Flash 073151 hosts
  • GPT-5.549 hosts
  • Claude Sonnet 4.649 hosts
  • GLM-5.349 hosts
  • Claude Opus 4.847 hosts

Как устроено это сравнение

Каждая цифра здесь — это опубликованная каждым провайдером цена API за токен, приведённая к долларам США за один миллион токенов. Когда модель размещают несколько провайдеров, таблица сохраняет собственную цену каждого, а не усредняет их, потому что одна и та же модель у разных хостов часто различается по цене, окну контекста и набору возможностей.

Комбинированная цена ранжирует модели по одному числу: цена ввода умноженная на 0,75 плюс цена вывода умноженная на 0,25, что соответствует предположению об использовании ввода к выводу как 3 к 1. Самый дешёвый платный канал не учитывает уровни за $0, поскольку бесплатный доступ обычно имеет ограничения по скорости и не даёт гарантий уровня обслуживания. Оценки качества, где они показаны, взяты из Artificial Analysis; у большинства моделей нет независимых данных о качестве, поэтому в этих строках показана только цена.

Данные о ценах и возможностях агрегируются из models.dev, а данные о качестве и скорости — из Artificial Analysis. Цифры ориентировочные и могут меняться, поэтому официальная страница провайдера остаётся итоговым источником, прежде чем вы выберете канал.

Частые вопросы

Какой самый дешёвый LLM API в 2026 году?
По нашему сравнению 1920+ моделей, Llama 3.2 1B Instruct от Inference предлагает самую низкую смешанную цену — около $0.010 за 1M токенов.
Как оценить стоимость LLM API?
Умножьте входные токены на цену входа модели за 1M токенов, сделайте то же для выходных токенов и сложите. Используйте встроенный калькулятор стоимости, чтобы оценить итоги для любой модели и провайдера.
У какого LLM самое большое окно контекста?
Pokee-Isaac 28B от misc поддерживает самое большое окно контекста — до 10,000,000 токенов.
Какие провайдеры и модели здесь сравниваются?
Сайт сравнивает 1920+ моделей у провайдеров вроде Alibaba, OpenAI, Anthropic, Google, Zhipu AI, Mistral, с ценами за вход, выход и кэш за 1M токенов, а также рейтингами качества.