Калькулятор стоимости ИИ-запросов и сравнение моделей

Вставьте промпт — увидите токены и стоимость на GPT, Claude, Gemini, Qwen, DeepSeek, а затем сравните две модели

0
Символы
0
Слова
0
≈ токенов (GPT)
МодельТокеныВходВыход Один запросЗапросов: {n}КонтекстВлезает?
Цены по состоянию на сентябрь 2026 года (USD за 1 млн токенов).
Количество токенов — локальная оценка (настоящий токенизатор каждого вендора отличается, обычно на 5–15%; неанглийский текст и код токенизируются менее эффективно). Цены — публичные прайс-листы в долларах США за 1 миллион токенов, без скидок за кэш и пакетную обработку, и они часто меняются: перед планированием бюджета проверьте страницу цен провайдера. Если у провайдера есть ценовые уровни, показан только стандартный (например, Gemini 3.1 Pro дороже свыше 200K токенов, у DeepSeek указаны цены в часы пик, а вне пика — вдвое дешевле, у Gemini 3.8 Flash акционная цена до 31 декабря 2026). Скорость — грубая относительная категория, а не бенчмарк. Всё считается в вашем браузере; текст никуда не отправляется.

О ценах на LLM и контекстных окнах

Большие языковые модели тарифицируются по токенам — небольшим фрагментам текста, примерно три четверти английского слова. Провайдеры отдельно берут плату за токены, которые вы отправляете (вход), и токены, которые модель пишет в ответ (выход), причём выход обычно в несколько раз дороже, поэтому короткий вопрос с длинным ответом может стоить дороже длинного документа с кратким резюме.

Цена — лишь одна из осей при выборе модели. Контекстное окно определяет, сколько текста модель учитывает одновременно — от ста тысяч токенов до миллиона и более; скорость решает, будет ли чат казаться мгновенным; а мультимодальные модели умеют ещё и читать изображения, слушать аудио и смотреть видео. Дешёвые быстрые модели подходят для классификации, извлечения данных и массового чата, а флагманские и рассуждающие стоят своих денег на сложном программировании, анализе и планировании.

Сравнение моделей класса GPT, Claude, Gemini, Qwen, DeepSeek, Grok и Llama бок о бок делает компромиссы видимыми до того, как проект вырастет: умножьте стоимость запроса на месячный объём — и десятикратная разница в цене превращается в реальную строку бюджета. Модели с открытыми весами добавляют ещё один вариант: их можно запускать на собственном оборудовании или у нескольких конкурирующих хостеров.