Нажмите Ctrl+D (Windows) или ⌘+D (Mac), чтобы добавить сайт в закладки

Сколько стоит API нейросети в месяц: расчёт для трёх типовых сценариев

«$3 за 1 млн токенов» ничего не говорит о счёте. Считаем на трёх типовых задачах

Ценники API выглядят обманчиво дёшево: «$3 за миллион токенов» звучит как копейки, пока не выясняется, что миллион токенов расходуется за пару дней. Ниже — формула и три типовых сценария, посчитанных по официальным ценам.

Формула

Стоимость = (входные токены ÷ 1 млн × цена входа) + (выходные токены ÷ 1 млн × цена выхода)

Входные токены — весь ваш запрос вместе с контекстом, системным промптом и историей диалога. Выходные — ответ модели. Важно: у всех моделей ниже выходные токены стоят в 3–6 раз дороже входных.

Сценарий 1. Чат-бот поддержки

1 000 обращений в день, в каждом ~2 000 входных и ~500 выходных токенов. За 30 дней это 30 000 запросов: 60 млн входных и 15 млн выходных токенов.

Разница между верхней и нижней строкой — трёхкратная. Прежде чем платить за флагман, прогоните свои типовые обращения на дешёвой модели.

Сценарий 2. Помощник по коду, один разработчик

100 запросов в день, но контекст большой: ~10 000 входных и ~1 500 выходных токенов на запрос. За 30 дней — 3 000 запросов: 30 млн входных и 4,5 млн выходных токенов.

Здесь вся вилка укладывается в $200 в месяц — меньше, чем стоит один рабочий день разработчика. Экономить на модели имеет смысл, только если вы проверили, что дешёвая справляется с вашим кодом.

Сценарий 3. Пакетная обработка документов

500 документов в месяц, ~20 000 входных и ~2 000 выходных токенов на документ: 10 млн входных и 1 млн выходных токенов.

Объём токенов большой, а задача однотипная — здесь почти двукратная экономия достаётся дёшево. Проверьте качество на десятке своих документов, прежде чем гнать весь пакет.

Три рычага снижения счёта

  1. Сменить способ оплаты. Самый недооценённый рычаг, и он же самый сильный: у сервисов с оплатой в USDT тарифы на ту же модель обычно в разы дешевле официальной цены, а у тех, кто принимает карту РФ и СБП, — чаще дороже неё. За рублёвое удобство берут наценку, и она больше, чем любая экономия на модели.
  2. Ограничить длину ответа. Раз выход дороже входа в 3–6 раз, лимит на длину ответа бьёт по счёту сильнее, чем сокращение промпта.
  3. Понизить класс модели там, где это не вредит. Массовые простые операции — классификация, извлечение, разметка — не требуют флагмана.

Две поправки к расчёту

Русский язык съедает больше токенов. Суммы выше посчитаны от заданного числа токенов. Но одна и та же задача на русском израсходует токенов больше, чем на английском, — то есть в формулу нужно подставлять большие объёмы, чем в англоязычном примере (подробнее о кириллице и стоимости).

Это официальные цены. У сервисов-агрегаторов цена на ту же модель бывает и ниже официальной, и выше. Актуальные цены в рублях по каждому сервису — в таблицах сравнения.

Частые вопросы

Как рассчитать стоимость API нейросети?
Стоимость = (входные токены ÷ 1 млн × цена входа) + (выходные токены ÷ 1 млн × цена выхода). Входные токены — это ваш запрос вместе со всем контекстом и историей диалога, выходные — ответ модели. Оценить объём можно по полю расхода токенов, которое API возвращает в каждом ответе.
Почему выходные токены дороже входных?
Генерация ответа вычислительно дороже, чем чтение запроса. У актуальных моделей выходные токены стоят примерно в 3–6 раз дороже входных: например, у Claude Sonnet 5 это $3 за 1 млн входных против $15 за 1 млн выходных. Поэтому ограничение длины ответа снижает счёт сильнее, чем сокращение промпта.
Как снизить расходы на API?
Три рычага по убыванию эффекта: сменить способ оплаты (у сервисов с оплатой в USDT тарифы обычно в разы дешевле официальной цены, у принимающих карту РФ — чаще дороже), ограничить длину ответов и брать модель попроще для простых массовых задач. Первый рычаг обычно даёт больше остальных вместе взятых.
Посчитать на своих ценах