Нажмите Ctrl+D (Windows) или ⌘+D (Mac), чтобы добавить сайт в закладки

Ошибка 429 (Too Many Requests) в AI API: причины и решение

Две разные причины одной ошибки — и как их отличить за 30 секунд

Код 429 Too Many Requests — одна из самых частых ошибок при работе с Claude, GPT и Gemini API. Проблема в том, что за одним и тем же кодом скрываются две разные ситуации с разными решениями: лимит на стороне официального провайдера и перегрузка канала на стороне агрегатора.

Причина 1: официальный лимит частоты запросов

У каждого аккаунта есть лимит запросов и токенов в минуту — он растёт по мере трат или задаётся тарифным планом. Если вы шлёте запросы быстрее лимита — получаете 429 стабильно, при любой попытке, пока не снизите частоту или не подождёте.

Признаки: ошибка повторяется предсказуемо при одинаковой нагрузке; в теле ответа обычно явно фигурирует формулировка про лимит запросов или токенов в минуту; после паузы в 30–60 секунд запрос обычно проходит.

Причина 2: перегружен канал у агрегатора

Если вы подключены не напрямую, а через агрегатор, часть тарифов работает через общий канал на многих пользователей одновременно — типичный пример разобран в материале про типы каналов: у части Max-тарифов лимит подписки делится между клиентами сервиса, и в пиковые часы канал может отдавать 429 или замедляться независимо от того, сколько запросов отправляете лично вы.

Признаки: ошибка возникает волнами, без всяких изменений в вашей нагрузке; чаще в вечерние часы и рабочие дни; после паузы в минуту-две тот же запрос проходит.

Как отличить одно от другого

  • Прочитайте ответ целиком — вместе с заголовками. Это самый надёжный способ: в заголовках ответа часто указано, через сколько повторять и какой лимит сработал. Официальный лимит обычно называет себя явно (rate limit, requests per minute, tokens per minute); агрегатор либо транслирует ту же ошибку от провайдера, либо возвращает собственную заглушку без деталей — и уже это вам кое-что говорит.
  • Проверьте стабильность. Одинаковая нагрузка + одинаковый результат каждый раз → официальный лимит. Ошибка то возникает, то нет при той же нагрузке → скорее канал агрегатора.
  • Смените время. Если при той же нагрузке ошибка пропадает ночью и возвращается вечером — причина больше похожа на перегрузку канала: у официального лимита «часов пик» нет.

Что делать

Если это официальный лимит

Снизьте частоту запросов, добавьте повтор с увеличивающейся задержкой на стороне своего кода, либо перейдите на тариф/канал с более широким лимитом.

Если это канал агрегатора

Разовая перегрузка в час пик — не повод менять сервис. Систематическая — повод посмотреть на другой тип канала: у тарифов с пометкой Official/Vertex лимиты обычно шире и предсказуемее, чем у Max/Reverse. Сравните тарифы разных сервисов на одну модель в нашей таблице цен.

Частые вопросы

Что означает ошибка 429 при запросе к API нейросети?
HTTP-код 429 (Too Many Requests) значит, что сервер сейчас не принимает запрос. Причин две: превышен лимит вашего аккаунта у официального провайдера — либо перегружен общий канал агрегатора, через который вы подключены, и ваша личная частота запросов тут ни при чём.
Как понять, чей это лимит — официальный или агрегатора?
Смотрите текст ошибки: официальный лимит обычно прямо называет себя в тексте ответа — лимит запросов или токенов в минуту — и стабильно повторяется при одинаковой нагрузке. Ошибка от перегруженного канала агрегатора чаще возникает волнами (в пиковые часы) и пропадает при повторе через минуту-две без изменения вашей нагрузки.
429 повторяется постоянно — что делать?
Если это официальный лимит — снизьте частоту запросов или поднимите уровень аккаунта у провайдера. Если проблема на стороне агрегатора — смените канал/тариф: у части Max-тарифов лимит подписки делится между клиентами сервиса, у Official/Vertex-каналов лимиты обычно шире. Сравните тарифы в рейтинге и переключитесь на сервис с более стабильным каналом.
Сравнить каналы и тарифы