НовостиАкцииРуководитель OpenAI Codex винит инструменты sub2api на фоне сообщений пользователей о сокращении лимитов использования

Руководитель OpenAI Codex винит инструменты sub2api на фоне сообщений пользователей о сокращении лимитов использования

Автор: Cryptopolitan·

Ключевые выводы

  • Тибо Соттио заявил, что OpenAI не меняет лимиты использования тихо и незаметно, и возложил ответственность за многие жалобы на аккаунты, использующие инструменты «sub2api».
  • Разработчики сообщали, что их квоты Codex исчерпывались необычно быстро: один подписчик 20x заявил, что его недельный лимит закончился примерно за пять часов.
  • Некоторые пользователи отмечали, что у новых аккаунтов на том же тарифе недельные лимиты были значительно меньше, чем у старых.
  • Согласно справочному центру OpenAI, Codex, ChatGPT Work и связанные инструменты используют общую квоту, а объём использования зависит от таких факторов, как выбор модели и сложность задачи.
  • Ранее OpenAI сообщала, что всплеск использования Codex в июне был вызван дублированием фоновой работы, и впоследствии сбросила лимиты всех пользователей.
Руководитель OpenAI Codex винит инструменты sub2api на фоне сообщений пользователей о сокращении лимитов использования

OpenAI опровергла утверждения о том, что компания изменила лимиты использования Codex, не поставив в известность разработчиков: руководитель Codex Тибо Соттио указал на сторонние инструменты «sub2api» как на объяснение после того, как платные пользователи сообщили, что их недельная квота Codex расходуется гораздо быстрее, чем предполагали приобретённые тарифы. Codex — это агентный инструмент OpenAI для написания кода, который расходует недельную квоту, привязанную к подписке ChatGPT, — модель с фиксированной оплатой, отличающаяся от тарификации API OpenAI по факту использования, и именно эту границу между подпиской и API пересекают инструменты «sub2api».

Снизила ли OpenAI свои лимиты использования?

Тибо Соттио, который сейчас руководит и ChatGPT, и Codex на посту главы основных продуктов OpenAI, в интервью Wired, ответил в широко разошедшемся посте в X на жалобы разработчиков о том, что их недельная квота Codex стремительно истощается.

Соттио написал, что корректировка лимитов использования — это не то, что компания делает без обсуждения с сообществом и открытого информирования. По его словам, когда его команда изучила аккаунты, в которых квоты стремительно расходовались, оказалось, что многие из них использовали инструменты «sub2api», которые переупаковывают подписку ChatGPT так, чтобы к ней можно было обращаться как к тарифицируемому API OpenAI с оплатой по факту использования. Однако собственная документация OpenAI отмечает, что доступ по подписке и доступ по API-ключу оплачиваются раздельно.

На форуме разработчиков OpenAI подписчик Codex 20x, публикующийся под именем anil.c1, написал 14 августа, что исчерпывал свою недельную квоту почти за пятичасовой промежуток, хотя выполнял тот же объём работы в базовом Codex Desktop без дополнительных инструментов. Четыре дня спустя он написал снова, сообщив, что отменил свою подписку.

Другой пользователь, «plutavian», сообщил, что у совершенно нового аккаунта 20x недельный лимит составлял около 200 долларов, тогда как у более старого аккаунта на том же тарифе оставалось более 2 000 долларов.

На кону не только деньги, но и конкуренция: Codex — один из нескольких AI-агентов для программирования, работающих по подписке, среди которых также Claude Code от Anthropic и GitHub Copilot, а квоты использования являются одним из критериев, по которым разработчики сравнивают тарифы на этом рынке.

Вызвана ли проблема использования OpenAI только сторонними инструментами?

Разработчик по имени Айан Лашари (Ayaan Lashari) создал бесплатное приложение NerfTrack, опубликованное на GitHub, которое считывает данные об использовании Codex и отображает недельный объём в долларовом выражении — это обходное решение проблемы, заключающейся в том, что OpenAI показывает лишь процентную шкалу.

Расследование Kingy AI охарактеризовало утверждения NerfTrack как «правдоподобные, но недоказанные», указав, что меньшая квота и более быстрая трата выглядят совершенно одинаково на округлённой процентной шкале, из-за чего трудно понять, что происходит на самом деле. В отчёте также упоминалась публикация Алекса Гетмана (Alex Getman) от 20 августа, в которой утверждалось, что квота Plus в пересчёте на API-доллары снизилась примерно со 160 до 80 долларов.

Это уже второй случай, когда проблема возникла за два месяца, и за этот период Соттио неоднократно отвечал на жалобы, связанные с использованием. 30 июня Соттио провёл воскресную встречу в формате «военной комнаты» («warroom»), чтобы объяснить, что первый инцидент произошёл из-за того, что Codex по ошибке выполнял дополнительную работу в фоновом режиме: автоматические инструменты проверки и вспомогательные субагенты иногда запускались дважды или слишком усердно пытались исправить ошибки, расходуя больше квоты, чем предполагалось. Он также сказал, что на панели мониторинга отображалась часть активности, которая никогда не тарифицировалась, и подтвердил, что исправления были внесены, а лимиты использования всех пользователей были полностью сброшены.

Затем, 28 июля, по данным Kingy AI, он ответил на новую волну жалоб, сообщив, что GPT-5.6 Sol совершает больше вызовов инструментов и работает дольше, чем предыдущие модели, и что OpenAI настроила её так, что обычное использование длится примерно на 18% дольше. Он также опроверг, что компания сокращала лимиты использования по подпискам.

Настоящая проблема заключается в непонимании того, как работает лимит использования. В справочном центре OpenAI говорится, что Codex, ChatGPT Work и связанные инструменты используют одну общую квоту. Объём использования также зависит от многих факторов, включая используемую модель, место выполнения задачи, её сложность, а также контекст, уровень усилий на рассуждение, скорость и используемые инструменты.

Например, Kingy AI отметил, что быстрый режим (Fast Mode) выполняет GPT-5.6 примерно в 1,5 раза быстрее, но расходует кредиты в 2,5 раза быстрее обычного. Когда проблема обострилась в июне, решением OpenAI стал полный сброс лимитов всех пользователей; на этот раз публичной реакцией пока стало лишь объяснение о sub2api — о сбросе лимитов или изменении панели мониторинга, показывающей только проценты, объявлено не было.