Ad
Искусственный интеллект

Codex раздал сброс за 20 млн и проверяет лимиты

Маша Даровская
By Маша Даровская , IT-редактор и автор
Codex раздал сброс за 20 млн и проверяет лимиты
Обложка © Anonhaven

Codex преодолел отметку в 20 млн активных пользователей. В честь этого OpenAI начислила платным пользователям Codex и ChatGPT Work по одному сохраненному сбросу лимитов. Его можно не применять сразу, а оставить до момента, когда дополнительная квота действительно понадобится.

Пользователи Codex в последние дни массово жаловались, что доступный объём использования стал расходоваться быстрее обычного. Сначала команда не обнаружила общей аномалии и обратила внимание на злоупотребления через sub2api. Через несколько часов расследование дало более интересный результат: у части пользователей действительно снизилась доля попаданий в кэш, а это способно увеличить расход квоты.

Об отметке в 20 млн пользователей и сохраненном сбросе 21 августа сообщил в X Тибо Соттио, работающий над Codex и ChatGPT в OpenAI.

 

На этот раз OpenAI не стала принудительно возвращать всем квоту к исходному значению. Пользователям выдали так называемый banked reset — сохраненный сброс, который лежит в аккаунте до ручной активации.

Позднее Соттио уточнил, что подарок предназначен для платных пользователей Codex и ChatGPT Work, а затем сообщил о завершении раздачи. В отдельных аккаунтах начисление появлялось с задержкой; спустя несколько часов он написал в ответе одному из пользователей, что распространение сброса уже должно было завершиться.

Официальная справка OpenAI о Codex описывает механику полного сохраненного сброса: при активации заново запускаются пятичасовое и недельное окна использования. Следующая дата недельного обновления после этого перемещается примерно на семь дней вперед.

Получается, применять сохраненный сброс при почти полной недельной квоте обычно нет смысла. Его выгоднее оставить до момента, когда основной запас подходит к концу. При этом OpenAI может задавать условия и срок действия конкретных акций, поэтому ориентироваться стоит на дату, которую показывает раздел Usage в самом аккаунте.

21 августа Соттио написал, что команда изучила несколько сообщений об изменившемся расходе Codex. На тот момент OpenAI не видела общей технической аномалии. При разборе конкретных аккаунтов инженеры заметили другой повторяющийся сценарий: многие из проверенных пользователей работали через sub2api.

22 августа появился новый результат расследования. OpenAI увидела, что у части пользователей на этой неделе доля попаданий в кэш оказалась хуже, чем в предыдущие стабильные недели. Соттио связал это с возможным ускорением расхода доступного объема и сообщил, что проверка продолжается. Следующее обновление команда намерена опубликовать после дополнительного анализа.

Codex при работе над проектом постоянно получает контекст: исходный код, историю диалога, результаты предыдущих действий, инструкции и другие данные. Значительная часть этого контекста может повторяться между запросами.

Повторяющиеся данные выгодно брать из кэша — уже обработанного контекста. Это требует меньше вычислительных ресурсов, поэтому такие токены учитываются значительно дешевле новых входных данных.

Разница видна в действующей таблице расхода кредитов Codex: для GPT-5.6 Sol один миллион обычных входных токенов соответствует 125 кредитам, а миллион входных токенов, взятых из кэша, — 12,5 кредита. Выходные токены стоят 750 кредитов за миллион. То есть кэшированный ввод для этой модели учитывается в десять раз дешевле обычного.

Если система перестает находить в кэше данные, которые раньше успешно переиспользовала, один и тот же рабочий процесс может начать требовать больше ресурсов. Отсюда и возможное ощущение, что процент недельной квоты уходит быстрее, хотя пользователь не стал отправлять в несколько раз больше задач.

OpenAI пока не раскрыла, насколько именно снизилась доля попаданий в кэш и сколько пользователей затронуто. Нет также окончательного вывода, объясняет ли эта проблема все нынешние жалобы.

23 мая пользователи тоже заметили ускорившийся расход Codex. Тогда инженерам удалось найти конкретную причину: одна из оптимизаций ухудшила попадание в кэш при сжатии контекста длительных сеансов. Изменение откатили, после чего OpenAI восстановила лимиты всем аккаунтам. Соттио публично описал причину и исправление в тот же день.

До обнаружения проблемы с кэшем основное внимание привлёк sub2api. Проект позволяет собрать один или несколько аккаунтов Codex в пул и выставить поверх них интерфейс, совместимый с API OpenAI и Anthropic. В его репозитории описаны управление несколькими аккаунтами, собственные ключи доступа, распределение запросов и API-методы для внешних клиентов.

Для OpenAI принципиально, что происходит с таким шлюзом дальше. Соттио объяснил: превращение пользовательской подписки в API-трафик с последующей раздачей или обслуживанием множества пользователей OpenAI не поддерживает. Такой трафик может срабатывать в системах защиты от мошенничества.

Это, однако, не стало окончательным объяснением жалоб на лимиты. Через несколько часов Соттио подчеркнул, что пример с sub2api относится лишь к одному обнаруженному шаблону использования, а расследование общего ускорения расхода квоты продолжается. Затем команда нашла снижение эффективности кэша.

Есть новость? Станьте автором.

Мы сотрудничаем с независимыми исследователями и специалистами по кибербезопасности. Отправьте нам новость или предложите статью на рассмотрение редакции.