pimenov.ai

Лимиты Codex снова сброшены: Тибо Соттио объяснил, куда они утекали

OpenAI снова сбросила лимиты Codex и ChatGPT Work, а Тибо Соттио подробно разобрал восемь багов, которые сжигали квоту, и рассказал, что именно исправили.

CodexИИ-агенты

В субботу OpenAI в очередной раз сбросила лимиты всем платным пользователям Codex и ChatGPT Work. Сами сбросы уже стали привычным ритуалом, но на этот раз интересно другое: Тибо Соттио, руководитель Codex, приложил к сбросу подробный разбор того, куда утекала квота.

Команда круглосуточно разбирала тысячи репортов и прошлась по системе «мелким гребнем». Что нашли и починили:

  • Сжатие контекста. При сжатии длинных сессий сохранялись старые изображения, контекст раздувался и мог запустить сжатие повторно. У работающих с картинками расход упал примерно на 10%.
  • Память. Фоновые процессы памяти наследовали стоп-хуки и не могли завершиться. Затронуто меньше 1% пользователей, но один тред 15 000 раз проверял, можно ли ему остановиться.
  • Цели. Цель, запущенная через /goal, могла продолжить работу после достижения результата или бесконечно повторять сломанный инструмент. Были случаи на 15–70% недельной квоты.
  • Автоматизации. Некоторые пользовательские расписания запускались чаще, чем были настроены.
  • Субагенты. Младшие модели вроде Luna иногда звали более мощных помощников без явного запроса, а оркестратор мог включить для них быстрый режим /fast.
  • Computer History. Старая реализация повторно суммаризировала одни и те же действия: в отдельных случаях это съедало до пятой части недельной квоты.
  • Фоновые суммаризации. Каждый обычный ход диалога запускал лишние фоновые запросы, примерно 1% к расходу токенов. Функцию отключили.
  • MCP. Результаты инструментов иногда кодировались дважды, а инструкции обрезались и запрашивались заново.

По оценке Тибо, квота теперь должна растягиваться на 10–50% дальше, в зависимости от того, как вы пользуетесь Codex. Команда также поменяла архитектуру, чтобы эти ошибки не вернулись, и поставила тревогу, которая поднимет дежурных при повторении. А в приложении появится разбивка, куда именно уходит квота.

Мне здесь интересен даже не список багов, а жест. После первого большого интервью Тибо, где он объяснял, как всё устроено внутри OpenAI, он стал рассказывать о происходящем ещё шире и подробнее. Вместо молчаливого сброса пользователи получают публичный постмортем с цифрами и названиями подсистем — редкий уровень открытости для компании такого масштаба.

Разобраться в самой среде поможет мой единый справочник по Codex.

Следующий шаг

Как OpenAI превратила сбросы лимитов Codex в петлю роста

Связанные материалы

Если вы строите ежедневную работу вокруг Codex, вопрос лимитов и устойчивости контура вас напрямую касается.

Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov