В субботу OpenAI в очередной раз сбросила лимиты всем платным пользователям Codex и ChatGPT Work. Сами сбросы уже стали привычным ритуалом, но на этот раз интересно другое: Тибо Соттио, руководитель Codex, приложил к сбросу подробный разбор того, куда утекала квота.
Команда круглосуточно разбирала тысячи репортов и прошлась по системе «мелким гребнем». Что нашли и починили:
- Сжатие контекста. При сжатии длинных сессий сохранялись старые изображения, контекст раздувался и мог запустить сжатие повторно. У работающих с картинками расход упал примерно на 10%.
- Память. Фоновые процессы памяти наследовали стоп-хуки и не могли завершиться. Затронуто меньше 1% пользователей, но один тред 15 000 раз проверял, можно ли ему остановиться.
- Цели. Цель, запущенная через /goal, могла продолжить работу после достижения результата или бесконечно повторять сломанный инструмент. Были случаи на 15–70% недельной квоты.
- Автоматизации. Некоторые пользовательские расписания запускались чаще, чем были настроены.
- Субагенты. Младшие модели вроде Luna иногда звали более мощных помощников без явного запроса, а оркестратор мог включить для них быстрый режим /fast.
- Computer History. Старая реализация повторно суммаризировала одни и те же действия: в отдельных случаях это съедало до пятой части недельной квоты.
- Фоновые суммаризации. Каждый обычный ход диалога запускал лишние фоновые запросы, примерно 1% к расходу токенов. Функцию отключили.
- MCP. Результаты инструментов иногда кодировались дважды, а инструкции обрезались и запрашивались заново.
По оценке Тибо, квота теперь должна растягиваться на 10–50% дальше, в зависимости от того, как вы пользуетесь Codex. Команда также поменяла архитектуру, чтобы эти ошибки не вернулись, и поставила тревогу, которая поднимет дежурных при повторении. А в приложении появится разбивка, куда именно уходит квота.
Мне здесь интересен даже не список багов, а жест. После первого большого интервью Тибо, где он объяснял, как всё устроено внутри OpenAI, он стал рассказывать о происходящем ещё шире и подробнее. Вместо молчаливого сброса пользователи получают публичный постмортем с цифрами и названиями подсистем — редкий уровень открытости для компании такого масштаба.
Разобраться в самой среде поможет мой единый справочник по Codex.
Следующий шаг
Как OpenAI превратила сбросы лимитов Codex в петлю роста
Связанные материалы
- Статья: Лимиты Codex: почему OpenAI ходит по тонкому льду и как выживать прямо сейчас
- Блог: Лимиты Codex обнулили: почему GPT-5.6 Sol сжигал их быстрее ожидаемого
- База знаний: Codex App — единый справочник по среде от OpenAI
Если вы строите ежедневную работу вокруг Codex, вопрос лимитов и устойчивости контура вас напрямую касается.
Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov
Если хотите разобрать свою задачу — напишите мне Если хотите разобрать свою задачу — напишите мне.
Можно прийти с идеей, черновым контекстом или уже живой задачей. Помогу быстро понять, где реальный следующий шаг, а где лишний шум.
Обычно хватает 2–3 сообщений, чтобы понять, могу ли я здесь реально помочь и в каком формате лучше двигаться дальше.
Дальше по теме
Консультации, аудит процессов, работа с контентом и сайтами, сессии для команд и решения под конкретную задачу.