pimenov.ai

Лимиты Codex обнулили: почему GPT-5.6 Sol сжигал их быстрее ожидаемого

Тибо из OpenAI сбросил лимиты ChatGPT Work и Codex и объяснил, почему GPT-5.6 Sol расходовал их быстрее ожидаемого. Что уже исправили.

CodexИИ-агентыОбзор

Тибо Соттио, отвечающий в OpenAI за Codex, сбросил лимиты использования всем пользователям ChatGPT Work и Codex и рассказал, что происходило с расходом на GPT-5.6 Sol.

Главное: тарифы не урезали. Лимиты заканчивались быстрее из-за того, как ведёт себя новая модель.

Sol гораздо охотнее работает долго: делает больше вызовов инструментов и держит длинные цепочки с субагентами. На сложных задачах это даёт результат, но расход по части задач оказался выше запланированного.

При одном и том же уровне reasoning effort (заданной глубины размышления) Sol тратит больше токенов, чем предыдущие модели. High на Sol обходится дороже, чем High на GPT-5.5.

Программные вызовы инструментов, они же code mode, позволяют запускать инструменты параллельно и продолжать работу во время ожидания. Побочный эффект: больше ответов за один шаг, больше кэшированных входных токенов, выше итоговый расход. Сильнее всего это проявлялось при ожидании ответа инструмента и при большом количестве веб-поисков. Оба случая уже поправили.

Разброс между пользователями оказался огромным. У медианного пользователя расход выглядел экономным, а у тех, кто гоняет тяжёлые задачи, лимит выгорал очень быстро. Перед запуском в OpenAI ориентировались на средние значения и пропустили длинный хвост.

Что изменилось сейчас: при типовой работе с Sol лимитов должно хватать примерно на 18% дольше, у части пользователей улучшение будет заметнее. Пятичасовой лимит, приостановленный на время разбора, возвращают.

Практический вывод для тех, кто строит рабочие процессы на агентах: возможности модели и её экономичность растут с разной скоростью. Свежая версия может решать более сложные задачи и одновременно стоить дороже в токенах, и выясняется это только на реальной нагрузке. Планируя переход на новую модель, пересчитывайте расход заново, не опираясь на прошлые привычки.

По теме

Если у вас на Codex держится производственный контур, лимиты превращаются в вопрос планирования нагрузки и стоимости. Такой разбор полезен командам, которые считают токены наравне с часами людей.

Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov