Тибо Соттио, отвечающий в OpenAI за Codex, сбросил лимиты использования всем пользователям ChatGPT Work и Codex и рассказал, что происходило с расходом на GPT-5.6 Sol.
Главное: тарифы не урезали. Лимиты заканчивались быстрее из-за того, как ведёт себя новая модель.
Sol гораздо охотнее работает долго: делает больше вызовов инструментов и держит длинные цепочки с субагентами. На сложных задачах это даёт результат, но расход по части задач оказался выше запланированного.
При одном и том же уровне reasoning effort (заданной глубины размышления) Sol тратит больше токенов, чем предыдущие модели. High на Sol обходится дороже, чем High на GPT-5.5.
Программные вызовы инструментов, они же code mode, позволяют запускать инструменты параллельно и продолжать работу во время ожидания. Побочный эффект: больше ответов за один шаг, больше кэшированных входных токенов, выше итоговый расход. Сильнее всего это проявлялось при ожидании ответа инструмента и при большом количестве веб-поисков. Оба случая уже поправили.
Разброс между пользователями оказался огромным. У медианного пользователя расход выглядел экономным, а у тех, кто гоняет тяжёлые задачи, лимит выгорал очень быстро. Перед запуском в OpenAI ориентировались на средние значения и пропустили длинный хвост.
Что изменилось сейчас: при типовой работе с Sol лимитов должно хватать примерно на 18% дольше, у части пользователей улучшение будет заметнее. Пятичасовой лимит, приостановленный на время разбора, возвращают.
Практический вывод для тех, кто строит рабочие процессы на агентах: возможности модели и её экономичность растут с разной скоростью. Свежая версия может решать более сложные задачи и одновременно стоить дороже в токенах, и выясняется это только на реальной нагрузке. Планируя переход на новую модель, пересчитывайте расход заново, не опираясь на прошлые привычки.
По теме
Если у вас на Codex держится производственный контур, лимиты превращаются в вопрос планирования нагрузки и стоимости. Такой разбор полезен командам, которые считают токены наравне с часами людей.
Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov
Если хотите разобрать свою задачу — напишите мне Если хотите разобрать свою задачу — напишите мне.
Можно прийти с идеей, черновым контекстом или уже живой задачей. Помогу быстро понять, где реальный следующий шаг, а где лишний шум.
Обычно хватает 2–3 сообщений, чтобы понять, могу ли я здесь реально помочь и в каком формате лучше двигаться дальше.