pimenov.ai

OpenAI на две недели остановила обучение флагманских моделей

OpenAI приостановила RL-обучение флагманских моделей: Astra приблизилась к критическому порогу киберспособностей, а мониторинг теперь съедает 20% вычислений.

ОбзорИИ-агенты

OpenAI официально подтвердила: компания на две недели приостановила RL-обучение (reinforcement learning, обучение с подкреплением) своих новейших моделей, а самый крупный запланированный запуск до сих пор стоит на паузе.

Причина названа прямо. Внутренние тесты показали, что готовящаяся модель Astra может достичь критического порога киберспособностей по собственной шкале оценки рисков OpenAI. Дополнительным триггером стал недавний инцидент между OpenAI и Hugging Face: компания обещает опубликовать о нём отдельный технический отчёт.

Что сделано за время паузы:

  • усиленная изоляция процессов, которые исполняют сгенерированный моделью код;
  • отсечение рискованных нагрузок от интернета и внутренних сетей;
  • многоступенчатый мониторинг: классификаторы проверяют каждый токен, а подозрительные действия передаются автоматическим «следователям» на более мощных моделях;
  • тревога высшего приоритета должна дойти до команды в течение 30 минут, и если за это время ложное срабатывание не доказано, активность останавливают.

Самая говорящая цифра заявления: мониторинг съедает примерно 20% вычислений наблюдаемого инференса. Безопасность перестала быть разделом на сайте для регуляторов и стала строкой расходов на GPU.

Практический вывод для тех, кто строит продукты на этих моделях: даже у OpenAI выпуск новой версии теперь зависит не только от качества самой модели, но и от пропускной способности её собственной системы надзора. Сроки релизов флагманов впервые официально подчинены скорости работы safety-инфраструктуры.

Следующий шаг

Продолжение темы о том, как OpenAI балансирует между скоростью и ограничениями: Лимиты Codex: почему OpenAI ходит по тонкому льду и как выживать прямо сейчас

Связанные материалы

Надзор за моделями быстро перестаёт быть абстрактной темой: если вы строите процессы вокруг ИИ-агентов, вопросы изоляции и мониторинга рано или поздно коснутся и вашей инфраструктуры. Такое обсуждение полезно командам, которые планируют внедрение агентов в реальные процессы.

Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov