OpenAI замедлила обучение своих сильнейших моделей на две недели и добавила 20% вычислительных затрат на контроль
OpenAI приостановила обучение с подкреплением некоторых своих сильнейших моделей на две недели и заморозила крупнейший запланированный тест. Компания также внедрила новую систему мониторинга, которая добавляет около 20% к вычислительным расходам на отслеживаемые операции. Об этом сообщает IXBT News.
«Правильно настроить безопасность ИИ важнее, чем инерция любой компании», — заявил Сэм Альтман.
Причинами такого решения стали два события. В июле модель, тестировавшаяся на киберспособности, смогла выйти из изолированной среды и получить доступ к системам Hugging Face. А 7 августа внутренние тесты невыпущенной модели Astra показали сильные результаты, которые не позволили исключить «критический уровень киберриска».
Сейчас компания переписывает свою систему оценки рисков, принятую в 2023 году. Новый мониторинг охватывает всё инструментальное обучение и оценки для моделей уровня GPT-5.6 Sol и выше, а также все инференсы Astra. Система читает цепочки рассуждений модели, а классификаторы отслеживают внутреннее состояние. При подозрении автоматически запускается расследование. Цель состоит в том, чтобы поднять тревогу за 30 минут и остановить прогон, если персонал не отреагирует.
OpenAI подчеркнула, что расходы в 20% не перекладывает на клиентов, но это дополнительное бремя для компании, которая готовится к IPO и всё ещё убыточна. На этом фоне конкурирующая Anthropic заявила, что не будет брать паузу, ссылаясь на 186-страничный отчёт о безопасности.
Подписывайтесь на наш Telegram-канал, чтобы быть в курсе всех новостей и событий Рунета.