Anthropic запретила Opus 5.5 помогать в разработке LLM

Anthropic ввела дополнительные ограничения для своей флагманской модели Claude Opus 5.5. Теперь система не помогает в разработке передовых языковых моделей (frontier LLM).
«При обнаружении запросов, связанных, например, с созданием ядра для определённых ML-ускорителей, разговор автоматически переключается на менее способную Opus 5», — сообщает IXBT News.
Ограничение действует только для Opus 5.5, у Opus 5 таких запретов нет. Аналогичные «предохранители» появились в биологической сфере. Opus 5.5 получила классификаторы, близкие к тем, что используются в модели Fable, для запросов двойного назначения — вирусологии, токсикологии, молекулярного дизайна. При срабатывании модель также откатывается на Opus 5.
Обе модели, Opus 5 и Opus 5.5, блокируют попытки дистилляции — извлечения внутренних рассуждений, например просьбы повторить цепочку мыслей дословно. Обычные вопросы вроде «почему так сделал?» остаются доступными.
Автоматическое переключение моделей включено по умолчанию, но пользователь может отключить его в настройках: тогда запрос будет просто заблокирован. Компания объясняет меры стремлением снизить риски по мере роста возможностей ИИ.
Для организаций, занимающихся кибербезопасностью или науками о жизни, Anthropic предлагает программы верификации — Cyber Verification Program и Life Sciences Verification Program. Они открывают доступ к более способным моделям с меньшими ограничениями. Opus 5.5 пока недоступна в киберпрограмме, но организациям на Opus 4.8 уже предоставляется доступ к Opus 5 с ослабленными кибер-ограничениями.
Подписывайтесь на наш Telegram-канал, чтобы быть в курсе всех новостей и событий Рунета.