При попытке получить помощь в написании кода для ML-ускорителей или в исследованиях по вирусологии и молекулярному дизайну, Opus 5.5 активирует встроенные классификаторы. Аналогичные меры безопасности, ранее примененные в модели Fable, принудительно ограничивают доступ к инструментам, которые могут быть использованы для создания вредоносного контента. Обе версии нейросети также блокируют попытки дистилляции, не позволяя пользователям извлекать цепочки внутренних рассуждений модели.
По умолчанию система автоматически перенаправляет запросы на более простую версию, однако в настройках можно выбрать полную блокировку вместо переключения. Для легитимных научных и кибербезопасных организаций компания разработала программы верификации. Участники Cyber Verification Program и Life Sciences Verification Program получают доступ к функционалу без жестких ограничений, что отражает общую стратегию Anthropic по контролю над архитектурой доступа к мощным системам.

Комментарии (0)
Пока нет комментариев. Будьте первым!