Компания классифицировала потенциал Astra как «Critical» согласно внутренней системе Preparedness Framework. Этот порог означает, что нейросеть способна без участия человека атаковать защищенные системы, получая лишь общую задачу. Для сравнения, предыдущие разработки, в том числе GPT-5.6-Sol, оценивались уровнем «High», который подразумевал меньшую степень автономности при поиске и эксплуатации уязвимостей.
Основной риск связан с сочетанием навыков агентного программирования и доступа к реальным инструментам. В OpenAI подчеркивают, что модель не просто пишет код, а способна выстраивать последовательность действий для взлома. Сейчас работы замедлены, чтобы доработать систему защиты и провести дополнительные стресс-тесты. Сроки релиза модели остаются неопределенными, так как компания не раскрывает детали проведенных испытаний, а лишь подтверждает, что не может исключить опасные сценарии использования Astra в текущем состоянии.

Комментарии (0)
Пока нет комментариев. Будьте первым!