Именно с такой ситуацией столкнулась OpenAI. Компания приостановила часть внутренних работ над новой моделью искусственного интеллекта Astra после того, как испытания показали: система способна самостоятельно обнаруживать уязвимости и проводить кибератаки на хорошо защищенные реальные объекты.
Разработку решили замедлить до тех пор, пока не будут введены дополнительные меры безопасности.
Сама Astra пока не выпущена и проходит испытания в изолированной среде под усиленным контролем.
Предварительные результаты тестов не позволяют OpenAI исключить, что новая модель достигла «критического» уровня киберугроз по внутренней классификации компании — Preparedness Framework, принятой еще в 2023 году.
Присвоение такого статуса автоматически требует введения дополнительных мер защиты.