OpenAI приостановила Astra: ИИ достиг критических кибервозможностей
OpenAI 7 августа приостановила внутренние работы с моделью Astra, которая не соответствует новым требованиям безопасности. В результате внутренних оценок и экспертных заключений компания не может исключить, что Astra достигла порога "Critical" в области кибербезопасности, установленного её системой оценки угроз по нескольким категориям риска Preparedness Framework. Модель ещё не выпущена, и тестирование её защитных механизмов продолжается. Об этом пишет портал iXBT.com.
Решение связано с увеличением возможностей Astra в области агентного программирования и кибербезопасности. Порог "Critical" подразумевает, что модель может самостоятельно разрабатывать эксплойты для неизвестных уязвимостей в защищённых системах или проводить кибератаки, получив лишь высокоуровневую задачу. Ранее модели OpenAI, такие как GPT-5.6-Sol, оценивались на уровне "High".
Теперь OpenAI усиливает испытания защитных механизмов и повышает требования к безопасности для моделей с более высокими возможностями. Конкретные результаты тестов и новые защитные меры не раскрыты. Astra не связана с недавним взломом инфраструктуры Hugging Face. По данным Axios, работы над моделью замедлены до внедрения необходимых механизмов, а сроки её выпуска пока не определены.
Для агентных систем важно проверять не только способность модели писать код или объяснять уязвимости, но и её действия при наличии реальных инструментов. Риски возникают при сочетании поиска уязвимостей, написания эксплойтов и автономного выполнения действий. Новые требования OpenAI касаются не только модели, но и связанных с ней процессов разработки и использования.
Это решение демонстрирует, как оценка кибервозможностей влияет на разработку ещё не выпущенной модели. Однако недостаточно данных, чтобы установить, достигла ли Astra порога "Critical". OpenAI продолжает тестирование и должна определить дальнейшие условия разработки до возможного выпуска модели.


