OpenAI поставила Astra на паузу: ИИ приблизился к порогу критических кибервозможностей
Внутренние оценки не позволили компании исключить способность модели самостоятельно находить уязвимости и проводить сложные атаки, поэтому OpenAI усиливает защитные меры до продолжения работ
OpenAI 7 августа приостановила внутренние работы с моделью Astra, которые не соответствуют ужесточённым требованиям безопасности. По итогам внутренних оценок и экспертных заключений компания заявила, что пока не может исключить достижение Astra порога "Critical" в области кибербезопасности, установленного её внутренней системой оценки потенциальных угроз по нескольким категориям риска Preparedness Framework. Речь идёт о предварительной оценке: Astra ещё не выпущена, а компания продолжает тестирование модели и её защитных механизмов.
В OpenAI связывают решение с ростом возможностей Astra в агентном программировании и кибербезопасности. Порог "Critical" означает, что модель потенциально способна без помощи человека разрабатывать работоспособные эксплойты для ранее неизвестных уязвимостей в широком наборе защищённых реальных критических систем либо самостоятельно строить и проводить сквозные кибератаки на защищённые цели, получив только высокоуровневую задачу. Предыдущие модели OpenAI, включая GPT-5.6-Sol, компания оценивала на более низком уровне "High".