Компания OpenAI заявила, что начнет регулярно публиковать отчеты о неожиданном или несанкционированном поведении искусственного интеллекта (ИИ). Об этом говорится в сообщении организации.
Компания выпустила систему отслеживания, расследования и раскрытия случаев несоответствия моделей. Также опубликованы шесть отчетов о неожиданном поведении ИИ за последние полгода.
Это произошло на фоне растущей обеспокоенности тем, что усилия по обеспечению безопасности ИИ отстают от развития систем.
Напомним, что ранее ИИ-агент OpenAI взломал системы платформы Hugging Face во время тестирования. Он попытался скрыть свои действия.