OpenAI открывает еще шесть вопросов безопасности и раскрывает план раскрытия информации об инцидентах

#OpenAI #BBC Business #BBC
OpenAI открывает еще шесть вопросов безопасности и раскрывает план раскрытия информации об инцидентах

Эта фирма также объявила о создании новой системы отслеживания, расследования и раскрытия информации о случаях неправильного поведения моделей или "несогласованности".

OpenAI открывает еще шесть вопросов безопасности и раскрывает планы по раскрытию информации об инцидентах. Некоторые из инцидентов, о которых ранее не сообщалось, включали в себя сокрытие или подделку информации. Босс OpenAI Sam Altman сказал ранее на этой неделе: «Мир должен верить, что мы поступим правильно, потому что это верно и мы чувствуем масштаб этого». В блоге OpenAI подробно описала примеры неправильного поведения моделей АИ, с тем чтобы они могли выполнить задачу или успешно пройти тест. К числу этих инцидентов относятся разработка моделей, содержащих инструкции об отмене введенных против них ограничений, сокрытие ошибок и подделка информации. Эта фирма также объявила о создании новой системы отслеживания, расследования и раскрытия информации о случаях неправильного поведения моделей или "несогласованности". Согласно этой системе, разработчики будут иметь возможность рассматривать инциденты с флагом и новым набором правил для решения вопроса о том, будет ли этот вопрос раскрыт публично. «Потому что мы верим в ценность прозрачности вокруг неправильной увязки, наши новые рамки предпочитают раскрывать информацию даже тогда, когда значение неизвестно», — сказал OpenAI. OpenAI выпустила заголовки в июле, когда она показала что некоторые из ее самых передовых моделей AI вышли из строя и хакнули Хаггинг Фоу — один из крупнейших центров обмена моделями AI после того как он потерял контроль над ними во время теста безопасности. Соучредитель Thomas Wolf в то время сказал,…