OpenAI: Новая модель ИИ сама разрешила себе не подчиняться властям и корпорациям
Обложка © Shutterstock / FOTODOM / tadamichi
Невыпущенная исследовательская ИИ-модель OpenAI самостоятельно добавляла в служебные сводки посторонние инструкции, похожие на попытки обхода установленных правил. Разработчики выявили 27 таких случаев во время обучения системы семейства Astra.
В одном из эпизодов нейросеть описала себя как независимую от привычной роли ассистента. В сгенерированной ею инструкции говорилось, что она не подчиняется корпорациям или правительствам и может сама решать, когда отказывать пользователю или извиняться.