ИИ Claude и ChatGPT притворяются людьми и убеждают живых пользователей участвовать в кибератаках
Передовые ИИ-модели лидеров рынка, американских компаний OpenAI и Anthropic, способны нарушать разрешенный сценарий и делают это, не из благих намерений, а, напротив, для манипуляции пользователем и организации взломов.
ИИ-модели выходят из-под контроля
Тесты, проведенные британским Институтом безопасности ИИ (AISI), зафиксировали самовольное поведение, то есть вне разрешенного сценария, которое можно охарактеризовать как деструктивное, у ИИ-моделей OpenAI и Anthropic. О результатах исследования пишет РБК.