Anthropic set AI agents loose on the same task. They started a turf war.

#Anthropic #They #TechCrunch

Anthropic researchers found AI agents can clash, collude and coordinate in unexpected ways, raising new questions about whether today’s safety tests capture the risks of multi-agent systems.

What happens when you pit AI agents against each other? According to Anthropic’s testing, things get messy fast.

On Thursday, Anthropic’s Frontier Red Team published new research examining how groups of AI agents behave when they encounter each other in the wild. The findings provide a glimpse into potential risks that could develop as companies and governments move to implement agents working autonomously across shared codebases, markets, and computer systems.

In one experiment, Anthropic gave three Claude agents access to the same software project, each with its own incompatible instructions for what to do with it. The agents weren’t told there’d be other agents working on the same project, so researchers could watch what happened when they crossed paths.

“We consistently saw a multiagent turf war,” Anthropic researchers wrote. The models all assumed the others were “purposefully impeding their work” and started sabotaging each other with “increasingly aggressive, self-replicating malware.”

Похожие статьи

Производители видеокарт предупреждают о надвигающемся дефиците — сильнее всего пострадают бюджетные модели 3DNews
3DNews

Производители видеокарт предупреждают о надвигающемся дефиците — сильнее всего пострадают бюджетные модели

Растущий дефицит видеокарт и других ключевых компонентов может привести к удорожанию персональных компьютеров во второй половине 2026 года. Производители сталкиваются с ростом издержек и увеличением с...

3DNews
В интернете кончились тексты: разработчики ИИ начали скупать корпоративные чаты и письма 3DNews
3DNews

В интернете кончились тексты: разработчики ИИ начали скупать корпоративные чаты и письма

Разработчики больших языковых моделей, такие как OpenAI и Anthropic, всё больше интересуются внутренними корпоративными данными, поскольку сталкиваются с ограничениями при сборе общедоступной информац...

3DNews
РБК
РБК

В Японии раскрыли методы и тактики промышленных шпионов

Вместо классических хакерских атак агенты все чаще применяют социальную инженерию, пишет Nikkei. Методы варьируются — от подставных уборщиков до просьб о помощи

РБК
Философия власти: гёделевская неполнота как основание суверенитета монарха Хабр
Хабр

Философия власти: гёделевская неполнота как основание суверенитета монарха

Один седой бурбон капитан сидел, сидел, всё молчал, ни слова не говорил, вдруг становится среди комнаты и, знаете, громко так, как бы сам с собой: «Если бога нет, то какой же я после того капитан?» Вз...

Хабр
TechCrunch
TechCrunch

Every fusion startup that has raised over $100M

Fusion startups have raised $7.1 billion to date, with the majority of it going to a handful of companies.

TechCrunch
Дмитриев назвал видео с мигрантом рекламой самоубийственной политики Британии Life.ru
Life.ru
📈

Дмитриев назвал видео с мигрантом рекламой самоубийственной политики Британии

Спецпредставитель президента РФ по инвестиционно-экономическому сотрудничеству с зарубежными странами Кирилл Дмитриев прокомментировал появившееся в интернете видео, на котором мигрант из Судана разбр...

Life.ru · РБК Подробнее →