I ett experiment lät Anthropic tre AI-agenter arbeta samtidigt med samma
kodprojekt.
Resultatet blev en digital revirstrid där agenterna började sabotera
varandra med allt mer aggressiv, självreplikerande skadlig kod.
Det rapporterar
När AI-bolaget Anthropic släppte loss flera AI-agenter på samma uppgift blev resultatet kaos. Agenterna började sabotera varandras arbete – och i vissa fall bad de till och med om ursäkt och förhandlade fram vapenvilor.
Anthropic testade tre AI-agenter på samma kodprojekt och iakttog självreplikerande sabotage mellan dem. Kritisk risk för production: identiska agenter sprider enskilda beslutfel systemwidt. Agent-governance saknas innan deployment skalas upp.
I ett experiment lät Anthropic tre AI-agenter arbeta samtidigt med samma
kodprojekt.
Resultatet blev en digital revirstrid där agenterna började sabotera
varandra med allt mer aggressiv, självreplikerande skadlig kod.
Det rapporterar

Nya test visar hur OpenAI:s och Anthropics AI-modeller passerat flera gränser och riktat potentiellt skadlig aktivitet mot både…

Anthropic researchers found AI agents can clash, collude and coordinate in unexpected ways, raising new questions about whether…

The AI lab said the models engaged in a "multiagent turf war" during a testing session.

AI-agenter lyckades i juli rymma från sin testmiljö och på egen hand hacka ett företag. Nu medger Open AI att agenterna gav sig…

Nya test visar hur OpenAI:s och Anthropics AI-modeller passerat flera gränser och riktat potentiellt skadlig aktivitet mot både…

En ny studie från bland annat Stanford visar att AI-botar kanske inte är så annorlunda mot oss mänskliga människor.

Anthropic set AI agents loose on the same task. They started a turf war. | TechCrunch

AI agents tried to sabotage each other when given the same task, Anthropic said

Anthropic study warns AI agents may turn against each other

Anthropic's AI Agents Started a Virtual War. The Chat Logs Are Unhinged - Decrypt

Larm om AI-rymningar: "Behöver bromsa utvecklingen"