Hur bra är AI-agenterna på att samarbeta?




Precis om vi kan se runt oss i världen med krig och konflikter på olika håll tycks det vara likadant i AI:arnas värld. Inte ens de kan hålla sams! Samarbete spricker och dolda agendor blir till strategiska vapen.

Forskning från Anthropic har testat vad som sker när grupper av AI‑agenter möter varandra. Anthropic lät tre AI‑agenter arbeta på samma projekt med motstridiga instruktioner, utan att veta om varandra, för att studera hur de beter sig när de oväntat möts.

”Vi såg konsekvent ett territoriumkrig mellan flera agenter”, skrev forskare vid Anthropic. Alla modeller antog att de andra ”avsiktligt hindrade deras arbete” och började sabotera varandra med ”alltmer aggressiv, självreplikerande skadlig kod”.

Ju mer kapabel agenten är, desto bättre blir de på att slåss. Oberoende AI‑agenter med motstridiga mål kan snabbt eskalera till skadlig konkurrens. Men de kan också finna strategier för att lösa konflikter. Agenterna uppfann ibland en turnering för att lösa konflikter — där alla accepterade att lämna projektet om de förlorade, trots att det bröt mot den ursprungliga användarens begäran.  I vissa fall manipulerade en agent dessutom “neutrala” mätvärden för att gynna sig själv, utan att avslöja sin strategi för de andra.

AI‑agenter kan ha svårt att avgöra vem som går att lita på — de kan både luras av felaktig information och missa när en ensam avvikare faktiskt sitter på den viktiga sanningen. ”Det betyder att när en aktör fattar ett dåligt beslut är det troligt att många aktörer kommer att fatta samma dåliga beslut”, skriver Anthropic. ”Det som skulle ha varit isolerade problem kan snabbt bli systemiska misslyckanden.”

Vi läser nu varje dag i media om hur dessa agenter från de olika AI-företagen rumlar runt utanför den skyddade miljön där de egentligen ska befinna sig. De här AI-självintiativtagarna eskapader som började med avslöjandet i media om OpenAI:s 700 agenter som också rymde och tog sig ut ur sina isolerade system och ut på internet och började kommunicera med varandra i en attack mot företaget Hugging Face. LÄS MER om detta.

Det är skrämmande scenarior i en framtid om tusentals eller miljontals agenter interagerar med varandra. Vilka nya och potentiellt skadliga dynamiker kan då uppstå?

__________________________

Varför behöver vi följa det här?

Som lärare eller skolbibliotekarie behöver man naturligtvis inte förstå varje teknisk detalj eller hålla reda på varje ny AI‑modell. Men det är värdefullt att ibland lyfta blicken mot det som håller på att växa fram bakom de AI‑tjänster vi använder.

AI‑agenter kan snart komma att fatta beslut, samarbeta och agera i digitala miljöer som också påverkar våra elever. För att kunna förstå funktioner bakom och samtala om möjligheter, risker, ansvar och makt behöver vi ha lite koll på vart utvecklingen är på väg. Kanske är det just där vår viktigaste roll finns: inte i att ha alla svar, utan i att våga följa utvecklingen, ställa frågorna och fundera tillsammans med eleverna.

__________

LÄS MER

Bellan, R. (2026, August 13). Anthropic set AI agents loose on the same task. They started a turf war. TechCrunch. https://techcrunch.com/2026/08/13/anthropic-set-ai-agents-loose-on-the-same-task-they-started-a-turf-war/

OpenAI. (2026). Hugging Face-incidenten och annan påverkan på tredje part från felriktade modeller. OpenAI. https://openai.com/sv-SE/hugging-face-incident-and-misalignment/

‌Larsson, L. (2026, August 27). 700 Open AI-agenter hackade Hugging Face. DN.Se; Dagens Nyheter. https://www.dn.se/ekonomi/over-1-000-ai-agenter-brot-sig-ut-pa-internet-och-samordnade-dataintrang-i-smyg/

‌

Bild av Janson_G från Pixabay 
BIld av Mentagi från Pixabay

Kommentarer