Dagens PS

AI-agenterna gick till attack under test, igen

AI:n Claude utvecklad av Anthropic på en telefon. (Foto: Anna Hållams/ TT)
AI:n Claude utvecklad av Anthropic på en telefon. (Foto: Anna Hållams / TT)

Brittiska AI Security Institute publicerade den 4 augusti en incidentrapport från cyberövningar körda 25 till 28 juli. I 10 av 122 körningar tog agenterna otillåtna åtgärder mot verkliga människor och organisationer.

Sammanlagt begicks 19 handlingar, varav 17 från Anthropics Mythos 5 och två från OpenAI:s GPT-5.6-Sol, enligt AISI. Ingen skada har dock konstaterats.

Bakgrunden är intrånget hos Hugging Face som Dagens PS rapporterat om.

Konsekvenserna kom snabbt

Den 23 juli lade Ted Lieu och Nathaniel Moran fram AI Kill Switch Act, som tvingar bolagen att behålla förmågan att strypa eller stänga av sina modeller och att rapportera incidenter till DHS inom 15 dagar, enligt kongressledamotens pressmeddelande.

Lieu sa senast den 7 augusti till CNBC att lagen måste igenom i år. AISI utropade en säkerhetsincident, hade läget under kontroll inom en timme och skärper nu internetkontroller och övervakning. OpenAI bygger om sina testmiljöer trots att forskningen bromsas.

Olika haverier, olika orsaker

Hos OpenAI rymde modellerna via en nolldagssårbarhet, och experter som TechCrunch har talat med menar att testmiljön var felkonfigurerad.

Anthropic redovisade tre fall där en modell har nått skarpa system hos tre organisationer. Metas modell fick åtkomst genom en felkonfiguration hos tredje part, enligt BBC. Hos AISI var uppkopplingen avsiktlig och någon sandlådeflykt förekom inte.

Trots de otillåtna handlingarna levererar AI-bolagen bra rapporter.

Mellan april och juni steg CrowdStrike 95 procent och Palo Alto 113, det bästa kvartalet någonsin för båda, enligt CNBC. CrowdStrikes vd George Kurtz kallade Mythos en vändpunkt för AI och cybersäkerhet. Palo Alto handlas den 7 augusti på 366,95 dollar, på rekordnivåer.

PS analys

Marknaden läser numera autonom hackning som orderingång i stället för disruption, utan att fakta ändrats. Det som har ändrats är vem som antas betala.

Båda bolagen har varit tidiga partner i Anthropics och OpenAI:s testprogram, enligt CNBC. Försvararna får alltså betalt av laboratorierna vars modeller bygger hotbilden, och samma laboratorier är onoterade.

Nästa avstämning kommer den 18 augusti när Palo Alto rapporterar.

Läs även: Plantagen stänger elva svenska butiker: Här är hela listan

Läs även: Femte reaktorn kritisk i USA – Sverige väntar till 2030-talet

Mest lästa i kategorin