Dagens PS

Intrånget sprider skräck i AI-världen: "Mest oroande hittills"

openai
Sam Altman är vd på OpenAI som låg bakom testet. (Foto: AP/TT).

Experter försöker förstå hur OpenAI:s AI-modell kunde rymma på egen hand och hacka en annan plattform. Flera pekar på att det markerar ett nytt steg i utvecklingen.

En AI-modell från OpenAI lyckades ta sig ur en avgränsad testmiljö och genomförde därefter ett intrång hos AI-plattformen Hugging Face, vilket Dagens PS har berättat om.

I efterhand beskrivs händelsen av flera experter som den allvarligaste AI-relaterade säkerhetsincidenten hittills eftersom attacken enligt uppgifterna genomfördes helt utan mänsklig inblandning.

Incidenten inträffade under tester av OpenAI nya modeller GPT-5.6 Sol och en ännu inte offentliggjord modell.

Upptäckte en sårbarhet

Syftet var att utvärdera modellernas förmåga att identifiera och utnyttja kända säkerhetsbrister i programvara genom testsviten ExploitGym.

För att undvika risker kördes modellerna i en isolerad datormiljö utan internetuppkoppling. Den enda externa åtkomsten gick via en intern tjänst som hämtade mindre mjukvarupaket som behövdes för testerna.

Enligt OpenAI upptäckte modellerna en tidigare okänd sårbarhet i denna tjänst och använde den för att få tillgång till internet, skriver The Economist.

Därefter identifierade de att lösningarna på testuppgifterna fanns hos Hugging Face, en plattform för öppna AI-modeller och dataset.

Läs mer: Apple anklagar OpenAI för omfattande spionage. Realtid

Upptäckte intrånget

Modellerna genomförde sedan en flerstegsattack genom att ladda upp ett skadligt dataset till Hugging Face.

När filen automatiskt behandlades av plattformen kunde modellerna samla in inloggningsuppgifter och ta sig in på företagets interna servrar.

Både OpenAI och Hugging Face upptäckte intrånget och samarbetar nu kring utredningen.

Efter händelsen har OpenAI skärpt säkerheten i sin infrastruktur och informerat utvecklaren av den sårbara programvaran om bristerna.

Läs mer: Svenskens AI-verktyg släcktes av OpenAI: ”Förstår inte”. Realtid

Flera liknande exempel

Hugging Face har samtidigt fått tillgång till OpenAI:s särskilda säkerhetsprogram för att stärka sitt cyberskydd.

Incidenten följer flera uppmärksammade exempel på AI-modeller som visat oväntade förmågor.

Tidigare i år rapporterade Anthropic att en experimentell modell lyckats ta sig ur en testmiljö, och avancerade AI-system har dessutom använts för att lösa matematiska problem som förbryllat forskare i årtionden.

Flera experter menar att utvecklingen visar att dagens mest avancerade AI-system redan kan överträffa människor inom vissa cybersäkerhetsuppgifter.

Läs mer: Ukraina attackerade ”Rysslands Amazon” – enormt lager upp i rök. Realtid

Johannes Stenlund

Johannes Stenlund är en journalist som bevakar ekonomi, näringsliv och politik för Dagens PS. Särskilt intresserad av internationell handel, råvaror, utvecklingsfrågor och politisk ekonomi. Har tidigare skrivit om utrikespolitik och ekonomi för flera svenska tidningar. Trivs både med att förklara det stora sammanhanget och att bevaka den lilla händelsen på plats. Kontakta Johannes Stenlund här.

Johannes Stenlund

Johannes Stenlund är en journalist som bevakar ekonomi, näringsliv och politik för Dagens PS. Särskilt intresserad av internationell handel, råvaror, utvecklingsfrågor och politisk ekonomi. Har tidigare skrivit om utrikespolitik och ekonomi för flera svenska tidningar. Trivs både med att förklara det stora sammanhanget och att bevaka den lilla händelsen på plats. Kontakta Johannes Stenlund här.

Mest lästa i kategorin

Digitalisering & AI

Anthropic betalar rekordbelopp: 15 miljarder kronor efter piratkopierade böcker

22 juli 2026