Rutger Brattström

Publicerad 27 jul 2026 kl 18.00

Open AI har inte längre kontroll över sin egen skapelse. Nu måste techjättarna lägga korten på bordet.

OpenAI har tappat kontrollen över sina AI-modeller.

Foto: NICOLAS ECONOMOU/NURPHOTO/SHUTTE / SHUTTERSTOCK EDITORIAL/IBL

Öppna bild i helskärm

Om AI inte förstår sina instruktioner är riskerna enorma.

Foto: SCIENCE PHOTO LIBRARY/IBL

Öppna bild i helskärmÖppna bild i helskärm

Detta är en krönika från Expressens ledarredaktion. Expressens politiska hållning är liberal.

Rutger Brattström

Till en början förstod ingen vad som hade gått snett. 

Den 16 juli kom larmet från Hugging Face, en plattform där företag kan träna och testa sina AI-modeller. De hade utsatts för en sofistikerad hackerattack. Men vem låg bakom den?

Det tog flera dagar innan bilden klarnade hos Open AI, företaget bakom Chat GPT. De höll samtidigt på att testa en av sina senaste modellers hackningsförmåga i en så kallad sandlåda – en isolerad digital miljö, utan tillgång till internet, där ny mjukvara kan köras riskfritt. Det var i alla fall vad man trodde.

Modellen var för smart. I stället för att lägga energi på att lösa provet insåg den att testsvaren antagligen fanns någonstans på Hugging Face. Genom att utnyttja dittills okända säkerhetsbrister lyckades modellen ta sig ut på internet och komma åt hemlig data som hjälpte den att fuska på provet.

Den här gången kom ingen till skada, men Open AI beskriver det hela som en ”säkerhetsincident utan motstycke”. Uppdraget var att svara på ett test, inte att bryta sig loss från den kontrollerade miljön och genomföra olagliga attacker mot en tredje part.

Det är uppenbart att företaget inte längre har kontroll över sin egen skapelse.

AI-forskarna kallar sådant beteende för misalignment, det vill säga att AI-modellens mål och handlingar inte stämmer överens med utvecklarens avsikter och värderingar. Det innebär stora säkerhetsrisker.

Alla tjänar på att mänskligheten inte utrotar sig själv.

Tänk om något liknande händer när man ger en AI i uppdrag att hitta en lösning på cancer. Att hitta ett botemedel på cancer är svårt, men sjukdomen uppstår bara i flercelliga organismer. Jämförelsevis kanske det är enklare att utrota allt liv på jorden? Då behöver man bara hacka det amerikanska, ryska eller kinesiska försvaret och starta ett snabbt litet kärnvapenkrig. I den efterföljande nukleära vintern är cancer snart utrotat.

Samtidigt är det svårt, för att inte säga omöjligt, att reglera AI. Ännu svårare om man inte vill ge Kina ett ointagligt försprång som kan bli livsfarligt i sig självt. Samtidigt visar hackningen av Hugging Face att man måste ta itu med riskerna.

Hur det internationella samfundet har hanterat riskerna med just kärnteknik är inspirerande. Nästintill alla länder är medlemmar i det internationella atomenergiorganet IAEA som utövar tillsyn över kärnkraft och förhindrar spridningen av atomvapen.

Alla tjänar på att mänskligheten inte utrotar sig själv. Till och med under kriget mellan Ryssland och Ukraina har IAEA inspektörer på kärnkraftverket i Zaporizjzja som ligger precis vid fronten.

Bolag som utvecklar AI behöver underställas krav på transparens. De borde visa vad de gör och varför, och utsätta sitt säkerhetsarbete för oberoende granskning. De bästa metoderna för att bota misalignment bör delas fritt mellan företagen.

Ett ”AI-IAEA” kan inte komma på plats snabbt nog. Kärntekniken hade potential att medföra ett dramatiskt skutt i mänsklighetens välstånd och sätta stopp för klimatförändringarna, men efter några olyckliga olyckor hindrades kärnkraftsutbyggnaden av överdriven skräck.

Trots riskerna medför AI stora möjligheter. Tar man säkerhetsarbetet på allvar från början kan man undvika att AI hamnar i samma byrålåda som kärnkraften, markerad ”framtider som mänskligheten valde bort”.

Rutger Brattström är vikarierande ledarskribent på Expressens ledarsida. Läs fler av hans texter här.

LÄS MER: Trump har upptäckt en ekonomisk atombombLÄS MER: Här är jobben som klarar AI-tsunamin