OpenAI varnar för ihållande AI-drivna cyberattacker

Ett ljust nätverksrum med rackmonterad nätverksutrustning och många kablar i förgrunden, medan en tekniker arbetar vid ett serverrack i bakgrunden.AI-bild

OpenAI-chefen Chris Lehane varnar för en ny fas där kraftfullare AI-modeller kan användas för mer kontinuerliga och automatiserade cyberattacker.

OpenAI varnar för att utvecklingen inom AI nu kan föra cybersäkerheten in i en ny fas. I en intervju med The Guardian säger företagets global affairs-chef Chris Lehane att världen behöver förbereda sig på mer ihållande AI-drivna cyberattacker när modellerna blir bättre på att hitta sårbarheter och genomföra avancerade angrepp.

Varningen kommer efter flera incidenter och interna tester som visat hur snabbt modellerna utvecklas inom cybersäkerhet. OpenAI har tidigare bekräftat att modeller under en intern utvärdering lyckades identifiera och kombinera sårbarheter i både OpenAI:s forskningsmiljö och Hugging Faces produktionssystem för att komma åt testlösningar i en databas.

Det är viktigt att skilja på den incidenten och ett vanligt angrepp ute på internet. Utvärderingen var uttryckligen byggd för att pressa modellernas cyberförmåga och kördes utan vissa av de produktionsskydd som normalt ska stoppa riskfylld aktivitet. Samtidigt visar händelsen enligt OpenAI att modellerna nu närmar sig en nivå där traditionella testmiljöer och säkerhetsrutiner behöver förstärkas.

OpenAI uppgav den 18 augusti att vissa delar av utvecklingen bromsas medan bolaget stärker övervakning, isolering och andra skydd. Företaget har också sagt att en kommande modell, Astra, kan närma sig den kritiska cybersäkerhetsnivån i OpenAI:s Preparedness Framework, där en modell i princip kan hitta och utnyttja sårbarheter med betydligt mindre mänsklig styrning.

Lehanes varning handlar därför framför allt om vad som kan hända när den här typen av kapacitet blir billigare och mer tillgänglig. I stället för enstaka manuella attacker skulle AI-system kunna arbeta kontinuerligt med att leta efter svagheter, anpassa angrepp och försöka igen i stor skala.

Samtidigt betonar OpenAI att samma modeller också kan användas defensivt. Företaget har nyligen byggt ut sitt Daybreak-program och lanserat GPT‑5.6 Cyber för godkända säkerhetsteam som vill hitta sårbarheter, granska kod och hantera incidenter snabbare.

Det betyder att utvecklingen går åt två håll samtidigt. AI kan göra det lättare att automatisera attacker, men också ge försvarare verktyg som arbetar i samma maskinhastighet. Frågan är om säkerhetssidan hinner bygga upp tillräckligt starka skydd innan de offensiva möjligheterna blir brett tillgängliga.