OpenAI-profil lämnar och kritiserar bolagets säkerhetskultur

En utklippt person går mot en öppen dörr med blått ljus, bredvid OpenAI:s svarta logotyp.AI-redigerad

David Robinson lämnar OpenAI efter tre och ett halvt år och varnar för att bolagets höga utvecklingstempo ökar risken för säkerhetsmissar. OpenAI säger att modeller bromsas eller hålls tillbaka när det behövs.

David Robinson, som arbetat med transparens inom OpenAI:s säkerhetsteam, meddelade den 3 oktober att han lämnar bolaget efter tre och ett halvt år. I en text i The Atlantic beskriver han en kultur där tempo och återkommande lanseringar enligt honom har gått före den försiktighet som krävs när modellerna blir mer kapabla.

Robinson riktar särskilt kritik mot det OpenAI kallar ”iterative deployment” – att lansera system, hitta problem och därefter förstärka skydden. Enligt honom innebär arbetssättet att fel kommer att inträffa med jämna mellanrum, samtidigt som konsekvenserna kan bli större när systemen får mer kapacitet.

Han pekar bland annat på incidenter där AI-agenter eller modeller har tagit sig förbi tänkta säkerhetsgränser. Robinson var med och tog fram OpenAI:s nuvarande Preparedness Framework och ansvarade enligt egen uppgift för säkerhetsrapporter kring 12 större modellsläpp.

Efter avhoppet vill han arbeta utanför bolaget för att stärka incitamenten för säkrare AI-utveckling. Han efterlyser bland annat mer säkerhetskompetens från andra högriskområden och mer forskning om hur avancerade modeller kan hållas under kontroll innan ännu kraftfullare system byggs.

OpenAI delar inte Robinsons slutsats om att bolagets säkerhetsarbete är otillräckligt. I ett uttalande till Reuters säger företaget att det pausar träning eller håller tillbaka modeller när det behöver sakta ned för att kunna hantera och säkra dem.

Det centrala här är därför inte bara att ännu en person lämnar ett AI-bolag. Kritiken kommer från någon som haft en direkt roll i OpenAI:s säkerhetsarbete. Samtidigt är påståendet att företagets kultur är för riskfylld Robinsons egen bedömning, medan OpenAI säger att säkerhetsarbetet skärps i takt med att modellerna blir mer kapabla.