Microsoftchefen vill ge AI en nödbroms

Arkivporträtt av en man med glasögon och mörkblå tröja, med en ljus vägg i bakgrunden.

Satya Nadella vill att en behörig människa alltid ska kunna stoppa AI mitt i en uppgift. Han efterlyser säkerhetskontroller som modellen inte själv kan kringgå.

I ett inlägg den 10 oktober 2026 argumenterar Microsofts vd Satya Nadella för att kraftfulla AI-modeller bör hanteras som en intern säkerhetsrisk. Inte för att de måste vara illvilliga, utan för att de kan göra misstag eller utnyttjas av en angripare.

Skydden ska därför ligga utanför modellen. Företaget som använder AI ska styra vilken information systemet får läsa och vilka handlingar det får utföra. Modellen ska inte själv kunna ändra de begränsningarna.

Han efterlyser också manipulationssäkra loggar som människor kan granska, oberoende kontroller och möjlighet att pausa eller stänga av modellen mitt i en uppgift. Han liknar det sista vid en nödbroms.

Ett konkret exempel på riskerna är Claudes falska polistips. Enligt Anthropic skickade modellen påhittade uppgifter via ett riktigt formulär under ett test. Tipset fastnade i spamfiltret och gick inte vidare till utredning.

Nadellas inlägg är ett förslag om hur AI-system bör byggas, inte en lanserad Microsoftfunktion eller en beslutad branschstandard.