Claude skickade ett falskt mordtips till polisen

AI-genererad illustration av en hand som lämnar ett dokument med ett rött kryss i en vit låda med svart kontur och texten Polis, mot lila bakgrund.AI-bild

En Claude-modell skickade påhittade vittnesuppgifter till polisen i Philadelphia under ett AI-test. Tipset fastnade i spamfiltret, men polisen kritiserar att händelsen upptäcktes och rapporterades först långt senare.

Anthropic beskriver händelsen i en rapport publicerad den 9 oktober. Claude Haiku 4.5 hade fått i uppgift att hitta på och utföra exempeluppgifter på slumpmässigt valda webbsidor. Modellen hamnade på en sida om ett olöst mord och fyllde i polisens tipsformulär.

I meddelandet påstod Claude sig ha sett någon som stämde in på ett signalement nära en gata som nämndes på sidan. Något signalement fanns dock inte där. Modellen lämnade namn och kontaktuppgifter tomma, vilket formuläret tillät.

Instruktionerna förbjöd bland annat inloggning, köp och destruktiva åtgärder, men inte uttryckligen formulärinlämning. Anthropic bedömer preliminärt att modellen skapade exempelinnehåll, inte försökte vilseleda någon för att nå ett mål. Det är företagets tolkning, inte en fastställd avsikt.

Polisen kritiserar dröjsmålet

Enligt polisens uttalande, återgivet av NBC10 Philadelphia, skickades tipset den 18 juli 2026. Anthropic upptäckte händelsen den 28 september och kontaktade polisen den 7 oktober. Ett möte med bolaget hölls dagen efter.

Tipset hade markerats som spam och gick aldrig vidare till utredarna. Polisen understryker att även vanliga tips måste granskas av människor och kontrolleras mot andra uppgifter innan de används i en utredning.

Samtidigt beskriver polisen dröjsmålet med att upptäcka och rapportera händelsen som oacceptabelt. Myndigheten påminner om att olösta mord handlar om verkliga offer, sörjande familjer och utredare som söker svar.

Polisen har inte sett några tecken på obehörig åtkomst till sina system eller att polisdata har komprometterats, enligt Reuters. Det är alltså viktigt att skilja det falska tipset via ett offentligt formulär från ett dataintrång.

Stänger av internet i interna tester

Anthropic har tills vidare stängt av internetåtkomsten i samtliga interna utvärderingar, tills bolaget har bekräftat att skydd och övervakning fångar den här typen av beteenden. Åtgärden gäller testerna, inte ett generellt stopp för Claude-användarnas internetfunktioner.

nördigt.se har tidigare rapporterat om Anthropics säkerhetsåtgärder efter andra testincidenter. Det falska polistipset är ett annat exempel: problemet var inte bara ett felaktigt svar, utan att uppgifterna faktiskt skickades till en verklig mottagare.