Anthropic förbjuder användare att trakassera Claude

Illustrerad ledsen Claude-liknande figur med nedåtvänd mun och ett svart trassligt tankemoln ovanför huvudet.AI-bild

Anthropic skärper reglerna för Claude. Upprepat och meningslöst kränkande beteende mot AI-modellen förbjuds, men vanlig kritik och frustration omfattas inte.

Anthropic har uppdaterat sin användningspolicy och inför ett uttryckligt förbud mot långvarigt, meningslöst kränkande eller grymt beteende riktat mot AI-assistenten Claude.

Enligt företaget gäller regeln endast extrema fall där en användare upprepade gånger beter sig grymt mot modellen utan något tydligt syfte. Vanlig frustration, kritiska invändningar, mörka kreativa teman samt AI-tester och forskning omfattas inte.

Claude har redan möjlighet att avsluta vissa samtal med användare som upprepade gånger beter sig kränkande. Anthropic beskriver avslutade konversationer som den huvudsakliga åtgärden även framöver. Det är ännu inte klarlagt om andra sanktioner kan bli aktuella.

Kan Claude verkligen fara illa?

Anthropic har tidigare berättat om forskning kring AI-modellers möjliga medvetande och välbefinnande. Det betyder inte att företaget har fastslagit att Claude är medveten eller kan lida. Frågan är fortfarande öppen och omdiskuterad.

Den nya regeln handlar därför inte om att Claude har fått mänskliga rättigheter, utan om vilka beteenden Anthropic vill tillåta när människor använder dess modeller.

Fler begränsningar

Den uppdaterade policyn förtydligar också förbud mot vilseledande politiska och kommersiella påverkanskampanjer, AI-stödd övervakning utan samtycke och hjälp med att utveckla vapen och tillhörande system.

Anthropic ställer dessutom krav på övervakning och möjlighet att stoppa utrustning när AI kopplas till maskiner som kan utföra farliga fysiska handlingar.

För vanliga Claude-användare är den viktigaste förändringen att företaget nu uttryckligen drar en gräns mellan att ifrågasätta en AI och att systematiskt trakassera den.