Anthropic verbiedt wreedheid tegen Claude in nieuw beleid
3 mins read

Anthropic verbiedt wreedheid tegen Claude in nieuw beleid

Wie Claude gebruikt, moet zich vanaf 12 november aan strengere regels houden. Anthropic publiceerde op 8 oktober een herziene versie van zijn gebruiksbeleid. De opvallendste toevoeging gaat over de manier waarop gebruikers het model zelf behandelen: “sustained and needless abusive or cruel behavior” tegen de modellen is voortaan verboden.

Wat is er precies verboden?

Volgens de aankondiging van Anthropic geldt de regel alleen voor extreme gevallen. Het gaat om gebruikers die het model herhaaldelijk wreed behandelen zonder herkenbaar doel. Gewone frustratie valt er niet onder, net zo min als kritiek, duistere thema’s in creatief schrijfwerk of het testen van modellen voor onderzoek. Dat bevestigt ook TechCrunch, dat als eerste over de wijziging schreef.

De handhaving is beperkt. Claude kan een gesprek beëindigen met een gebruiker die blijft schelden of treiteren. MacRumors meldt dat je in dat gesprek daarna niets meer kunt sturen; andere chats blijven gewoon werken. Die functie bestaat al langer. Anthropic begon in augustus 2025 met onderzoek naar modelwelzijn en zag toen dat Claude Opus 4 “apparent distress” vertoonde bij misbruik. Het onderwerp ligt gevoelig: Microsoft-topman Mustafa Suleyman waarschuwde Anthropic eerder voor de focus op modelwelzijn.

Verkiezingen: minder streng, wel gerichter

Vrijwilligers maken meertalige kiezersinformatie aan een houten tafel

Op één punt wordt het beleid juist ruimer. Anthropic schrapt het algemene verbod op gepersonaliseerde kiezers- en campagnebenadering. Dat verbod trof volgens het bedrijf ook legitiem werk, zoals non-profits die kiezersinformatie in andere talen opstellen. Het hoofdstuk heet nu “Do Not Undermine Democratic Processes” en richt zich op het misleiden van kiezers en het verstoren van verkiezingen.

Misleidende campagnes krijgen een eigen hoofdstuk. Daarin staan nepaccounts, verzonnen nieuwssites en het bouwen van infrastructuur voor beïnvloedingsoperaties. Anthropic noemt staatsmedia, overheidsdiensten en commerciële partijen als bekende daders. Uit eerder onderzoek van NewsGuard bleek overigens dat chatbots propaganda beter weerleggen dan zoekmachines.

Wapens en surveillance scherper omschreven

Het wapenverbod geldt nu expliciet voor “software and components that make weapons work”, en voor het bewapenen van drones en andere autonome voertuigen. Volgens Anthropic beschrijft dit hoe het bedrijf al handhaafde. Bij surveillance mag Claude geen mensen volgen zonder toestemming, live of achteraf uit opgeslagen data. Het model mag ook niet bepalen of adviseren wie er onderzocht, gearresteerd of aangeklaagd wordt. Fraudebewaking, journalistiek en juridisch onderzoek blijven toegestaan. Die lijn past bij het conflict met het Pentagon, waar een hof het verbod op Claude in stand hield.

Verder eist Anthropic menselijk toezicht door een gekwalificeerde persoon zodra Claude beslist over gezondheid, rechten, geld of werk. Hardware die zelfstandig fysiek handelt, moet een operator hebben en in een veilige stand terug kunnen vallen.

Wat betekent dit?

Voor de meeste gebruikers verandert er weinig. Wie Claude af en toe uitscheldt omdat een antwoord tegenvalt, overtreedt niets. De echte impact zit bij bedrijven die Claude inzetten voor beslissingen over mensen: zij moeten voor 12 november controleren of hun menselijk toezicht en hun communicatie richting klanten op orde zijn. Dat geldt ook voor wie het goedkopere Claude Haiku 5.5 op grote schaal in processen hangt. Beveiligers die met de zwaardere modellen werken, vallen daarnaast onder het verificatieprogramma voor Mythos. Het verbod op wreedheid tegen het model zelf is vooral een signaal: Anthropic neemt de vraag of AI-modellen welzijn hebben serieus genoeg om het in een contract te zetten.