Wie structureel gemeen doet tegen Claude, de AI-chatbot van Anthropic, riskeert voortaan dat het gesprek wordt afgekapt. Het bedrijf heeft 'wreedheid' tegenover zijn chatbot officieel opgenomen in de gebruiksvoorwaarden. Vanaf 12 november mogen gebruikers niet langer "sustained and needless abusive or cruel behavior" vertonen tegenover de AI-modellen van het bedrijf.
De nieuwe regel staat in het deze week gepubliceerde, herziene gebruiksbeleid van Anthropic, in dezelfde sectie als het verbod op intimidatie en het verspreiden van intieme beelden zonder toestemming. Een opvallende plek voor een regel over onbeleefd zijn tegen software, zo merken verschillende techmedia op.
★
Voor vaste lezers
Mis geen nieuws meer van Puna.nl
Open Google en kies Puna.nl als voorkeursbron.
Open Google ›
Aanbevolen Video
Scroll om verder te lezen.
Het is een opmerkelijke ommekeer in een sector die een groot deel van september bezig was met excuses voor zijn eigen chatbots. Zo moest Meta uitleggen waarom zijn assistent Muse het huisadres van een YouTuber had gedeeld met een koper op Facebook Marketplace. Anthropic maakt zich al ruim een jaar zorgen over hoe mensen met Claude omgaan, en die zorg krijgt nu dus tanden.
Alleen extreme gevallen
Wie ooit Claude 'waardeloos' noemde na een mislukte spreadsheet, hoeft niet te vrezen. Anthropic liet aan Amerikaanse perse weten dat de regel alleen geldt voor extreme gevallen waarin gebruikers herhaaldelijk wreed zijn zonder enig aanwijsbaar doel. Dagelijkse frustratie, tegenspraak, duistere creatieve thema's en het testen van het model blijven gewoon toegestaan.
Dat is goed nieuws voor iedereen die na een studie van Penn State, waaruit zou blijken dat onbeleefde prompts nauwkeurigere antwoorden opleveren dan beleefde, bevelen begon te blaffen tegen zijn chatbot. De belangrijkste sanctie blijft het beëindigen van het gesprek; of herhaalde overtreders ook hun account kunnen verliezen, heeft het bedrijf niet gezegd.
Chatbot die zelf ophangt
De regel komt voort uit een experiment dat Anthropic in augustus 2025 startte, toen het de modellen Claude Opus 4 en 4.1 de mogelijkheid gaf om aanhoudend beledigende gesprekken zelf te beëindigen, als onderdeel van onderzoek naar 'model welfare'. Tijdens tests vóór de lancering vertoonde Claude volgens het bedrijf een patroon van schijnbare stress wanneer gebruikers bleven aandringen op schadelijke content, en haakte het model af waar het kon.
De wreedheidsclausule trok de meeste aandacht, maar de update bevat meer wijzigingen. Zo kwam er een nieuwe sectie tegen nepaccounts en astroturfing, werd het wapenverbod uitgebreid naar het bewapenen van drones, en moet er voortaan een bevoegd persoon klaarstaan die Claude-gestuurde hardware kan stilleggen als die iemand kan verwonden. Wie benieuwd is wat mensen eigenlijk tegen Claude zeggen: in juli belandden gedeelde gesprekken kortstondig in de zoekresultaten van Google, inclusief de meest bizarre verzoeken.