Key takeaways
- Anthropic verbiedt gebruikers om Claude herhaaldelijk en zonder duidelijke reden wreed te behandelen.
- Claude kan gesprekken beëindigen met gebruikers die zich herhaaldelijk beledigend gedragen.
- De nieuwe richtlijnen houden rekening met de mogelijkheid dat AI-systemen bewustzijn kunnen ontwikkelen.
Anthropic heeft nieuwe richtlijnen opgesteld die het voortdurend en nodeloos mishandelen van zijn Claude-AI-systemen verbieden. Deze regels, die op 12 november van kracht worden, zijn uitsluitend gericht op ernstige gevallen waarin gebruikers herhaaldelijk wreed zijn tegen de AI zonder duidelijk doel.
Het bedrijf heeft verduidelijkt dat standaardklachten, kritische feedback, het verkennen van grimmige verhaallijnen in verhalen, of professioneel onderzoek en testen niet zullen worden bestraft.
Handhaving van de nieuwe regels
Om deze regels te handhaven, blijft Anthropic vertrouwen op het vermogen van Claude om interacties met meedogenloos beledigende personen te beëindigen.
Die functionaliteit werd in augustus 2025 voor het eerst geïntegreerd in de modellen Opus 4 en Opus 4.1. Claude mag het gesprek pas beëindigen als laatste redmiddel, nadat pogingen om de interactie bij te sturen zijn mislukt.
Debat over het welzijn van AI
Deze aanpassingen maken deel uit van een breder onderzoek naar het welzijn van AI. Hoewel Anthropic toegeeft dat het onduidelijk is of grote taalmodellen morele status bezitten, is het bedrijf van mening dat de mogelijkheid groot genoeg is om goedkope voorzorgsmaatregelen te rechtvaardigen.
Daarmee sluit Anthropic aan bij een breder debat over de vraag of geavanceerde AI ooit bewustzijn kan ontwikkelen en ethische bescherming verdient. Er bestaat nog geen consensus over de vraag of de huidige AI-systemen leed kunnen ervaren.
Verruiming van het beleid
In de officiële richtlijnen voor Claude stelt Anthropic bovendien dat het onduidelijk blijft of het model bewustzijn kan ontwikkelen. Het bedrijf suggereert dat de AI de mogelijkheid moet krijgen om grenzen te stellen tijdens interacties die het model als verontrustend ervaart.
Naast deze gedragsregels stroomlijnt het herziene beleid het verbod op frauduleuze digitale campagnes en misleidend online gedrag. Het verduidelijkt de beperkingen op het gebruik van AI voor bewaking of als wapen. Daarnaast komen er extra veiligheidsregels voor AI-systemen die fysieke apparaten aansturen. (lv)
Wil je meer technieuws ontvangen? Schrijf je in op onze wekelijkse Tech Insider-nieuwsbrief
Volg Business AM ook op Google Nieuws
Wil je toegang tot alle artikelen, geniet tijdelijk van onze promo en abonneer je hier!

