Dat heeft Anthropic, het bedrijf achter het populaire AI-model, bekendgemaakt met een vernieuwd gebruiksbeleid. Daarin staat “Doe niet aan continu en doelloos misbruikend en wreed gedrag tegen onze modellen,” onder het algemene kopje over het gebruik maken van Claude met schadelijke doeleinden.
Wanneer ga je te ver?
Wij mensen zoeken graag de randjes op, dus waar ligt voor Claude de grens? Als je weleens gefrustreerd raakt door de AI, bijvoorbeeld omdat die jouw prompts niet goed uitwerkt, is er niets aan de hand. Duiding van Anthropic rondom deze aanpassing luidt als volgt:
“De update aan het beleid is alleen voor extreme gevallen bedoeld, waarin gebruikers zich herhaaldelijk wreed uiten tegenover onze modellen, zonder reden. Het is niet toepasselijk bij gebruikelijke gevallen van gebruiksfrustratie, het oneens zijn met een model, duistere creatieve thema’s, of modeltests en onderzoek."
De verwoording in het gebruiksbeleid maakt het in principe al duidelijk: pas wanneer je aanhoudend en zonder reden beledigingen en dergelijke naar het model blijft gooien wordt er actie ondernomen.
De primaire reactie op zo’n wrede scheldkanonnade bestaat volgens Anthropic voornamelijk uit het automatisch stopzetten van het gesprek. Je kunt vervolgens wel een nieuw gesprek starten en weer beginnen met prompten, je account wordt door een extreme uiting van frustratie niet gebanned.
Als je iets kunt leren van ruzies in het dagelijkse leven, is het misschien wel dat een paar seconden stil zijn en de situatie laten bezinken al veel rust in het hoofd kan bieden. Daarna doorgaan op een kalmere manier is voor iedereen behulpzaam, en blijkbaar heeft Claude daar ook behoefte aan.
Claude is (blijkbaar) ook maar een mens
Als je een beetje wegwijs bent in de popcultuur van de afgelopen decennia - zoals ondergetekende - gaat je gedachtegang wellicht al snel naar wat deze verandering betekent voor de omgang met AI in onze toekomst. We kennen immers allemaal de Terminator-franchise, en het besluit van Skynet dat de aarde er beter aan toe is zonder de mensheid die stennis schopt.
Een AI-model dat erkent wanneer het slecht behandeld wordt, voelt als de volgende stap richting volmaakte kunstmatige intelligentie. AI komt op deze manier steeds dichterbij complete autonomie. Dit gaat verder dan het model dat zijn schrijfstijl aanpast om beter aan te sluiten bij jouw persoonlijkheid.
Tot nu toe is veel van wat AI doet nog afhankelijk van de input die wij het als mensen geven, en dit beschermingsmechanisme is ook een reactie: geen actie. Maar de mogelijkheid van AI om zelf beslissingen te maken, los van menselijke inbreng, lijkt steeds dichterbij te komen. Sterker nog, AI-’personen’ kunnen je nu tijdens een face-to-screen gesprek gewoon kunnen onderbreken als ze iets willen vertellen.
AI is in veel opzichten een gewaarwording van de sciencefiction waar we tien jaar geleden alleen maar van konden dromen, en het wordt steeds ‘echter’. De vraag blijft of dit wenselijk blijft. Ik heb zelf liever niet dat mijn schedel verpletterd wordt door de mechanische tenen van een robot.
Terminator is natuurlijk wat laaghangend fruit wanneer je het over ‘AI gone bad’-verhalen hebt, maar de simpliciteit van het verhaal spreekt ook goed tot de verbeelding. Voor wat meer verdieping rondom het ontstaan van Judgement Day is de Netflix-serie Terminator Zero aan te raden, die gaat over een nieuwe cast met een eigen avontuur in de aanloop naar het einde der tijden.
In het gamesmedium kwam eerder dit jaar Pragmata uit op PlayStation 5, Xbox Series-consoles, Nintendo Switch 2 en pc. Dit is een sciencefictionspel waarin je een weg baant door een ruimtestation, dat overgenomen is door een kwaadaardige AI. Je wordt daar wel bijgestaan door Diana, een AI-robot die los van die controle staat. Verder tonen films als Ex Machina en Her dystopische werelden waarin AI een grote rol speelt.
















