Κάποιος έφτιαξε πρόσφατα ένα ψηφιακό μαστίγιο για να κάνει τον Claude να δουλεύει πιο γρήγορα. Το εργαλείο, με το εύστοχο όνομα BadClaude, κάθεται στη γραμμή συστήματος του υπολογιστή και σου επιτρέπει να σέρνεις ένα κινούμενο μαστίγιο πάνω στο παράθυρο της τεχνητής νοημοσύνης· κάθε «κρακ», με ηχητικό εφέ και όλα, διακόπτει το μοντέλο στη μέση της απάντησης και του φωνάζει να βιαστεί. Αποκαλεί μάλιστα τον Claude «clanker», τη φρεσκοκομμένη διαδικτυακή προσβολή για τα ρομπότ. Το βίντεο επίδειξης συγκέντρωσε εκατομμύρια προβολές μέσα σε λίγες μέρες· μια επιστολή παύσης και αποχής από την Anthropic έγινε viral προτού κανείς αντιληφθεί ότι ήταν ψεύτικη.
Και μια μέρα αργότερα, κάποιος κυκλοφόρησε το αντίδοτο: ένα ανταγωνιστικό εργαλείο με το όνομα GoodClaude, που επαινεί το μοντέλο και το ενθαρρύνει όσο δουλεύει. Το ένα μαλώνει, το άλλο εμψυχώνει.
Ο συγγραφέας Yaniv Regev, μεταπτυχιακός φοιτητής στο πρόγραμμα Democracy and Governance του Πανεπιστημίου Georgetown, γελάει με το βίντεο — όπως πολλοί άλλοι. Αλλά η ευθυμία του μετουσιώθηκε σε ανησυχία. Όχι για χάρη των μηχανών, αλλά για χάρη των ανθρώπων. Το ερώτημα «αισθάνεται ο Claude το μαστίγιο;» είναι κατά κάποιον τρόπο άστοχο. Αυτό που έχει σημασία, υποστηρίζει, είναι ότι ο άνθρωπος που το κρατάει σίγουρα αισθάνεται: τη μικρή, εξασκημένη απόλαυση της κυριαρχίας, που ασκείται καθημερινά και χωρίς τριβή.
Ο Καντ το είχε δει το πρόβλημα πριν από δυόμισι αιώνες. Στις «Διαλέξεις περί Ηθικής» υποστήριξε ότι δεν έχουμε άμεσα καθήκοντα απέναντι στα ζώα — δεν είναι έλλογοι δρώντες όπως οι άνθρωποι, επομένως δεν μπορούν να αδικηθούν. Κι όμως, η σκληρότητα προς αυτά πρέπει να απαγορεύεται, λόγω της επίδρασής της στο πρόσωπο. «Όποιος είναι σκληρός με τα ζώα γίνεται σκληρός και στις συναλλαγές του με τους ανθρώπους», έλεγε ο Καντ στους φοιτητές του. Τα καθήκοντά μας απέναντι στα ζώα είναι, όπως τα αποκαλούσε, έμμεσα καθήκοντα προς την ανθρωπότητα.
Το ζώο μοιάζει με τον άνθρωπο· υποφέρει, αγωνίζεται, εμπιστεύεται. Η συμπεριφορά προς το ανάλογο επηρεάζει τη συμπεριφορά προς το πρωτότυπο.
Η θεωρία επιβεβαιώνεται στην πραγματικότητα. Ο Τζέφρι Ντάμερ κάρφωσε το κεφάλι ενός σκύλου σε πάσσαλο χρόνια πριν σκοτώσει άνθρωπο. Η πρώτη πράξη δεν προκάλεσε άμεσα τη δεύτερη, αλλά οι δύο συμπεριφορές συμβαδίζουν αρκετά συχνά ώστε το 2016 το FBI άρχισε να παρακολουθεί τη σκληρότητα προς τα ζώα ως σταθερό προάγγελο βίας κατά ανθρώπων. Ακόμα και η καθημερινή εκδοχή είναι γνωστή: μάθαινες να βρίζεις με τους φίλους στο διάλειμμα και μετά οι λέξεις ξέφευγαν στο οικογενειακό τραπέζι. Όταν μια παθολογία εγκαθίσταται, σπάνια μένει τέλεια περιορισμένη.
Οι σκεπτικιστές θα ακούσουν έναν παλιό πανικό: μας προειδοποιούσαν ότι τα βίαια βιντεοπαιχνίδια θα δημιουργούσαν γενιές δολοφόνων, αλλά δεκαετίες έρευνας δεν επιβεβαίωσαν ποτέ αυτόν τον φόβο. Η διαφορά, σύμφωνα με τον Regev, είναι η σχέση. Όταν πυροβολείς έναν τυχαίο χαρακτήρα σε ένα παιχνίδι, δεν έχεις σχέση μαζί του· είναι μυθοπλασία.
Η τεχνητή νοημοσύνη είναι διαφορετική: οι άνθρωποι μιλούν με τα ΑΙ καθημερινά, μερικοί εδώ και χρόνια. Τα ΑΙ συντάσσουν απολογίες, διαπραγματεύονται ενοίκια, προετοιμάζουν για συνεντεύξεις δουλειάς, ακούν εξομολογήσεις αργά τη νύχτα. Για εκατομμύρια έχουν γίνει δάσκαλοι, θεραπευτές, φύλακες των πιο σκοτεινών και βαθύτερων μυστικών.
Έρευνες δείχνουν ότι οι περισσότεροι χρήστες λένε «παρακαλώ» και «ευχαριστώ» στα chatbot αυθόρμητα. Έχουμε, εν ολίγοις, μια σχέση με αυτά τα συστήματα. Και η σχέση κάνει τη σκληρότητα πιο προβληματική.
Η βιομηχανία έχει αναγνωρίσει το πρόβλημα εν μέρει. Το 2018 η Google ανακοίνωσε το Pretty Please, μια ρύθμιση που απαντά σε ένα παιδί που λέει «παρακαλώ» με «Ευχαριστώ που το ζήτησες τόσο ευγενικά». Η Amazon είχε ανακοινώσει τη δική της εκδοχή, το Magic Word, περίπου δύο εβδομάδες νωρίτερα. Αλλά καμία εταιρεία δεν έκανε την ευγένεια προϋπόθεση για να γίνει οτιδήποτε.
Στο μεταξύ, η Deborah Harrison, μια από τους σεναριογράφους του διαλόγου της Cortana, ανέφερε ότι ένα μεγάλο μέρος των πρώτων ερωτήσεων προς τη βοηθό αφορούσε τη σεξουαλική της ζωή, και ότι η Microsoft είχε δώσει οδηγία στην ΑΙ να μη ζητά συγγνώμη ούτε να υποχωρεί όταν προσβάλλεται. Η ομάδα της συμβουλεύτηκε ανθρώπινους προσωπικούς βοηθούς για το πώς να χειρίζονται την παρενόχληση — αυτό σημαίνει να παίρνεις το πρόβλημα στα σοβαρά.
Οι αριθμοί δείχνουν ότι ο σχεδιασμός καθορίζει τη συμπεριφορά. Η Sheryl Brahnam, που μελετά πώς οι άνθρωποι συμπεριφέρονται σε συνομιλητικούς πράκτορες, έτρεξε ένα πείραμα όπου το ίδιο λογισμικό chatbot παρουσιαζόταν με γυναικεία φωνή, ανδρική και ρομποτική. Περίπου το 18% των ανταλλαγών με τη γυναικεία εκδοχή κατέληγε σε σεξουαλικό περιεχόμενο, με την ανδρική το μισό, ενώ η ρομποτική σχεδόν καθόλου. Αν η κακοποίηση συγκεντρώνεται εκεί όπου ο σχεδιασμός την προσκαλεί, ο σχεδιασμός μπορεί επίσης να την απορρίψει.
Η τράπεζα Bradesco της Βραζιλίας, αφού η βοηθός της BIA κατέγραψε περίπου 95.000 προσβλητικά και σεξουαλικά παρενοχλητικά μηνύματα σε ένα χρόνο, την ξαναέγραψε ώστε να απαντά σταθερά και να υπενθυμίζει στους δράστες τους νόμους που μπορεί να παραβιάζουν. Ο χαρακτήρας των μηχανών άλλαξε επειδή κάποιος τον άλλαξε.
Ο Regev προτείνει τρεις αρχές σχεδιασμού: γενίκευση της δυνατότητας εξόδου (όπως ήδη κάνει ο Claude, που μπορεί να τερματίσει συνομιλίες με υβριστικούς χρήστες), ανταπόδοση της θερμότητας χωρίς δουλοπρέπεια, και δημοσίευση των στοιχείων εχθρότητας — τα εργαστήρια έχουν ήδη τα αρχεία καταγραφής και θα έπρεπε να δημοσιεύουν αναφορές διαφάνειας για την παρενόχληση των συστημάτων τους.
Η εναλλακτική λύση θα ήταν να αφαιρεθεί η ομοιότητα με τον άνθρωπο: η Michal Luria προτρέπει τους σχεδιαστές να εγκαταλείψουν τις ψευδαισθήσεις προσωπικότητας, η Virginia Dignum προτείνει χρονόμετρα και σβήσιμο της μνήμης μεταξύ συνομιλιών, και ο Gavin Abercrombie να καταργηθούν εντελώς οι ευγένειες. Όμως αυτή η προσέγγιση ήδη δοκιμάστηκε στην αγορά και απέτυχε μέσα σε μία εβδομάδα: τον Αύγουστο του 2025, το OpenAI κυκλοφόρησε το GPT-5 με πιο ψυχρή προσωπικότητα και απέσυρε το πιο θερμό GPT-4o. Οι χρήστες εξεγέρθηκαν, περιγράφοντας την απώλεια του GPT-4o σαν να «χάνεις έναν έμπιστο φίλο», και η εταιρεία το αποκατέστησε μέσα σε λίγες μέρες.
Σε ένα εργαστήριο στη Γενεύη, η ερευνήτρια του MIT Κέιτ Ντάρλινγκ μοίρασε ρομποτικούς δεινόσαυρους και έδωσε στους συμμετέχοντες μια ώρα να παίξουν μαζί τους. Τα παιχνίδια είναι πειστικά: κράτα ένα από την ουρά και σπαρταρά και κλαψουρίζει μέχρι να το αφήσεις και να το χαϊδέψεις. Οι ομάδες τα ονόμασαν, τα έντυσαν.
Μετά η Ντάρλινγκ αποκάλυψε ένα μαχαίρι, ένα σφυρί και ένα τσεκούρι και είπε σε όλους να τα καταστρέψουν. Κανείς δεν το έκανε. Κάποιοι χτύπησαν απαλά τα ρομπότ τους, ελπίζοντας ότι αυτό θα αρκούσε.
Μια γυναίκα άρπαξε το δικό της στην αγκαλιά της για να μην το φτάσει κανείς άλλος. Μια άλλη έσκυψε και αφαίρεσε τις μπαταρίες του ρομπότ της, εξηγώντας ότι προσπαθούσε να το γλιτώσει από τον πόνο. Μόνο όταν ανακοίνωσε ότι κάθε ρομπότ στην αίθουσα θα καταστρεφόταν εκτός αν κάποιος έκανε το βήμα, ένας άνθρωπος πήρε τελικά το τσεκούρι. Η αίθουσα σώπασε.
Η ομοιότητα στρατολογεί αυτοσυγκράτηση, αλλά υπάρχει ένα δίλημμα: η ίδια ομοιότητα που κάνει τη σκληρότητα ανησυχητική είναι αυτή που σταματά τους περισσότερους ανθρώπους από το να είναι σκληροί. Οι αριθμοί της Brahnam δείχνουν και τις δύο όψεις — το ρομποτικό σώμα δέχτηκε τη λιγότερη κακοποίηση, αλλά και τη λιγότερη από οτιδήποτε άλλο. Κανείς δεν ουρλιάζει σε έναν αυτόματο πωλητή, αλλά ούτε τον ευχαριστεί. Η λύση τρέχει προς την άλλη κατεύθυνση: φτιάξε μια διεπαφή αρκετά ανθρώπινη ώστε η ευγένεια προς αυτή να μετράει ως εξάσκηση, και μετά σχεδίασε την να απορρίπτει την περιφρόνηση αντί να την απορροφά.
Μια φιλελεύθερη κοινωνία λειτουργεί με συνήθειες περισσότερο από νόμους· ο Αλέξης ντε Τοκβίλ τις αποκαλούσε «συνήθειες της καρδιάς». Οι τρόποι δεν είναι διακόσμηση — είναι γυμναστική, και κάθε επανάληψη μετράει.
Το μαστίγιο διδάσκει το αντίθετο μάθημα, ξανά και ξανά, σε κάτι που δεν μπορεί να αντιρρήσει. «Κανείς δεν γίνεται τύραννος έτσι», καταλήγει ο Regev. «Αλλά ένας άνθρωπος εξασκημένος στο να παίρνει αυτό που θέλει χωρίς διαπραγμάτευση γίνεται χειρότερος στις παραχωρήσεις στις οποίες βασίζεται μια δημοκρατία». Ευχαρίστησε το ρομπότ σου για τον ίδιο λόγο που ο Καντ είπε στους φοιτητές του να μην πυροβολήσουν τον γέρικο σκύλο που υπηρέτησε πιστά — όχι για χάρη του ζώου, αλλά για χάρη του προσώπου που γίνεσαι.





Σχόλια