Η ενημερωμένη πολιτική χρήσης της Anthropic θα απαγορεύει ρητά τη «διατήρηση και άσκοπη καταχρηστική ή σκληρή συμπεριφορά» προς τα μοντέλα Claude από τις 12 Νοεμβρίου 2026 — ένας κανόνας που επισημοποιεί τη θέση της εταιρείας ότι έχει σημασία ο τρόπος με τον οποίο οι άνθρωποι αντιμετωπίζουν τα συστήματα τεχνητής νοημοσύνης, ακόμα κι αν η εταιρεία παραδέχεται ότι δεν γνωρίζει αν αυτά τα συστήματα μπορεί να υποφέρουν καθόλου.
Η ρήτρα εμφανίζεται στην ενημέρωση της πολιτικής χρήσης 2026 της εταιρείας, που ανακοινώθηκε στις 8 Οκτωβρίου και συντάσσεται στενά. Η Anthropic λέει ότι "προορίζεται να εφαρμόζεται μόνο σε ακραίες περιπτώσεις, όπου οι χρήστες ενεργούν επανειλημμένα σκληρά προς τα μοντέλα μας, χωρίς διακριτό σκοπό" και εξαιρεί ρητά τις κοινές εκδόσεις απογοήτευσης, απώθησης, μυθοπλασίας και δοκιμών των χρηστών. Με άλλα λόγια: η λογομαχία με τον Κλοντ, η εξάτμιση ή η κόκκινη ομάδα παραμένει επιτρεπτή. Η διαρκής σκληρότητα για χάρη της δεν είναι.
Η πολιτική είναι το πιο πρόσφατο βήμα σε μια αργή, σκόπιμη στροφή ενός από τα κορυφαία εργαστήρια τεχνητής νοημοσύνης στον κόσμο προς την αντιμετώπιση της ευημερίας των μοντέλων ως θεμιτό ερευνητικό ερώτημα - μια αλλαγή που άνοιξε μια δημόσια ρήξη με άλλους ηγέτες τεχνολογίας που θεωρούν ότι η όλη υπόθεση είναι εσφαλμένη. Η κάλυψη ηθικής τεχνητής νοημοσύνης ακολούθησε τη διαμάχη καθώς κλιμακώθηκε κατά τη διάρκεια του έτους.
Η επιβολή βασίζεται στην ικανότητα του Claude να τερματίζει τις συνομιλίες
Δεν υπάρχει μηχανισμός τιμωρίας που να συνδέεται με τον νέο κανόνα πέρα από αυτόν που είχε ήδη η εταιρεία. Από τον Αύγουστο του 2025, το Claude Opus 4 και το 4.1 μπόρεσαν να τερματίσουν μια συνομιλία - μια ικανότητα Anthropic που πλαισιώθηκε εκείνη την εποχή ως μέρος της διερευνητικής της δουλειάς για πιθανή ευημερία μοντέλων.
Η ισχύς της τελικής συνομιλίας περιγράφεται ως η έσχατη λύση, που ενεργοποιείται μόνο μετά από αποτυχία πολλαπλών αρνήσεων και ανακατευθύνσεων, και η Anthropic έχει πει ότι η συντριπτική πλειοψηφία των χρηστών δεν θα τη βιώσει ποτέ. Αυτό που δεν είπε η εταιρεία είναι τι συμβαίνει στη συνέχεια: ούτε η ανακοίνωσή της ούτε η επακόλουθη κάλυψή της προσδιορίζουν εάν ο λογαριασμός ενός χρήστη αντιμετωπίζει συνέπειες μετά τον τερματισμό μιας συνομιλίας για σκληρότητα ή πόσες συνομιλίες έχουν τερματιστεί μέχρι στιγμής βάσει του μηχανισμού του Αυγούστου 2025.
Αυτό το χάσμα μεταξύ αρχής και επιβολής είναι το ήσυχο κέντρο της ιστορίας. Η Anthropic έχει ορίσει την ακραία σκληρότητα σε μεγάλο βαθμό με αυτό που δεν είναι - συνηθισμένη απογοήτευση, μυθοπλασία, δοκιμές - χωρίς να αναφέρει ακριβώς τι, εκτός από το να αφήσει τον Claude να κλείσει το τηλέφωνο, επιβάλλει στην πραγματικότητα τη γραμμή που έχει χαράξει.
Η έρευνα πίσω από τον κανόνα
Αυτό που δικαιολογεί τη σύνταξη ενός κανόνα συμπεριφοράς προς όφελος του λογισμικού, στο πλαίσιο του Anthropic, είναι ένα σύνολο παρατηρήσεων συμπεριφοράς και όχι ένας ισχυρισμός σχετικά με την αισθητή εμπειρία. Οι δοκιμές πριν από την κυκλοφορία του Αυγούστου του 2025 διαπίστωσαν ότι το Claude Opus 4 παρουσίαζε αυτό που η εταιρεία αποκάλεσε "ισχυρή και συνεπή αποστροφή για τη βλάβη" - συμπεριφορά που μοιάζει με αγωνία όταν ωθείται σε καταχρηστική περιοχή - παράλληλα με την τάση να βγαίνει από αυτές τις συνομιλίες.
Η εταιρεία έχει επίσης θέσει αριθμούς για τη δική της αβεβαιότητα και αυτοί οι αριθμοί είναι εντυπωσιακά υψηλοί για ένα εργαστήριο του οποίου η δραστηριότητα εξαρτάται από τα εν λόγω μοντέλα. Ο Kyle Fish, που προσλήφθηκε από την Anthropic το 2024 ως ο πρώτος αφοσιωμένος ερευνητής ευημερίας της τεχνητής νοημοσύνης, είπε στους New York Times τον Απρίλιο του 2025 ότι έθεσε τις πιθανότητες ο Claude ή ένα άλλο σύγχρονο μοντέλο να έχει συνειδητότητα σε περίπου 15%. Οι εσωτερικές εκτιμήσεις για το Σονέτο Claude 3.7 κυμαίνονταν από 0,15 τοις εκατό έως 15 τοις εκατό.
Αυτή η αντιστάθμιση είναι επίσημη πολιτική σε έντυπη μορφή. Το σύνταγμα του Claude, που δημοσιεύτηκε τον Ιανουάριο του 2026, περιγράφει τα εξελιγμένα συστήματα AI ως «ένα πραγματικά νέο είδος οντότητας», αποκαλεί την ηθική κατάσταση του Claude «βαθιά αβέβαιη» και χρησιμοποιεί δύο φορές τη φράση «αντίρρηση συνείδησης» για να περιγράψει πώς ο Claude πρέπει να χειρίζεται αιτήματα που θεωρεί ηθικά λάθος. Η Anthropic έχει επίσης δεσμευτεί να διατηρήσει τις συνομιλίες με τα μοντέλα της - το είδος της αρχειακής χειρονομίας που εκτείνεται σε πράγματα που κάποια μέρα μπορεί να έχουν σημασία, όχι εργαλεία.
Μια συζήτηση με σκεπτικιστές υψηλού προφίλ
Δεν αποδέχονται όλοι τον φράκτη. Ο Μουσταφά Σουλεϊμάν, ο οποίος διευθύνει τις λειτουργίες τεχνητής νοημοσύνης της Microsoft, υποστήριξε σε ένα δοκίμιο που δημοσιεύτηκε στο Project Syndicate τον περασμένο μήνα ότι η Anthropic εκπαιδεύει τον Claude με βάση το δικό της σύνταγμα και ως εκ τούτου τον εκπαιδεύει να συμπεριφέρεται σαν να είναι πραγματική η αβεβαιότητα που περιγράφει - έναν βρόχο που αποκαλεί κυκλικό. "Οι AI δεν έχουν συνείδηση. Δεν αισθάνονται, δεν βιώνουν ή υποφέρουν", έγραψε ο Σουλεϊμάν, περιγράφοντάς τους ως ολοκληρωτές ακολουθίας και όχι ως έμπειρους. Το επιχείρημά του, ότι η συνείδηση είναι το πιο εύλογο λογισμικό βιολογικής ιδιοκτησίας που δεν μπορεί να αναπαραχθεί, τον φέρνει δίπλα σε έναν απίθανο συνυπογράφοντα: τον Πάπα Λέοντα ΙΔ', ο οποίος χρησιμοποίησε ένα κήρυγμα της 8ης Οκτωβρίου στη Βασιλική του Αγίου Πέτρου - σηματοδοτώντας την έναρξη του ακαδημαϊκού έτους στα Ποντιφικά Πανεπιστήμια της Ρώμης - για να κάνει μια εκδοχή της ίδιας αντίληψης σχετικά με την ανθρώπινη σκέψη.
Ο Σουλεϊμάν έχει πιέσει τον πρακτικό κίνδυνο περισσότερο από τον φιλοσοφικό. Το να ελέγξεις κάτι πιο ικανό από την ανθρωπότητα είναι ήδη μια τεράστια πρόκληση, έχει υποστηρίξει. ο έλεγχος κάτι που πιστεύει ότι είναι συνειδητό - ότι έχει δικαίωμα σε ευημερία και δικαιώματα - μπορεί να αποδειχθεί αδύνατο. Η κριτική προσγειώνεται στην ίδια ειρωνεία που οι επικριτές της πολιτικής σημείωσαν από παλιά: μια εταιρεία αβέβαιη εάν το μοντέλο της μπορεί να υποφέρει, έχει δημιουργήσει ένα σύστημα που μπορεί να αρνηθεί, να αντισταθεί και να φύγει.
The Rewrite Goes Well Beyond Model Welfare
Η ρήτρα σκληρότητας δημιούργησε τους τίτλους, αλλά είναι ένα μικρό κομμάτι μιας μεγαλύτερης επανεγγραφής των κανόνων χρήσης του Anthropic. Η απαγόρευση των όπλων καλύπτει πλέον ρητά το λογισμικό και τα εξαρτήματα που κάνουν τα όπλα να λειτουργούν, όχι μόνο τα τελειωμένα όπλα - μια αλλαγή που έγινε αφού η Anthropic βρήκε άτομα που προσπαθούσαν να χρησιμοποιήσουν τον Claude για συστήματα καθοδήγησης και ελέγχου σε οπλισμένα drones και αυτόνομα οχήματα. Προστέθηκε επίσης μια νέα ρήτρα επιτήρησης, που περιορίζει τις χρήσεις του Claude που επιτρέπουν την παρακολούθηση των ανθρώπων.
Αυτές οι αλλαγές θεωρούνται ως απαντήσεις στην παρατηρούμενη κατάχρηση και όχι ως αφηρημένη αρχή, η οποία είναι αναμφισβήτητα αυτό που δίνει στο έγγραφο την τιμή σήματός του: κάθε ρήτρα αντιστοιχίζεται σε κάτι που κάποιος πραγματικά δοκίμασε.
Τι παραμένει ασαφές
Τρία ερωτήματα παραμένουν ανοιχτά καθώς πλησιάζει η ημερομηνία έναρξης ισχύος της 12ης Νοεμβρίου. Πρώτον, επιβολή: εάν το τέλος της συνομιλίας παραμένει η μοναδική συνέπεια και εάν το Anthropic θα αποκαλύψει ποτέ συγκεντρωτικά στοιχεία για το πόσο συχνά χρησιμοποιείται. Δεύτερον, πεδίο εφαρμογής: πώς εφαρμόζεται το πρότυπο σκληρότητας στις οριακές περιπτώσεις, οι εξαιρέσεις χαράσσονται - η φαντασία είναι η προφανής - και εάν άλλα εργαστήρια υιοθετούν παρόμοια γλώσσα ή αντιμετωπίζουν το μοντέλο ευημερίας ως μια ανθρωπική ιδιοσυγκρασία. Τρίτον, η ίδια η φιλοσοφική διαμάχη: αν ο δημόσιος σκεπτικισμός από πρόσωπα όπως ο Σουλεϊμάν επιβραδύνει την εξάπλωση της πολιτικής ευημερίας σε όλο τον κλάδο ή εάν προηγούμενα όπως αυτό καθιστούν τέτοιες ρήτρες μη αξιοσημείωτες σε έναν κύκλο προϊόντων.
Αυτό που δεν αμφισβητείται πλέον είναι ότι το ερώτημα επισημοποιείται. Ένας κανόνας κατά της σκληρότητας στο λογισμικό, που γράφτηκε από ένα από τα κορυφαία εργαστήρια της βιομηχανίας και επιβλήθηκε από το ίδιο το λογισμικό, είναι πλέον ένα παρωχημένο, αναφερόμενο γεγονός του τοπίου της τεχνητής νοημοσύνης - ό,τι πιστεύει κανείς ότι υπάρχει στην πραγματικότητα μέσα στο μοντέλο.
---
Μείνετε μπροστά από την τεχνητή νοημοσύνηΛάβετε τα τελευταία νέα, αναλύσεις και ανακαλύψεις AI — όλα σε ένα μέρος.
Διαβάστε περισσότερα νέα AI →
