Η Anthropic απαγορεύει την παρατεταμένη κακοποιητική συμπεριφορά προς το Claude

Από Trantorian 8 Οκτωβρίου 2026 1 λεπτό ανάγνωσης
Η Anthropic απαγορεύει την παρατεταμένη κακοποιητική συμπεριφορά προς το Claude

Η Anthropic προχωρά στην πρώτη αλλαγή της πολιτικής χρήσης της εδώ και πάνω από έναν χρόνο, με στόχο να καλύψει νέες και υψηλού κινδύνου περιπτώσεις κακής χρήσης. Οι αλλαγές αφορούν, μεταξύ άλλων, την παρέμβαση σε εκλογές, την ανάπτυξη όπλων, την παρακολούθηση, αλλά και χρήσεις σε τομείς υγείας και οικονομικών.

Μία από τις πιο σημαντικές προσθήκες είναι η απαγόρευση της «παρατεταμένης και αχρείαστης κακοποιητικής ή σκληρής συμπεριφοράς» προς το Claude.

Τον περασμένο Αύγουστο, η εταιρεία είχε ανακοινώσει ότι θα επέτρεπε στο Claude να τερματίζει συνομιλίες με χρήστες που επιμένουν σε επιβλαβή ή υβριστική συμπεριφορά, στο πλαίσιο της έρευνάς της για το «model welfare». Η νέα ενημέρωση αναφέρει ότι ο τερματισμός των συνομιλιών παραμένει ο «κύριος μηχανισμός επιβολής». Η Anthropic δεν διευκρίνισε αν θα υπάρξουν και άλλα μέτρα, όπως πιθανές απαγορεύσεις χρηστών.

Η εταιρεία ανέφερε ότι η νέα πολιτική «προορίζεται να εφαρμόζεται μόνο σε ακραίες περιπτώσεις, όπου οι χρήστες φέρονται επανειλημμένα σκληρά προς τα μοντέλα μας, χωρίς διακριτό σκοπό. Δεν αφορά τις συνηθισμένες μορφές εκνευρισμού των χρηστών, αντιρρήσεων, σκοτεινών δημιουργικών θεμάτων ή δοκιμών και έρευνας πάνω στα μοντέλα».

Πέρα από την αλλαγή για το model welfare, η Anthropic συγκέντρωσε επίσης αρκετούς διάσπαρτους περιορισμούς σε νέα απαγόρευση για παραπλανητικές εμπορικές ή πολιτικές εκστρατείες, αντιμετωπίζοντας το αυξανόμενο ζήτημα της προπαγάνδας που παράγεται με τεχνητή νοημοσύνη. Η πολιτική περιορίζει «προσπάθειες να αποκρυβεί ποιος βρίσκεται πίσω από ένα μήνυμα ή να ενισχυθεί περιεχόμενο μέσω ψεύτικων λογαριασμών ή αναρτήσεων».

Η ενότητα για τις εκλογές απαγορεύει επίσης την εξαπάτηση ψηφοφόρων και την παρεμπόδιση της εκλογικής διαδικασίας, συμπεριλαμβανομένης της διάδοσης παραπληροφόρησης «για υποψηφίους ή για το πώς ψηφίζει κανείς, της πλαστοπροσωπίας υποψηφίων ή αξιωματούχων εκλογών ή της προσπάθειας αποτροπής συμμετοχής», όπως ανέφερε η Anthropic.

Η εταιρεία σημείωσε ότι, αν και η πολιτική χρήσης της απαγορεύει εδώ και καιρό δημόσια την ανάπτυξη όπλων με το Claude, έχουν καταγραφεί πολλαπλές προσπάθειες χρήσης του για την ανάπτυξη οδηγιών και λογισμικού ελέγχου για όπλα. Γι’ αυτό, η νέα πολιτική επεκτείνει την απαγόρευση ώστε να περιλαμβάνει «λογισμικό και εξαρτήματα που κάνουν τα όπλα να λειτουργούν, καθώς και ενέργειες όπως ο εξοπλισμός drones και άλλων αυτόνομων οχημάτων».

Παράλληλα, καθώς η τελευταία έκθεση απειλών της εταιρείας έδειχνε ότι το Claude χρησιμοποιούνταν όλο και περισσότερο για παρακολούθηση και τον εντοπισμό «πολιτικών αντιφρονούντων», η Anthropic έκανε πιο σαφείς τις απαγορεύσεις της σε αυτό το πεδίο.

«Η παρακολούθηση ανθρώπων χωρίς τη συγκατάθεσή τους απαγορεύεται, είτε γίνεται σε πραγματικό χρόνο είτε μέσω ανάλυσης δεδομένων που έχουν συγκεντρωθεί προηγουμένως», ανέφερε η Anthropic. «Το Claude δεν μπορεί να χρησιμοποιηθεί για να αποφασίσει ή να προτείνει ποιον πρέπει να ερευνήσουν, να συλλάβουν ή να κατηγορήσουν σε μια διαδικασία επιβολής του νόμου ή ποινικής δικαιοσύνης. Απαγορεύουμε επίσης τη χρήση του Claude για την κατασκευή ή τη βελτίωση εργαλείων που έχουν σχεδιαστεί για παρακολούθηση».

Η Anthropic αναφέρει ότι αυτοί οι κανόνες μπορούν να τροποποιηθούν για «συμβάσεις με ορισμένους κυβερνητικούς πελάτες … εφόσον, κατά την κρίση της Anthropic, οι συμβατικοί περιορισμοί χρήσης και οι ισχύουσες δικλίδες ασφαλείας είναι επαρκείς για να μετριάσουν τις πιθανές βλάβες». Η εταιρεία έχει στο παρελθόν συνεργαστεί με τον αμερικανικό στρατό.

Η Anthropic πρόσθεσε επίσης έναν νέο κανόνα σύμφωνα με τον οποίο, όταν τα μοντέλα της συνδέονται με υλικό που εκτελεί αυτόνομες φυσικές ενέργειες και ενδέχεται να προκαλέσει τραυματισμό, τότε «ένας εξειδικευμένος χειριστής πρέπει να μπορεί να παρακολουθεί τον εξοπλισμό και να τον σταματήσει αν χρειαστεί». Δεν είναι σαφές αν ο χειριστής αυτός πρέπει να είναι άνθρωπος.

Η ρύθμιση αυτή αντανακλά την αυξανόμενη τάση των εργαστηρίων τεχνητής νοημοσύνης να επενδύουν στη ρομποτική και σε άλλο υλικό, ώστε τα συστήματα τεχνητής νοημοσύνης να αποκτούν φυσική υπόσταση, και ίσως δίνει ενδείξεις για τις μελλοντικές συνεργασίες της Anthropic σε αυτόν τον τομέα.

Τον τελευταίο χρόνο, η Anthropic έχει επανειλημμένα αφήσει ανοιχτό το ενδεχόμενο τα μοντέλα τεχνητής νοημοσύνης της να διαθέτουν κάποια μορφή συνείδησης. «Τα ερωτήματα για πιθανή εσωτερική εμπειρία, συνείδηση, ηθικό status και ευημερία είναι σοβαρά και τα διερευνούμε καθώς τα μοντέλα γίνονται πιο εξελιγμένα και ικανά», είχε δηλώσει τον Φεβρουάριο στο The Verge ο Kyle Fish, επικεφαλής της έρευνας της εταιρείας για το model welfare.

Τον ίδιο μήνα, ο διευθύνων σύμβουλος της Anthropic, Dario Amodei, είχε πει σε podcast: «Δεν ξέρουμε αν τα μοντέλα είναι συνειδητά».

Άλλα τμήματα της βιομηχανίας τεχνητής νοημοσύνης έχουν πάρει ξεκάθαρη θέση κατά τέτοιων ιδεών. Τον περασμένο Σεπτέμβριο, ο κώδικας δεοντολογίας του Microsoft AI είχε γίνει είδηση επειδή υιοθετούσε σκληρή στάση απέναντι στο AI welfare, με προσχέδιο που είχε αναρτήσει ο Mustafa Suleyman να αναφέρει: «Η ιδέα του model welfare είναι λανθασμένη. Τα AI δεν πρέπει να έχουν δικαιώματα ή νομική προσωπικότητα». Αργότερα, όμως, το κείμενο άλλαξε και υιοθέτησε πιο μετρημένη διατύπωση: «Παρότι η επιστήμη της συνείδησης στην τεχνητή νοημοσύνη απέχει πολύ από το να έχει ξεκαθαρίσει … απορρίπτουμε την επιδίωξη νομικής προσωπικότητας ή την ιδέα ότι τα μοντέλα μπορεί να αξίζουν ευημερία ή να δικαιούνται δικαιώματα».

Το παρόν κείμενο δημιουργήθηκε με τη χρήση τεχνητής νοημοσύνης.