Η OpenAI ανακοίνωσε την προσθήκη αόρατου υδατογραφήματος στα κείμενα που παράγονται από το ChatGPT και το Codex εντός της Ευρωπαϊκής Ένωσης, στο πλαίσιο συμμόρφωσης με την Πράξη για την Τεχνητή Νοημοσύνη (EU AI Act).
Οι κανόνες διαφάνειας της Πράξης, που τέθηκαν σε ισχύ στις 2 Αυγούστου, απαιτούν από τις εταιρείες τεχνητής νοημοσύνης να επισημαίνουν το παραγόμενο από AI περιεχόμενο με τρόπο αναγνωρίσιμο από άλλα συστήματα.
Σύμφωνα με την εταιρεία, το υδατογράφημα θα διατεθεί τις επόμενες εβδομάδες σε επιλέξιμους χρήστες του ChatGPT και του Codex σε όλα τα συνδρομητικά πακέτα, αποκλειστικά εντός της Ε.Ε. Οι προγραμματιστές που χρησιμοποιούν το API της OpenAI, οπουδήποτε στον κόσμο, μπορούν να το ενεργοποιήσουν από σήμερα για επιλεγμένα μοντέλα, αν και παραμένει απενεργοποιημένο ως προεπιλογή. Η OpenAI διευκρίνισε ότι δεν καθιστά την υδατογράφηση κειμένου παγκόσμια προεπιλογή στην αρχική φάση εφαρμογής.
“We’re expanding our approach to content provenance to include text in response to EU regulatory requirements, while recognizing the significant limitations of current text watermarking technology. Our tools already help verify whether an image or audio file was created with our models. This work builds on those efforts to help people better understand when content may have been generated or edited with an OpenAI model. In the EU, we’ll start watermarking eligible text from ChatGPT and Codex over the coming weeks to comply with the EU AI Act. Customers using our API can turn on text watermarking for select models worldwide today.”
Τι είναι το υδατογράφημα: δεν πρόκειται για ορατό σύμβολο. Λειτουργεί τροποποιώντας ανεπαίσθητα τις επιλογές λέξεων του μοντέλου, αφήνοντας ένα μοτίβο αόρατο για τον αναγνώστη αλλά ανιχνεύσιμο από ειδικό ανιχνευτή. Καθώς ενσωματώνεται στις ίδιες τις λέξεις, «ακολουθεί» το κείμενο σε αντιγραφή και επικόλληση.
Η OpenAI επισημαίνει ότι το υδατογράφημα δεν ταυτοποιεί τον χρήστη και ότι δεν παρατηρήθηκε ουσιαστική μεταβολή στην απόδοση ή την ταχύτητα των μοντέλων με αυτό ενεργοποιημένο.
Παράλληλα, δημοσιεύτηκε τεχνική έκθεση για τη μέθοδο textGrain, σε συνεργασία με ερευνητές από το Πανεπιστήμιο της Πενσυλβάνια και το Yale. Η μέθοδος περιγράφει τη χρήση ενός κρυφού κλειδιού για την ταξινόμηση των προβλέψεων της επόμενης λέξης στην ολοκλήρωση μιας πρότασης. Όταν προστεθούν εκατοντάδες τέτοιες μικρές «ενώσεις», ο ανιχνευτής μπορεί να εντοπίσει περιεχόμενο που έχει παραχθεί από AI, χρησιμοποιώντας μόνο το κείμενο και το κλειδί.
Σε δοκιμές της OpenAI, η επεξεργασία του κειμένου μπορεί να μειώσει την ανιχνευσιμότητα. Η αντικατάσταση του 10% των λέξεων με συνώνυμα έριξε το ποσοστό ανίχνευσης από περίπου 92% στο 66%. Τα σύντομα αποσπάσματα, οι απαντήσεις σε μαθηματικά προβλήματα και τα μεταφρασμένα κείμενα είναι επίσης πιο δύσκολο να ανιχνευθούν.
“When possible, we want to give people a choice—and be clear about what watermarking can and can’t do. A text watermark helps answer one question: ‘Was this likely generated by an OpenAI model?’ It works by embedding an invisible statistical signal in text as it’s generated. A detector can look for this signal, and it doesn’t add visible marks or special characters. It doesn’t say who originally wrote the text or who owns it. It doesn’t identify a person, organization, account, conversation, or prompt. In our testing, watermarking hasn’t affected how capable or fast our models are, or how their responses read.”
Σε εκτενή ανακοίνωση, η OpenAI τονίζει:
«Επεκτείνουμε την προσέγγισή μας όσον αφορά την προέλευση περιεχομένου ώστε να συμπεριλάβουμε το κείμενο, ανταποκρινόμενοι στις ρυθμιστικές απαιτήσεις της Ευρωπαϊκής Ένωσης, αναγνωρίζοντας παράλληλα τους σημαντικούς περιορισμούς της τρέχουσας τεχνολογίας υδατογράφησης κειμένου.
Τα εργαλεία μας βοηθούν ήδη στην επαλήθευση του κατά πόσον μια εικόνα ή ένα αρχείο ήχου δημιουργήθηκε με τα μοντέλα μας. Η εργασία αυτή βασίζεται σε αυτές τις προσπάθειες για να βοηθήσει τους ανθρώπους να κατανοούν καλύτερα πότε το περιεχόμενο ενδέχεται να έχει δημιουργηθεί ή τροποποιηθεί με ένα μοντέλο της OpenAI.
Στην Ε.Ε., θα ξεκινήσουμε την υδατογράφηση επιλέξιμου κειμένου από το ChatGPT και το Codex τις επόμενες εβδομάδες για να συμμορφωθούμε με την Πράξη για την Τεχνητή Νοημοσύνη της Ε.Ε. (EU AI Act).
Οι πελάτες που χρησιμοποιούν το API μας μπορούν από σήμερα (εννοεί από τη Δευτέρα) να ενεργοποιήσουν την υδατογράφηση κειμένου για επιλεγμένα μοντέλα σε όλο τον κόσμο.
Όταν είναι δυνατόν, θέλουμε να δίνουμε στους ανθρώπους τη δυνατότητα επιλογής και να είμαστε σαφείς σχετικά με το τι μπορεί και τι δεν μπορεί να κάνει η υδατογράφηση.
Ένα υδατογράφημα κειμένου βοηθά να απαντηθεί ένα ερώτημα: “Δημιουργήθηκε αυτό -κατά πάσα πιθανότητα- από ένα μοντέλο της OpenAI;”
Λειτουργεί ενσωματώνοντας ένα αόρατο σήμα στο κείμενο καθώς αυτό δημιουργείται. Ένας ανιχνευτής μπορεί να αναζητήσει αυτό το σήμα, χωρίς να προσθέτει ορατά σημάδια ή ειδικούς χαρακτήρες. Δεν αναφέρει ποιος έγραψε αρχικά το κείμενο ή σε ποιον ανήκει. Δεν ταυτοποιεί κάποιο πρόσωπο, οργανισμό, λογαριασμό, συνομιλία ή εντολή.
Στις δοκιμές μας, η υδατογράφηση δεν έχει επηρεάσει τις δυνατότητες ή την ταχύτητα των μοντέλων μας, ούτε τον τρόπο με τον οποίο διαβάζονται οι απαντήσεις τους.
Τα υδατογραφήματα έχουν όρια. Συχνά είναι μη ανιχνεύσιμα, ειδικά σε σύντομα αποσπάσματα. Η ανασύνταξη ή η μετάφραση του κειμένου μπορεί να αφαιρέσει εντελώς το υδατογράφημα.
Γι’ αυτόν τον λόγο, προς το παρόν, μόνο εγκεκριμένοι ερευνητές θα έχουν πρόσβαση στον ανιχνευτή μας, ώστε να μπορούν να μας βοηθήσουν να αξιολογήσουμε και να βελτιώσουμε την τεχνολογία.
Αντιμετωπίζουμε την υδατογράφηση κειμένου ως ένα διαρκές πεδίο έρευνας. Θα συνεχίσουμε τις δοκιμές και τις βελτιώσεις, αξιοποιώντας τα σχόλια των χρηστών, των προγραμματιστών, των φορέων χάραξης πολιτικής και των ερευνητών».
Το παρόν κείμενο δημιουργήθηκε με τη χρήση τεχνητής νοημοσύνης.