To ChatGPT βάζει πλέον «κρυφή» υπογραφή στα κείμενα

Το textGrain είναι η νέα τεχνολογία με την οποία η OpenAI θα αρχίσει να προσθέτει αόρατο, machine-readable watermark στα κείμενα που παράγουν το ChatGPT και το Codex στην Ευρωπαϊκή Ένωση. Η εφαρμογή θα ξεκινήσει σταδιακά μέσα στις επόμενες εβδομάδες και θα αφορά επιλέξιμους χρήστες όλων των plans στην ΕΕ.

Δεν πρόκειται όμως για κάποιον κρυφό χαρακτήρα που μπορεί να βρεθεί ανοίγοντας το κείμενο σε έναν editor. Το textGrain επεμβαίνει στον ίδιο τον τρόπο με τον οποίο το μοντέλο επιλέγει τις λέξεις του, δημιουργώντας ένα στατιστικό αποτύπωμα που ένας ειδικός detector μπορεί αργότερα να αναζητήσει.

Πώς λειτουργεί το textGrain

Κατά την παραγωγή κειμένου, ένα language model δεν επιλέγει απλώς την «επόμενη σωστή λέξη».

Υπολογίζει πιθανότητες για πολλά διαφορετικά επόμενα tokens και στη συνέχεια επιλέγει ανάμεσά τους.

Το textGrain τροποποιεί ελαφρά αυτές τις πιθανότητες βάσει ενός μυστικού key. Ορισμένες πιθανές επιλογές ευνοούνται κάθε φορά, χωρίς όμως να αλλάζει ουσιαστικά το νόημα του κειμένου.

Σε μεγαλύτερα αποσπάσματα, οι επιλογές αυτές δημιουργούν ένα μοτίβο που δεν είναι ορατό στον αναγνώστη αλλά μπορεί να αναγνωριστεί στατιστικά από detector που γνωρίζει το αντίστοιχο key.

Η OpenAI τονίζει ότι δεν προστίθενται αόρατα γράμματα, ειδικά Unicode characters, κενά ή watermark-only tokens στα κείμενα του ChatGPT.

Αυτό σημαίνει ότι ένα απλό copy-paste δεν αφαιρεί αυτομάτως το watermark.

Δεν μπορεί να αποδείξει ότι ένα κείμενο είναι γραμμένο από AI

ChatGPT Work: Δεκάδες εργασίες που μπορεί πλέον να ολοκληρώσει για εσάς

Εδώ βρίσκεται και ο σημαντικότερος περιορισμός.

Η ύπαρξη ενός textGrain watermark αποτελεί ένδειξη ότι ένα OpenAI model πιθανότατα δημιούργησε ή επεξεργάστηκε το συγκεκριμένο κείμενο.

Δεν αποδεικνύει ποιος το δημιούργησε, ποιος το έγραψε, ποιος έχει τα δικαιώματα ή πόσο μεγάλη ήταν η ανθρώπινη συμμετοχή.

Αντίστοιχα, η απουσία watermark δεν σημαίνει ότι το κείμενο γράφτηκε απαραίτητα από άνθρωπο.

Ένα κείμενο μπορεί να προέρχεται από άλλο AI model, από παλαιότερη έκδοση χωρίς watermark ή να έχει υποστεί αρκετή επεξεργασία ώστε το στατιστικό σήμα να μην είναι πλέον ανιχνεύσιμο.

Η ίδια η OpenAI αναγνωρίζει επίσης ότι μπορεί να υπάρξουν false positives και false negatives.

Paraphrasing και μετάφραση παραμένουν πρόβλημα

Ρώτησε το ChatGPT αν θα τον πιάσουν - και αυτό ακριβώς τον κατέστρεψε

Τα text watermarks έχουν μια σημαντική αδυναμία σε σχέση με αντίστοιχες τεχνολογίες για εικόνα και ήχο. Η γλώσσα αλλάζει εύκολα.

Μικρές διορθώσεις μπορεί να διατηρήσουν το στατιστικό σήμα, αλλά ένα εκτεταμένο rewrite, έντονο paraphrasing ή μετάφραση σε άλλη γλώσσα μπορεί να το αποδυναμώσει ή να το εξαφανίσει.

Η OpenAI είχε επισημάνει ήδη σε προηγούμενες έρευνές της ότι η μετάφραση ή η επαναδιατύπωση μέσω δεύτερου generative model μπορούν να παρακάμψουν αρκετά εύκολα ορισμένες μορφές text watermarking.

Για αυτό η εταιρεία δεν παρουσιάζει το textGrain ως αλάνθαστο AI detector.

Τα σύντομα κείμενα και ο κώδικας είναι ακόμη δυσκολότερα

Ένα ακόμη πρόβλημα αφορά το μέγεθος και τη φύση του περιεχομένου.

Ένα μεγάλο άρθρο προσφέρει στο μοντέλο πολλές ευκαιρίες να επιλέξει ανάμεσα σε διαφορετικές λέξεις και διατυπώσεις, άρα υπάρχει αρκετός χώρος για να δημιουργηθεί το στατιστικό μοτίβο.

Μια απάντηση δύο προτάσεων δεν προσφέρει το ίδιο περιθώριο.

Ακόμη δυσκολότερος είναι ο κώδικας. Σε πολλές περιπτώσεις υπάρχουν πολύ λιγότερες λογικές επιλογές για το επόμενο token, επειδή το πρόγραμμα πρέπει να παραμένει συντακτικά και λειτουργικά σωστό.

Αυτό έχει ιδιαίτερο ενδιαφέρον για το Codex, το οποίο περιλαμβάνεται στην ευρωπαϊκή εφαρμογή του watermarking αλλά παράγει μεγάλο ποσοστό περιεχομένου όπου η ανίχνευση μπορεί να είναι πιο δύσκολη.

Γιατί ξεκινά από την Ευρωπαϊκή Ένωση

Η επιλογή της Ευρώπης δεν είναι τυχαία.

Το Article 50 του ευρωπαϊκού AI Act απαιτεί από providers συστημάτων generative AI να διασφαλίζουν ότι synthetic audio, image, video και text μπορούν να αναγνωριστούν σε machine-readable μορφή ως περιεχόμενο που δημιουργήθηκε ή τροποποιήθηκε τεχνητά.

Οι συγκεκριμένες transparency obligations άρχισαν να εφαρμόζονται από τις 2 Αυγούστου 2026, με περιορισμένη μεταβατική περίοδο για ορισμένα συστήματα που βρίσκονταν ήδη στην αγορά.

Η OpenAI έχει επίσης υπογράψει το ευρωπαϊκό Code of Practice για τη διαφάνεια του AI-generated content.

Το textGrain αποτελεί την τεχνική απάντηση της εταιρείας σε αυτές τις απαιτήσεις.

Δεν γίνεται ακόμη παγκόσμιο default

Η OpenAI έχει επιλέξει πιο προσεκτική ανάπτυξη εκτός Ευρώπης.

Για ChatGPT και Codex το watermark θα ενεργοποιηθεί αρχικά μόνο στην ΕΕ και η εταιρεία αναφέρει ρητά ότι δεν πρόκειται να το κάνει global default κατά το λανσάρισμα.

Αντίθετα, οι πελάτες του OpenAI API σε όλο τον κόσμο μπορούν ήδη να επιλέξουν προαιρετικά watermarked outputs για υποστηριζόμενα models.

Η επιλογή παραμένει απενεργοποιημένη από προεπιλογή.

Παράλληλα, η OpenAI σκοπεύει να διαθέσει το textGrain ως open-source τεχνολογία, ώστε ερευνητές και άλλες εταιρείες να μπορούν να μελετήσουν και να βελτιώσουν τη μέθοδο.

Ο AI detector δεν θα δοθεί σε όλους

To ChatGPT βάζει πλέον «κρυφή» υπογραφή στα κείμενα

Εξίσου ενδιαφέρον είναι ότι η OpenAI δεν ανοίγει αρχικά τον detector στο ευρύ κοινό.

Από σήμερα μπορούν να υποβάλουν αίτηση εγκεκριμένοι ερευνητές και εξειδικευμένοι οργανισμοί, με την πρόσβαση να δίνεται κατά περίπτωση.

Ο λόγος είναι ακριβώς οι περιορισμοί της τεχνολογίας.

Ένα εργαλείο που παρουσιάζεται στο κοινό ως «AI detector», ενώ μπορεί να κάνει λάθος, θα μπορούσε εύκολα να οδηγήσει σε λανθασμένες κατηγορίες σε σχολεία, πανεπιστήμια, επιχειρήσεις ή μέσα ενημέρωσης.

Για αυτό το textGrain δεν πρέπει να αντιμετωπίζεται ως μηχανή που απαντά με βεβαιότητα αν ένα κείμενο είναι «ανθρώπινο» ή «AI».

Είναι περισσότερο ένα επιπλέον provenance signal.

Και ίσως αυτή να είναι η σημαντικότερη διάκριση καθώς η Ευρώπη επιχειρεί να κάνει το AI-generated περιεχόμενο πιο διαφανές: ένα watermark μπορεί να αφήνει ίχνη για το πώς δημιουργήθηκε ένα κείμενο, αλλά δεν μπορεί να λύσει μόνο του το πολύ πιο δύσκολο ερώτημα του ποιος πραγματικά το έγραψε.