Ένα κείμενο του ChatGPT θα μπορεί σύντομα να κουβαλά μαζί του ένα αόρατο «ίχνος», ακόμη κι όταν κάποιος το αντιγράψει και το επικολλήσει αλλού.
Η OpenAI ανακοίνωσε ότι μέσα στις επόμενες εβδομάδες θα αρχίσει να προσθέτει αόρατο, μηχανικά ανιχνεύσιμο watermark στα επιλέξιμα κείμενα που παράγουν το ChatGPT και το Codex για χρήστες στην Ευρωπαϊκή Ένωση.
Η αλλαγή αφορά όλα τα διαθέσιμα πακέτα στην ΕΕ και έρχεται σε εφαρμογή των νέων υποχρεώσεων διαφάνειας του ευρωπαϊκού AI Act, οι οποίες απαιτούν το περιεχόμενο που δημιουργείται από συστήματα τεχνητής νοημοσύνης να μπορεί, όπου είναι τεχνικά εφικτό, να αναγνωρίζεται ως τέτοιο.
Δεν πρόκειται, πάντως, για ένα λογότυπο στο τέλος της απάντησης. Ούτε για κρυφούς χαρακτήρες που μπορεί κάποιος να εντοπίσει ανοίγοντας το κείμενο σε έναν editor, μιας και σύστημα είναι αρκετά πιο περίπλοκο.
Το watermark κρύβεται στις ίδιες τις λέξεις
Η τεχνολογία της OpenAI ονομάζεται textGrain και παρεμβαίνει διακριτικά στον τρόπο με τον οποίο το μοντέλο επιλέγει τις λέξεις του.
Όταν ένα μοντέλο γράφει μια πρόταση, δεν υπάρχει μόνο μία πιθανή επόμενη λέξη. Υπάρχουν πολλές, με διαφορετικές πιθανότητες επιλογής. Το textGrain επηρεάζει ελαφρά αυτές τις επιλογές, δημιουργώντας σε βάθος ενός μεγαλύτερου κειμένου ένα στατιστικό μοτίβο. Ο αναγνώστης δεν βλέπει τίποτε διαφορετικό.
Ένας ειδικός ανιχνευτής, όμως, μπορεί να ψάξει για το συγκεκριμένο μοτίβο και να εκτιμήσει εάν το κείμενο δημιουργήθηκε ή επεξεργάστηκε από σύστημα της OpenAI.
Όπως εξηγεί η ίδια η OpenAI στην ανακοίνωσή της, το watermark αποτελεί μέρος της διατύπωσης του κειμένου. Έτσι μπορεί να παραμείνει όταν το περιεχόμενο αντιγραφεί από το ChatGPT σε ένα email, ένα έγγραφο ή μια ιστοσελίδα. Το TechCrunch σημειώνει ότι η τεχνολογία θα εφαρμοστεί αρχικά μόνο στην ΕΕ, ενώ για τους πελάτες του API σε όλο τον κόσμο η δυνατότητα watermarking θα είναι προαιρετική και απενεργοποιημένη εξ ορισμού.
Μπορεί κάποιος απλώς να το «σβήσει»;
Εδώ βρίσκεται η μεγάλη αδυναμία του συστήματος.Ναι, η επεξεργασία του κειμένου μπορεί να αποδυναμώσει σημαντικά το watermark. Σε δοκιμές της OpenAI, σε κείμενα περίπου 400 tokens, ο ανιχνευτής εντόπιζε το σήμα περίπου στο 92% των περιπτώσεων. Όταν αντικαταστάθηκε μόλις το 10% των λέξεων με συνώνυμα, το ποσοστό έπεσε περίπου στο 66%. Με αλλαγή του 25% των λέξεων, έπεσε στο 17%.
Με απλά λόγια, ένα κείμενο που αντιγράφεται αυτούσιο είναι πολύ ευκολότερο να αναγνωριστεί. Αν ξαναγραφτεί σε σημαντικό βαθμό, μεταφραστεί ή υποστεί εκτεταμένη ανθρώπινη επεξεργασία, το σήμα μπορεί να εξασθενήσει δραστικά.
Όμως πρόβλημα υπάρχει και στα πολύ σύντομα κείμενα. Όσο λιγότερες λέξεις έχει στη διάθεσή του ο ανιχνευτής, τόσο λιγότερο στατιστικό υλικό έχει για να αποφασίσει.
Δεν θα υπάρχει ένα δημόσιο «AI detector» για όλους
Η OpenAI δεν σκοπεύει, τουλάχιστον στην αρχή, να δώσει τον ανιχνευτή σε οποιονδήποτε θέλει να ανεβάσει ένα κείμενο και να ρωτήσει «το έγραψε το ChatGPT;».
Η πρόσβαση θα δοθεί αρχικά σε εγκεκριμένους ερευνητές και εξειδικευμένους οργανισμούς.
Υπάρχει λόγος. Οι ανιχνευτές δεν είναι αλάνθαστοι.
Μπορούν να δώσουν false positive, δηλαδή να θεωρήσουν ότι υπάρχει watermark εκεί όπου δεν υπάρχει, αλλά και false negative, χάνοντας ένα πραγματικά σημαδεμένο κείμενο.
Γι' αυτό η OpenAI ξεκαθαρίζει κάτι σημαντικό: η απουσία watermark δεν αποδεικνύει ότι ένα κείμενο γράφτηκε από άνθρωπο. Μπορεί απλώς να έχει δημιουργηθεί από άλλο μοντέλο. Μπορεί να είναι παλιότερο. Ή απλώς να έχει τροποποιηθεί τόσο πολύ ώστε το αρχικό σήμα να μην ανιχνεύεται πλέον.
Τι δεν αποκαλύπτει το watermark
Το σύστημα επίσης δεν ταυτοποιεί τον χρήστη. Δεν μπορεί να δείξει ποιος έδωσε το prompt, από ποιον λογαριασμό προήλθε το κείμενο ή ποια συνομιλία χρησιμοποιήθηκε. Δεν αποκαλύπτει τα prompts και δεν λειτουργεί ως μηχανισμός παρακολούθησης ενός συγκεκριμένου ανθρώπου.
Ούτε μπορεί να απαντήσει σε μια πολύ πιο δύσκολη ερώτηση: πόσο από το τελικό κείμενο είναι πραγματικά ανθρώπινο;
Ένας δημοσιογράφος, για παράδειγμα, μπορεί να χρησιμοποιήσει AI για μια πρώτη δομή και στη συνέχεια να ερευνήσει, να ξαναγράψει και να επιμεληθεί ολόκληρο το άρθρο. Το watermark μπορεί να υποδείξει ότι ένα σύστημα OpenAI συμμετείχε κάποια στιγμή στη δημιουργία ή επεξεργασία του κειμένου. Δεν μπορεί να μετρήσει την ανθρώπινη δουλειά που ακολούθησε.
Η ίδια η ευρωπαϊκή νομοθεσία προβλέπει άλλωστε ειδική μεταχείριση για δημοσιεύσεις δημοσίου ενδιαφέροντος όταν έχει μεσολαβήσει ανθρώπινος έλεγχος και υπάρχει συντακτική ευθύνη.
Η Ευρώπη πιέζει για όλο και περισσότερη διαφάνεια
Το νέο μέτρο εντάσσεται σε μια ευρύτερη αλλαγή του τρόπου με τον οποίο η Ευρωπαϊκή Ένωση αντιμετωπίζει τα μεγάλα συστήματα AI.
Το ChatGPT έχει ήδη περάσει σε καθεστώς αυξημένης ευρωπαϊκής εποπτείας, ενώ οι κανόνες του AI Act για τη διαφάνεια του παραγόμενου περιεχομένου τέθηκαν σε εφαρμογή από τις 2 Αυγούστου 2026.
Στον σχετικό ευρωπαϊκό κώδικα έχουν δεσμευθεί να συμμετάσχουν, μεταξύ άλλων, η OpenAI, η Google, η Microsoft, η Meta και η Anthropic.
Η OpenAI έχει ήδη χρησιμοποιήσει διαφορετικές τεχνικές προέλευσης για εικόνες και ήχο. Με το textGrain επιχειρεί τώρα κάτι δυσκολότερο: να αφήσει ένα ίχνος μέσα σε ένα μέσο που αλλάζει πανεύκολα. Γιατί μια εικόνα μπορεί να κουβαλά metadata ή ενσωματωμένο ψηφιακό σήμα. Το κείμενο, όμως, μπορεί να ξαναγραφτεί σε δύο λεπτά. Και αυτή ακριβώς είναι η δυσκολία που κανένα watermark δεν έχει ακόμη λύσει πλήρως.
Διαβάστε τις Ειδήσεις σήμερα και ενημερωθείτε για τα πρόσφατα νέα.
Ακολουθήστε το Skai.gr στο Google News και μάθετε πρώτοι όλες τις ειδήσεις.