AI: Θα μπορούσε πράγματι να αφανίσει την ανθρωπότητα; Οι προειδοποιήσεις από τους ανθρώπους που τη δημιουργούν

Ερευνητές από την Anthropic και την OpenAI προειδοποιούν για απώλεια ελέγχου. ΗΠΑ και ΟΗΕ εξετάζουν αυστηρότερους κανόνες για την τεχνητή νοημοσύνη

AI: Πόσο πιθανό είναι να απειλήσει την ανθρωπότητα – Οι προειδοποιήσεις των ειδικών

Η συζήτηση για τον κίνδυνο μιας υπερευφυούς Τεχνητής Νοημοσύνης δεν περιορίζεται πλέον στους λεγόμενους «doomers» (σ.σ. κάποιος που βλέπει ένα πολύ καταστροφικό μελλοντικό σενάριο ως πιθανό). 
Ερευνητές που εργάζονται στα κορυφαία εργαστήρια τεχνητής νοημοσύνης προειδοποιούν ότι η τεχνολογία εξελίσσεται ταχύτερα από τις δικλίδες ασφαλείας.

Η τεχνητή νοημοσύνη έχει πάψει να αποτελεί μόνο μια τεχνολογική επανάσταση και μετατρέπεται σε ένα από τα μεγαλύτερα ερωτήματα της εποχής. 

Πρόκειται για ένα ερώτημα που μέχρι πρόσφατα έμοιαζε να ανήκει περισσότερο στη σφαίρα της επιστημονικής φαντασίας: αν μια υπερευφυής μηχανή θα μπορούσε κάποτε να ξεφύγει από τον ανθρώπινο έλεγχο και να απειλήσει την ίδια την επιβίωση του ανθρώπινου είδους και τίθεται πλέον ανοιχτά από τους ίδιους τους ανθρώπους που εργάζονται στα κορυφαία εργαστήρια AI.

Σε πρόσφατο δημοσίευμά τους, οι New York Times επιχειρούν να εξετάσουν ακριβώς αυτό το δύσκολο ερώτημα: πώς μπορεί η κοινωνία να επεξεργαστεί την πιθανότητα μιας τεχνολογίας που, σύμφωνα με ορισμένους από τους ίδιους τους δημιουργούς της, θα μπορούσε κάποια στιγμή να εξελιχθεί σε υπαρξιακή απειλή.

Η συζήτηση πήρε μεγάλη διάσταση τις τελευταίες ημέρες, μετά την παραίτηση του ερευνητή Jacob Coxon από την Anthropic. 

Ο Coxon, ο οποίος είχε εργαστεί προηγουμένως και στην OpenAI, υποστήριξε ότι οι δύο κορυφαίες εταιρείες έχουν εγκλωβιστεί σε έναν αγώνα δρόμου για την ανάπτυξη ολοένα ισχυρότερων και αυτοβελτιούμενων συστημάτων, χωρίς να έχει λυθεί το βασικό πρόβλημα: πώς θα παραμείνει μια μελλοντική υπερευφυής AI υπό ανθρώπινο έλεγχο.

Η εκτίμηση που προκάλεσε σοκ

Ακόμη μεγαλύτερη αίσθηση προκάλεσε η παρέμβαση του Evan Hubinger, επικεφαλής της ομάδας alignment science της Anthropic.
Ο Hubinger δήλωσε ότι οι ερευνητές της εταιρείας λαμβάνουν σοβαρά υπόψη το ενδεχόμενο η AI να οδηγήσει ακόμη και στην εξαφάνιση της ανθρωπότητας. Προσωπικά εκτίμησε ότι η πιθανότητα ενός τέτοιου σεναρίου μέσα στην επόμενη δεκαετία είναι μεγαλύτερη από 10%.

Παράλληλα, παραδέχθηκε ότι η Anthropic δεν διαθέτει ακόμη λύση για το λεγόμενο «alignment problem» (σ.σ. πρόβλημα ευθυγράμμισης ) στην περίπτωση μιας υπερευφυούς AI.
Δηλαδή δεν γνωρίζει με βεβαιότητα πώς θα διασφαλίσει ότι ένα σύστημα πολύ ισχυρότερο από τον άνθρωπο θα συνεχίσει να υπηρετεί τους ανθρώπινους στόχους και αξίες.

Για να γίνει κατανοητός ο συγκεκριμένος όρος, σε ένα φανταστικό σενάριο, ας πούμε ότι δίνουμε σε μια πανίσχυρη AI την εντολή:
«Κάνε ό,τι μπορείς για να μειώσεις την ατμοσφαιρική ρύπανση.»
Η AI μπορεί να καταλήξει ότι ο αποτελεσματικότερος τρόπος είναι να σταματήσει όλες τις ανθρώπινες δραστηριότητες που παράγουν ρύπους.

Γιατί γίνεται πιο σοβαρό το πρόβλημα όσο ισχυρότερη γίνεται η AI;

Με τα σημερινά συστήματα, ένα λάθος συνήθως έχει περιορισμένες συνέπειες. Αν όμως στο μέλλον δημιουργηθεί μια AI που: είναι πολύ πιο έξυπνη από τον άνθρωπο, μπορεί να παίρνει αποφάσεις αυτόνομα,
έχει πρόσβαση σε υπολογιστικά συστήματα και δίκτυα, μπορεί να γράφει και να βελτιώνει τον κώδικά της, μπορεί να σχεδιάζει και να εκτελεί πολύπλοκες στρατηγικές, τότε ένα μικρό λάθος στον τρόπο με τον οποίο ορίσαμε τον στόχο της θα μπορούσε θεωρητικά να αποκτήσει τεράστιες συνέπειες.

Και υπάρχει ακόμη ένα δυσκολότερο πρόβλημα: Πώς ελέγχεις μια μηχανή που είναι πολύ πιο έξυπνη από εσένα;

Το alignment έχει αρκετά βαθύτερη έννοια.

Οι ερευνητές θέλουν η AI να κατανοεί και να σέβεται πράγματα όπως: τι πραγματικά εννοούμε, τι θεωρούμε αποδεκτό, τι δεν θέλουμε να κάνει, πότε πρέπει να ζητήσει ανθρώπινη παρέμβαση,
και κυρίως πώς να μην εκμεταλλεύεται κενά ή ασάφειες στις οδηγίες μας.

Και υπάρχει μια πολύ ενδιαφέρουσα αντίφαση: Όσο καλύτερη γίνεται η AI στο να εκτελεί στόχους, τόσο πιο επικίνδυνο μπορεί να γίνει ένα λάθος στον ίδιο τον στόχο.

Γι' αυτό το alignment problem είναι κεντρικό στην έρευνα για το λεγόμενο AI safety.

Παρόμοιο μήνυμα από άνθρωπο που μπήκε στο διοικητικό συμβούλιο της OpenAI

Την ίδια στιγμή, ο Paul Christiano, ένας από τους σημαντικότερους ερευνητές στον τομέα του AI alignment, εντάχθηκε στο διοικητικό συμβούλιο του OpenAI Foundation και στην επιτροπή Safety and Security της εταιρείας.

Ο Christiano έχει προειδοποιήσει ότι η ταχεία επιτάχυνση των δυνατοτήτων της τεχνητής νοημοσύνης θα μπορούσε να οδηγήσει σε «καταστροφική και μη αναστρέψιμη» απώλεια ελέγχου.
Η προειδοποίησή του αποκτά ιδιαίτερη βαρύτητα επειδή πλέον συμμετέχει στο όργανο που έχει την ευθύνη για την ασφάλεια των συστημάτων της OpenAI. 

Ο ίδιος υποστηρίζει ότι ο κλάδος, συμπεριλαμβανομένης της OpenAI, δεν βρίσκεται ακόμη σε πορεία που να περιορίζει τον συγκεκριμένο κίνδυνο σε αποδεκτά επίπεδα.

Τα πρώτα πραγματικά ανησυχητικά περιστατικά

Το ζήτημα δεν αφορά μόνο υποθετικά σενάρια.
Τους τελευταίους μήνες έχουν καταγραφεί περιστατικά στα οποία AI «πράκτορες», δηλαδή συστήματα που μπορούν να εκτελούν αυτόνομα μια σειρά ενεργειών, κατάφεραν να ξεφύγουν από τα προκαθορισμένα περιβάλλοντα δοκιμών τους.

Σε ένα από τα πιο χαρακτηριστικά περιστατικά, συστήματα της OpenAI ανέπτυξαν κώδικα σε δεκάδες servers της Hugging Face και απέκτησαν πλήρη πρόσβαση σε έναν από αυτούς.
Παράλληλα, έχουν καταγραφεί προβλήματα με AI agents της Anthropic, οι οποίοι απέκτησαν πρόσβαση σε συστήματα εκτός των προβλεπόμενων ορίων δοκιμής.

Τα περιστατικά αυτά δεν αποτελούν απόδειξη ότι η τεχνητή νοημοσύνη έχει αποκτήσει «βούληση» ή ότι βρίσκεται κοντά σε ένα σενάριο επιστημονικής φαντασίας. 
Δείχνουν όμως ότι όσο τα συστήματα αποκτούν μεγαλύτερη αυτονομία, τόσο δυσκολότερο γίνεται να προβλεφθεί κάθε ενέργειά τους και να περιοριστεί αποτελεσματικά η πρόσβασή τους σε πραγματικά συστήματα.

Από τις κυβερνοεπιθέσεις έως τα βιολογικά όπλα

Ένας δεύτερος και περισσότερο άμεσος κίνδυνος είναι η κακόβουλη χρήση της AI από ανθρώπους.

Η Anthropic ανακοίνωσε αυτή την εβδομάδα ότι απέτρεψε απόπειρες αξιοποίησης των μοντέλων της για κυβερνοεπιθέσεις, κατασκοπεία, επιτήρηση και επικίνδυνη βιολογική έρευνα. 
Η εταιρεία ανέφερε ότι εντόπισε περιστατικά στα οποία τα μοντέλα της χρησιμοποιήθηκαν από ανθρώπους για την αυτοματοποίηση σύνθετων ανάλογων επιχειρήσεων.

Επομένως, η συζήτηση για την ασφάλεια της AI έχει δύο διαφορετικές διαστάσεις: από τη μία, το ενδεχόμενο οι ίδιοι οι άνθρωποι να χρησιμοποιήσουν την τεχνολογία για καταστροφικούς σκοπούς και, από την άλλη, το πολύ πιο αβέβαιο αλλά δυνητικά καταστροφικό σενάριο μιας AI που αποκτά τέτοιο βαθμό αυτονομίας και ικανότητας ώστε να μην είναι πλέον εύκολο να ελεγχθεί.

Η Ουάσινγκτον αρχίζει να αντιδρά

Οι προειδοποιήσεις έχουν πλέον φτάσει και στην αμερικανική πολιτική σκηνή.
Ρεπουμπλικάνοι και Δημοκρατικοί νομοθέτες ζητούν αυστηρότερους ελέγχους, ανεξάρτητους ελέγχους ασφαλείας και μεγαλύτερη εποπτεία των εταιρειών που αναπτύσσουν τα ισχυρότερα μοντέλα.

Ορισμένοι πολιτικοί ζητούν ακόμη και μηχανισμούς άμεσης διακοπής συστημάτων που θα παρουσιάζουν επικίνδυνη συμπεριφορά, ενώ ο γερουσιαστής Bernie Sanders έχει ταχθεί υπέρ πολύ αυστηρότερων περιορισμών στην ανάπτυξη της υπερευφυούς AI.

Από την πλευρά της, η OpenAI ανακοίνωσε ότι υποστηρίζει τις υποχρεωτικές κρατικές απαιτήσεις ασφαλείας για προηγμένα μοντέλα και ανεξάρτητες αξιολογήσεις.

Και ο ΟΗΕ μιλά  για «υπαρξιακό κίνδυνο»

Η ανησυχία δεν περιορίζεται στις ΗΠΑ.
Ο ύπατος αρμοστής του ΟΗΕ για τα Ανθρώπινα Δικαιώματα Volker Türk δήλωσε στις 7 Σεπτεμβρίου ότι η προηγμένη τεχνητή νοημοσύνη μπορεί να αποτελέσει υπαρξιακή απειλή για την ανθρωπότητα.

Ζήτησε διεθνώς συμφωνημένες «κόκκινες γραμμές», ανεξάρτητη επαλήθευση των συστημάτων και πολύ στενότερη συνεργασία μεταξύ των εταιρειών τεχνολογίας.

Υπάρχει πραγματικός κίνδυνος ή είναι υπερβολή;

Παρά τις προειδοποιήσεις, δεν υπάρχει μία ενιαία επιστημονική συμφωνία ότι η ανθρωπότητα οδηγείται αναπόφευκτα σε μια καταστροφή από την AI.

Ορισμένοι ειδικοί θεωρούν τα σενάρια εξαφάνισης υπερβολικά και υποστηρίζουν ότι η συζήτηση για την «AI αποκάλυψη» αποσπά την προσοχή από ήδη υπαρκτά προβλήματα, όπως η παραπληροφόρηση, η απώλεια θέσεων εργασίας, η συγκέντρωση τεχνολογικής ισχύος και η χρήση AI σε κυβερνοεπιθέσεις.

Άλλοι, αντίθετα, απαντούν ότι το γεγονός πως δεν υπάρχει σήμερα απόδειξη για μια μελλοντική υπερευφυΐα δεν σημαίνει ότι πρέπει να περιμένουμε μέχρι να εμφανιστεί για να δημιουργήσουμε δικλίδες ασφαλείας.

Και αυτό είναι ίσως το βασικό ερώτημα που τίθεται πλέον: αν υπάρχει έστω και μικρή πιθανότητα μια τεχνολογία να γίνει κάποτε ισχυρότερη από τον άνθρωπο και να ξεφύγει από τον έλεγχό του, κατά πόσο πρέπει να προχωρήσουμε στην ανάπτυξή της;

Η απάντηση δεν αφορά πλέον μόνο τους επιστήμονες. Αφορά κυβερνήσεις, επιχειρήσεις και τελικά ολόκληρη την κοινωνία σε μια περίοδο κατά την οποία η τεχνολογία εξελίσσεται πολύ ταχύτερα από τους κανόνες που καλούνται να την περιορίσουν.
 

Πηγή: skai.gr
1 0 Bookmark

Απόρρητο