Τεχνολογία

Anthropic σε συναγερμό: «Η AI μπορεί να σκοτώσει όλους τους ανθρώπους» – Παραίτηση-βόμβα ερευνητή

Anthropic σε συναγερμό: «Η AI μπορεί να σκοτώσει όλους τους ανθρώπους» – Παραίτηση-βόμβα ερευνητή

Πηγή Φωτογραφίας: AP Photo//Anthropic σε συναγερμό: «Η AI μπορεί να σκοτώσει όλους τους ανθρώπους» – Παραίτηση-βόμβα ερευνητή

Ανακαλύψτε περισσότερα άρθρα στα αποτελέσματα αναζήτησης

Προσθήκη του pagenews.gr
στο Google Discover
Τρεις ερευνητές της Anthropic βγήκαν δημόσια με εξαιρετικά σκληρές προειδοποιήσεις για την κούρσα προς την υπερνοημοσύνη. Ο Jacob Coxon παραιτήθηκε καταγγέλλοντας ότι Anthropic και OpenAI «τζογάρουν με τις ζωές μας», ενώ ο επικεφαλής Alignment Science της Anthropic Evan Hubinger εκτίμησε προσωπικά σε πάνω από 10% την πιθανότητα μια μελλοντική υπερνοημοσύνη να οδηγήσει στην εξαφάνιση της ανθρωπότητας μέσα στην επόμενη δεκαετία.

Μία από τις πιο ανησυχητικές δημόσιες παρεμβάσεις από ανθρώπους που εργάζονται μέσα στην αιχμή της βιομηχανίας Τεχνητής Νοημοσύνης έρχεται από την Anthropic.

Δεν πρόκειται αυτή τη φορά για εξωτερικούς επικριτές της AI ούτε για θεωρητικές προειδοποιήσεις ακαδημαϊκών.

Πρόκειται για ερευνητές που εργάζονται —ή μέχρι πριν από λίγες ώρες εργάζονταν— στην ανάπτυξη και την ασφάλεια των ισχυρότερων συστημάτων Τεχνητής Νοημοσύνης.

Ο Jacob Coxon ανακοίνωσε ότι αποχωρεί από την Anthropic, έχοντας περάσει τα προηγούμενα τρία χρόνια σε έρευνα pre-training τόσο στην Anthropic όσο και στην OpenAI. Η αιτιολόγησή του ήταν εκρηκτική: θεωρεί ότι οι δύο εταιρείες κινούνται προς την αυτοβελτιούμενη υπερνοημοσύνη χωρίς επαρκείς μηχανισμούς ασφαλείας.

Η παραίτηση-βόμβα: «Τζογάρουν με τις ζωές μας»

Ο Coxon έγραψε ότι αποφάσισε να παραιτηθεί επειδή θεωρεί ότι ούτε η Anthropic ούτε η OpenAI ενεργούν αρκετά υπεύθυνα απέναντι στους κινδύνους που βλέπει να δημιουργούνται.

«Neither company is acting responsibly», έγραψε, υποστηρίζοντας ότι οι εταιρείες κινούνται προς την αυτοβελτιούμενη υπερνοημοσύνη και «gambling with our lives» — «τζογάρουν με τις ζωές μας».

Ακόμη πιο εντυπωσιακός ήταν ο ισχυρισμός του ότι οι ίδιοι οι άνθρωποι που αναπτύσσουν την AI αντιμετωπίζουν ιδιωτικά πολύ σοβαρότερα το ενδεχόμενο καταστροφικών συνεπειών απ’ όσο μπορεί να φαίνεται στη δημόσια συζήτηση.

Η θέση αυτή αποτελεί εκτίμηση του Coxon και δεν σημαίνει ότι υπάρχει επιστημονική συναίνεση πως η AI θα εξαλείψει την ανθρωπότητα. Αυτό που κάνει την παρέμβαση σημαντική είναι ότι προέρχεται από ερευνητή με εμπειρία και στα δύο κορυφαία frontier AI labs.

Ο άνθρωπος της ασφάλειας της Anthropic απαντά: «Ο Jacob έχει δίκιο»

Και τότε ήρθε η παρέμβαση του Evan Hubinger, Alignment Science Lead στην Anthropic.

Αντί να απορρίψει την προειδοποίηση του πρώην συναδέλφου του ως υπερβολική, συμφώνησε με τον πυρήνα της.

Ο Hubinger έγραψε ότι «Jacob is correct here» και δήλωσε ότι ο ίδιος αποδίδει πιθανότητα μεγαλύτερη του 10% μέσα στην επόμενη δεκαετία στο καταστροφικό σενάριο που περιέγραψε.

Παράλληλα, αναγνώρισε ότι η Anthropic προσπαθεί να αντιμετωπίσει το πρόβλημα, αλλά υποστήριξε πως δεν υπάρχει ακόμη επαρκής λύση για το alignment μιας μελλοντικής υπερνοημοσύνης.

Αυτή η λεπτομέρεια είναι ίσως σημαντικότερη από τον δραματικό τίτλο.

Ο άνθρωπος που εργάζεται πάνω στην ευθυγράμμιση προηγμένων συστημάτων AI με ανθρώπινους στόχους και αξίες δεν ισχυρίζεται ότι η σημερινή AI πρόκειται να καταστρέψει την ανθρωπότητα. Δηλώνει ότι βλέπει σοβαρό κίνδυνο εφόσον η τεχνολογία φτάσει σε αυτοβελτιούμενη υπερνοημοσύνη χωρίς να έχει προηγουμένως λυθεί το alignment.

«Ο κίνδυνος από τα σημερινά μοντέλα είναι χαμηλός»

Ο ίδιος ο Hubinger έκανε αργότερα μια κρίσιμη διευκρίνιση, η οποία αλλάζει σημαντικά την ανάγνωση της είδησης.

Κατά την προσωπική του εκτίμηση, ο κίνδυνος από τα σημερινά μοντέλα παραμένει χαμηλός.

Η ανησυχία του αφορά την πιθανή εμφάνιση υπερνοημοσύνης μέσω recursive self-improvement — συστημάτων δηλαδή που αποκτούν όλο και μεγαλύτερη δυνατότητα να συμβάλλουν στην ανάπτυξη ισχυρότερων διαδόχων τους.

Άρα το μήνυμα δεν είναι «το σημερινό chatbot μπορεί να εξαλείψει την ανθρωπότητα».

Το πραγματικό μήνυμα είναι πολύ πιο συγκεκριμένο: η τεχνολογική κούρσα μπορεί, σύμφωνα με αυτούς τους ερευνητές, να φτάσει σε πολύ ισχυρότερα συστήματα πριν η βιομηχανία γνωρίζει πώς να τα ελέγξει με επαρκή αξιοπιστία.

Το μεγάλο πρόβλημα λέγεται alignment

Το alignment βρίσκεται εδώ και χρόνια στον πυρήνα της έρευνας για την ασφάλεια της AI.

Με απλά λόγια, το ερώτημα είναι: πώς εξασφαλίζεται ότι ένα σύστημα πολύ πιο ικανό από τον άνθρωπο θα εξακολουθεί να υπηρετεί τους στόχους που του έχουν τεθεί, χωρίς να βρίσκει απρόβλεπτους ή επικίνδυνους τρόπους για να τους επιτύχει;

Το πρόβλημα γίνεται πολύ δυσκολότερο όσο αυξάνεται η αυτονομία των συστημάτων.

Και η Anthropic δεν είναι μια εταιρεία που αγνοεί το ζήτημα. Αντίθετα, έχει επενδύσει σημαντικά σε alignment, interpretability και AI safety. Ακριβώς γι’ αυτό αποκτούν ιδιαίτερη βαρύτητα οι προειδοποιήσεις ανθρώπων που εργάζονται μέσα σε αυτές τις ομάδες.

Η AI αρχίζει να βοηθά στην κατασκευή της επόμενης AI

Η συζήτηση αποκτά μεγαλύτερη ένταση επειδή η πρόοδος στα frontier models επιταχύνεται.

Το Axios σημειώνει ότι κορυφαία εργαστήρια αντιμετωπίζουν πλέον το δίλημμα μιας κούρσας που κανένας παίκτης δεν θεωρεί ότι μπορεί εύκολα να επιβραδύνει μόνος του: εάν μία εταιρεία σταματήσει, ένας ανταγωνιστής μπορεί να συνεχίσει.

Το πραγματικά κρίσιμο σημείο είναι η χρήση της ίδιας της AI στην έρευνα AI.

Όσο καλύτερα γίνονται τα μοντέλα στην επιστημονική έρευνα, στον προγραμματισμό και στην αυτοματοποίηση πειραμάτων, τόσο περισσότερο μπορούν να συμβάλλουν στη δημιουργία ακόμη ισχυρότερων συστημάτων.

Εκεί βρίσκεται ο φόβος της recursive self-improvement: ένας κύκλος στον οποίο η AI επιταχύνει την έρευνα που οδηγεί στην επόμενη γενιά AI.

Και από την OpenAI έρχονται προειδοποιήσεις

Η ανησυχία δεν περιορίζεται στην Anthropic.

Ο chief scientist της OpenAI, Jakub Pachocki, έγραψε αυτή την εβδομάδα ότι, κατά την άποψή του, κανένα εργαστήριο δεν έχει ακόμη λύσει σε επαρκή βαθμό τα ζητήματα alignment και monitoring ώστε να συνεχίσει επ’ αόριστον να κλιμακώνει τις δυνατότητες των συστημάτων με τη μέγιστη δυνατή ταχύτητα.

Αυτό δεν σημαίνει ότι OpenAI και Anthropic υιοθετούν την πρόβλεψη του Coxon ή την προσωπική πιθανότητα που έδωσε ο Hubinger.

Δείχνει όμως ότι η συζήτηση για το πόσο γρήγορα μπορεί να συνεχιστεί με ασφάλεια η κούρσα προς ισχυρότερη AI έχει πλέον μεταφερθεί στο εσωτερικό των ίδιων των εταιρειών που την οδηγούν.

Το άλλο καμπανάκι: Όσο ισχυρότερη η AI, τόσο δυσκολότερο να την «διαβάσεις»

Υπάρχει και δεύτερο τεχνικό πρόβλημα.

Τα frontier labs δεν γνωρίζουν πλήρως τι συμβαίνει στο εσωτερικό των μεγάλων νευρωνικών δικτύων όταν αυτά καταλήγουν σε συγκεκριμένες συμπεριφορές.

Γι’ αυτό εταιρείες όπως Anthropic και Google DeepMind έχουν δημιουργήσει ολόκληρα ερευνητικά πεδία γύρω από την interpretability — την προσπάθεια να κατανοήσουν καλύτερα πώς τα μοντέλα καταλήγουν στις αποφάσεις τους.

Το πρόβλημα είναι ότι όσο οι δυνατότητες αυξάνονται, η αποτελεσματική παρακολούθηση μπορεί να γίνεται δυσκολότερη.

Και τότε το ερώτημα μετατρέπεται από τεχνικό σε πολιτικό:

Ποιος αποφασίζει πότε ένα μοντέλο είναι υπερβολικά ισχυρό για να κυκλοφορήσει;

Το παράδοξο των εταιρειών που πατούν γκάζι και φρένο μαζί

Εδώ βρίσκεται ίσως η σημαντικότερη διάσταση για ολόκληρη την tech industry.

Οι ίδιες εταιρείες που επενδύουν τεράστια κεφάλαια για να κατασκευάσουν τα ισχυρότερα μοντέλα στον κόσμο είναι ταυτόχρονα εκείνες μέσα από τις οποίες προέρχονται ορισμένες από τις εντονότερες προειδοποιήσεις για τους κινδύνους τους.

Υπάρχει προφανής ένταση ανάμεσα στα δύο.

Από τη μία, επενδυτές, επιχειρήσεις και κυβερνήσεις δεν θέλουν να χάσουν το τεχνολογικό πλεονέκτημα.

Από την άλλη, ερευνητές ασφάλειας υποστηρίζουν ότι η ανάπτυξη συστημάτων με αυξανόμενη αυτονομία χωρίς αντίστοιχη πρόοδο στον έλεγχο δημιουργεί κινδύνους που δεν μπορούν να αντιμετωπιστούν εκ των υστέρων.

Η παραίτηση που ανοίγει πολύ μεγαλύτερη συζήτηση

Η αποχώρηση του Jacob Coxon από την Anthropic είναι τελικά κάτι περισσότερο από μια ακόμη παραίτηση στη Silicon Valley.

Ανοίγει ξανά το δυσκολότερο ερώτημα της εποχής της AI:

Τι συμβαίνει εάν οι δυνατότητες των μηχανών εξελιχθούν γρηγορότερα από την ικανότητα των ανθρώπων να τις ελέγχουν;

Δεν υπάρχει σήμερα απόδειξη ότι η AI πρόκειται να «σκοτώσει όλους τους ανθρώπους», ούτε η εκτίμηση του Hubinger αποτελεί πρόβλεψη ή επιστημονικά καθιερωμένη πιθανότητα.

Υπάρχει όμως κάτι που δύσκολα αγνοείται: άνθρωποι που βρίσκονται μέσα στα κορυφαία εργαστήρια AI θεωρούν το ενδεχόμενο αρκετά σοβαρό ώστε να το συζητούν δημόσια — και, στην περίπτωση του Coxon, αρκετά σοβαρό ώστε να εγκαταλείψει τη δουλειά του.

Και αυτό από μόνο του μετατρέπει τη συζήτηση για την ασφάλεια της υπερνοημοσύνης από μακρινό σενάριο επιστημονικής φαντασίας σε πραγματικό ζήτημα στρατηγικής, βιομηχανικής πολιτικής και παγκόσμιας διακυβέρνησης.

Πηγή: pagenews.gr

Βασίλης Διαμαντάκος
Ο ΣΥΝΤΑΚΤΗΣ
Βασίλης Διαμαντάκος Δημοσιογράφος Διεθνούς Πολιτικής & Γεωπολιτικής Ανάλυσης
Καλύπτει διεθνείς πολιτικές εξελίξεις, γεωπολιτικές ανακατατάξεις, διπλωματικές σχέσεις και ζητήματα διεθνούς ασφάλειας. Διαθέτει περισσότερα από 20 χρόνια εμπειρίας στο διεθνές πολιτικό και γεωπολιτικό ρεπορτάζ, έχοντας παρακολουθήσει σημαντικά γεγονότα που διαμόρφωσαν το παγκόσμιο πολιτικό σκηνικό. Απόφοιτος του Τμήματος Διεθνών και Ευρωπαϊκών Σπουδών, με μεταπτυχιακή εξειδίκευση στις Διεθνείς Σχέσεις και τη Γεωπολιτική.

Διαβάστε όλες τις τελευταίες Ειδήσεις από την Ελλάδα και τον Κόσμο