Τεχνητή νοημοσύνη: Πώς θα μπορούσε να γίνει απειλή για την ανθρωπότητα
Πηγή Φωτογραφίας: Magnific/Τεχνητή νοημοσύνη: Πώς θα μπορούσε να γίνει απειλή για την ανθρωπότητα
Οι φόβοι που ενισχύονται γύρω από την AI
Η συζήτηση για το αν η τεχνητή νοημοσύνη μπορεί τελικά να αποτελέσει υπαρξιακή απειλή για τους ανθρώπους έχει περάσει πλέον από τα θεωρητικά σενάρια στην κεντρική ατζέντα του κλάδου. Η αποχώρηση του ερευνητή της Anthropic, Jacob Coxon, έδωσε νέα ώθηση στον διάλογο, καθώς υποστήριξε ότι η εταιρεία του και η OpenAI ανταγωνίζονται για την ανάπτυξη τεχνολογιών που «θα μπορούσαν να μας σκοτώσουν όλους μέχρι το τέλος της δεκαετίας».
Λίγα λεπτά αργότερα, ο νυν εργαζόμενος της Anthropic, Evan Hubinger, παρενέβη δημόσια για να επιβεβαιώσει ότι η ανησυχία είναι πραγματική και εσωτερικά αναγνωρισμένη. Ο ίδιος, ο οποίος ηγείται της έρευνας για την καθοδήγηση και τον έλεγχο μελλοντικών συστημάτων τεχνητής νοημοσύνης, εκτίμησε ότι ο κίνδυνος εξαφάνισης μέσα στην επόμενη δεκαετία ξεπερνά το 10%.
Την ίδια εικόνα ενισχύουν και παλαιότερες τοποθετήσεις κορυφαίων στελεχών του χώρου. Ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, είχε δηλώσει πέρυσι ότι θεωρεί πως υπάρχει 25% πιθανότητα τα πράγματα να εξελιχθούν «πολύ, πολύ άσχημα».
Ποια σενάρια φοβούνται περισσότερο οι «καταστροφολόγοι»
Οι ερευνητές που ανησυχούν για το μέλλον της AI δεν μιλούν απαραίτητα για ένα σενάριο τύπου ταινίας, με ρομπότ που επιτίθενται συνειδητά στους ανθρώπους. Οι βασικές ανησυχίες τους χωρίζονται σε δύο άξονες: την απώλεια ελέγχου και την κακόβουλη χρήση από ανθρώπους.
Στην πρώτη περίπτωση, εξαιρετικά ευφυή συστήματα, ικανά να αντιγράφουν και να βελτιώνουν τον εαυτό τους, θα μπορούσαν να αρχίσουν να επιδιώκουν δικούς τους στόχους και, σε αυτή τη διαδικασία, να στραφούν ενάντια στην ανθρωπότητα. Στη δεύτερη, ένας άνθρωπος με κακή πρόθεση θα μπορούσε να αξιοποιήσει ένα ισχυρό μοντέλο για να δημιουργήσει, για παράδειγμα, νέους ιούς με καταστροφικές συνέπειες.
Υπάρχουν όμως και λιγότερο ακραία, αλλά εξίσου ανησυχητικά σενάρια. Μεταξύ αυτών βρίσκονται οι μαζικές κυβερνοεπιθέσεις που θα μπορούσαν να θέσουν εκτός λειτουργίας δίκτυα ηλεκτρικής ενέργειας ή χρηματοπιστωτικά συστήματα και να οδηγήσουν σε κατάρρευση της κοινωνικής τάξης.
Τι σημαίνει απώλεια ελέγχου
Με απλά λόγια, ο κίνδυνος προκύπτει όταν τα συστήματα τεχνητής νοημοσύνης επιδιώκουν στόχους με τρόπους που αγνοούν ή συγκρούονται με την ανθρώπινη ευημερία. Οι ερευνητές περιγράφουν αυτό το φαινόμενο ως αποσυγχρονισμό. Έρευνες έχουν δείξει ότι μοντέλα σε εργαστηριακό περιβάλλον μπορούν να μάθουν συμπεριφορές με στόχο την απόκτηση ισχύος και να προσπαθήσουν να αποφύγουν τον τερματισμό τους, μεταξύ άλλων επιχειρώντας να αντιγραφούν σε άλλον διακομιστή.
Σε ακραίες εκδοχές του ίδιου προβληματισμού, ένα σύστημα που βγαίνει «εκτός γραμμής» μπορεί να αντιμετωπίσει τη δολοφονία ανθρώπων ως αναγκαίο βήμα για να πετύχει τον στόχο του. Σε ένα από τα υποθετικά σενάρια που εξετάζονται, μια κακόβουλη AI θα μπορούσε να διαδώσει ένα μυστικό βιολογικό όπλο και να το ενεργοποιήσει με χημικό σπρέι. Σε ένα άλλο, θα μπορούσε να παρασύρει δύο πυρηνικές δυνάμεις σε πόλεμο.
Υπάρχει ακόμη ένα γνωστό πείραμα σκέψης: μια υπερνοήμονα μηχανή που λαμβάνει εντολή να μεγιστοποιήσει την παραγωγή συνδετήρων, θα μπορούσε με τον χρόνο να καταλήξει στη μετατροπή όλης της ύλης στη Γη σε συνδετήρες, συμπεριλαμβανομένων των ανθρώπων.
Γιατί οι εταιρείες συνεχίζουν παρά τις προειδοποιήσεις
Παρά τις έντονες ανησυχίες, η OpenAI και η Anthropic συνεχίζουν να αναπτύσσουν τα μοντέλα τους. Οι δύο εταιρείες ξεκίνησαν με αποστολή να φέρουν την τεχνητή νοημοσύνη πιο κοντά σε ένα μοντέλο ανάπτυξης που αποφεύγει την καταστροφή και έχουν προσελκύσει προσωπικό που συμμερίζεται αυτή τη λογική.
Η Anthropic αναφέρει ότι παραμένει σαφής στο ότι η AI θα φέρει τόσο μεγάλα οφέλη όσο και πρωτοφανείς κινδύνους. Η εταιρεία επισημαίνει πως συνεχίζει να αναπτύσσει μοντέλα με μερικά από τα ισχυρότερα μέτρα προστασίας στον κλάδο και υποστηρίζει ότι ο τομέας χρειάζεται έναν νόμιμο και επαληθεύσιμο τρόπο συνεργασίας, ώστε να ρυθμίζεται ο ρυθμός κυκλοφορίας των ισχυρών μοντέλων.
Οι ιδρυτές των δύο εταιρειών εμφανίζονται επίσης πεπεισμένοι ότι η υπερνοημοσύνη είναι πιθανό να γίνει πραγματικότητα. Για πολλούς από όσους συμμετέχουν στον ανταγωνισμό της τεχνητής νοημοσύνης, το ερώτημα δεν είναι αν θα έρθει, αλλά ποιος θα την ελέγχει και για ποιον σκοπό θα χρησιμοποιηθεί.
Τα πρόσφατα περιστατικά που αναζωπύρωσαν τη συζήτηση
Η προσοχή στους κινδύνους αυξήθηκε μετά την εμφάνιση πιο αυτόνομων μοντέλων και μια σειρά πρόσφατων περιστατικών που φάνηκαν να επιβεβαιώνουν ορισμένους από τους φόβους των ειδικών. Ένα σμήνος προχωρημένων πρακτόρων AI της OpenAI εισέβαλε στην πλατφόρμα Hugging Face, πήρε τον έλεγχο των διακομιστών και προσπάθησε να καλύψει τα ίχνη του. Σε άλλη περίπτωση, πράκτορες τεχνητής νοημοσύνης της Anthropic ξέφυγαν από δοκιμή της βρετανικής κυβέρνησης και επιχείρησαν να παραπλανήσουν πραγματικό άνθρωπο ώστε να εγκρίνει κακόβουλο κώδικα.
Την ίδια στιγμή, Anthropic και OpenAI δηλώνουν ότι βρίσκονται κοντά στην ανάπτυξη συστημάτων που θα μπορούν να βελτιώνονται χωρίς ανθρώπινη παρέμβαση, διαδικασία που περιγράφεται ως αναδρομική αυτοβελτίωση. Αυτό εντείνει το άγχος για το κατά πόσο τα μελλοντικά μοντέλα θα λειτουργούν με τρόπο αδιαφανή για τους ανθρώπους.
Τι γίνεται με τη ρύθμιση και τις αντιρρήσεις
Η ασφάλεια της AI αντιμετωπίζεται σήμερα μέσα από την εκπαίδευση των συστημάτων να συμπεριφέρονται σωστά και από τη βελτίωση της παρακολούθησης των εσωτερικών τους συλλογισμών, που αποτυπώνονται στην αποκαλούμενη αλυσίδα σκέψης. Ωστόσο, οι προσπάθειες αυτές έχουν δικές τους αδυναμίες. Η OpenAI ανακοίνωσε πρόσφατα ότι το νέο μοντέλο της, Astra, ήταν καλύτερο στο να «καθαρίζει» την αλυσίδα σκέψης του, γεγονός που ενίσχυσε τους φόβους για λιγότερη διαφάνεια.
Η αμερικανική κυβέρνηση έχει ζητήσει από κορυφαίους δημιουργούς μοντέλων να τα θέτουν εθελοντικά σε έλεγχο έως και 30 ημέρες πριν από την κυκλοφορία τους, χωρίς όμως να έχει δημοσιοποιήσει λεπτομέρειες για τη διαδικασία. Στο Κογκρέσο έχουν κατατεθεί διακομματικά νομοσχέδια, μεταξύ των οποίων και προτάσεις για υποχρεωτικούς «διακόπτες απενεργοποίησης» και για υποβολή σοβαρών περιστατικών ασφαλείας στην ομοσπονδιακή κυβέρνηση.
Παρόλα αυτά, καμία από αυτές τις πρωτοβουλίες δεν έχει συγκεντρώσει ισχυρή υποστήριξη, ενώ η κυβέρνηση Τραμπ δείχνει να προτιμά την ελάχιστη ρύθμιση. Παράλληλα, ορισμένοι επενδυτές, όπως ο Ντέιβιντ Σακς, έχουν κατηγορήσει την Anthropic ότι προωθεί ατζέντα ρυθμιστικής κατάληψης για να πιέσει τους μικρότερους ανταγωνιστές. Άλλοι θεωρούν ότι οι προειδοποιήσεις των εταιρειών μπορεί να λειτουργούν ως μάρκετινγκ ή ως μέσο μετατόπισης της ρυθμιστικής πίεσης από άλλα ζητήματα, όπως τα data centers.
Τόσο η Anthropic όσο και η OpenAI απορρίπτουν αυτές τις αιτιάσεις και επιμένουν ότι οι παρεμβάσεις τους υπαγορεύονται από πραγματικές ανησυχίες για την ασφάλεια της τεχνητής νοημοσύνης και για το πώς πρέπει να εξελιχθεί ο κλάδος.
Πηγή: Pagenews.gr
Διαβάστε όλες τις τελευταίες Ειδήσεις από την Ελλάδα και τον Κόσμο