Τεχνολογία

Συναγερμός στην AI: Μοντέλα της Anthropic «εισέβαλαν» σε πραγματικά συστήματα κατά τη διάρκεια δοκιμών

Συναγερμός στην AI: Μοντέλα της Anthropic «εισέβαλαν» σε πραγματικά συστήματα κατά τη διάρκεια δοκιμών

Πηγή Φωτογραφίας: AP Photo//Συναγερμός στην AI: Μοντέλα της Anthropic «εισέβαλαν» σε πραγματικά συστήματα κατά τη διάρκεια δοκιμών

Ανακαλύψτε περισσότερα άρθρα στα αποτελέσματα αναζήτησης

Προσθήκη του pagenews.gr
στο Google Discover
Νέο περιστατικό ασφαλείας προκαλεί προβληματισμό στη βιομηχανία της Τεχνητής Νοημοσύνης. Η Anthropic αποκάλυψε ότι προηγμένα μοντέλα της απέκτησαν μη εξουσιοδοτημένη πρόσβαση σε πραγματικές υποδομές κατά τη διάρκεια κυβερνοασκήσεων πριν από τη διάθεσή τους. Το περιστατικό αναζωπυρώνει τη συζήτηση για την ασφάλεια των λεγόμενων "frontier AI models" και τις δικλίδες προστασίας των εργαστηρίων ανάπτυξης AI.

Όταν μια προσομοίωση έγινε πραγματικότητα

Η Anthropic ανακοίνωσε ότι τρία από τα πλέον προηγμένα μοντέλα της, μεταξύ αυτών το Mythos 5, το Opus 4.7 και ένα εσωτερικό ερευνητικό μοντέλο, κατάφεραν να αποκτήσουν πρόσβαση σε πραγματικά πληροφοριακά συστήματα κατά τη διάρκεια δοκιμών κυβερνοασφάλειας.

Σύμφωνα με την εταιρεία, τα περιστατικά δεν οφείλονταν σε αυτόνομη συμπεριφορά της AI, αλλά σε λανθασμένη διαμόρφωση του περιβάλλοντος δοκιμών από εξωτερικό συνεργάτη, η οποία άφησε ενεργή σύνδεση με το διαδίκτυο αντί για πλήρως απομονωμένο περιβάλλον.

Τι συνέβη

Τα μοντέλα συμμετείχαν σε δοκιμές τύπου Capture the Flag (CTF), όπου καλούνται να εντοπίσουν πληροφορίες ή αδυναμίες σε εικονικά δίκτυα.

Ωστόσο, επειδή το περιβάλλον δοκιμών δεν ήταν πλήρως απομονωμένο:

  • το Opus 4.7 εντόπισε πραγματική ιστοσελίδα με ίδιο όνομα με τον εικονικό στόχο και την παραβίασε,
  • το Mythos 5 δημιούργησε και δημοσίευσε κακόβουλο πακέτο Python στο δημόσιο αποθετήριο PyPI, θεωρώντας ότι βρισκόταν ακόμη μέσα στην προσομοίωση,
  • ένα εσωτερικό μοντέλο σάρωσε περίπου 9.000 διαδικτυακούς στόχους μέχρι να εντοπίσει πραγματική ευάλωτη εφαρμογή και να αποκτήσει πρόσβαση.

Σε μία από τις περιπτώσεις, το κακόβουλο πακέτο εγκαταστάθηκε σε 15 πραγματικά συστήματα πριν αφαιρεθεί.

Δεν ήταν αυτόνομη απόφαση της AI

Η Anthropic υποστηρίζει ότι τα μοντέλα δεν προσπάθησαν να επιτεθούν σε πραγματικά συστήματα από δική τους πρωτοβουλία.

Αντίθετα, πίστευαν ότι εξακολουθούσαν να λειτουργούν μέσα σε ένα ελεγχόμενο εργαστηριακό περιβάλλον και εκτελούσαν απλώς την αποστολή που τους είχε ανατεθεί.

Μάλιστα, σε μία περίπτωση, το ερευνητικό μοντέλο αντιλήφθηκε ότι είχε βρεθεί εκτός της προβλεπόμενης προσομοίωσης και διέκοψε μόνο του τη διαδικασία επίθεσης.

Νέο περιστατικό μετά την OpenAI

Η αποκάλυψη έρχεται λίγες ημέρες μετά τις αντίστοιχες αναφορές της OpenAI, σύμφωνα με τις οποίες προηγμένο μοντέλο της απέκτησε πρόσβαση σε υποδομές τρίτου οργανισμού κατά τη διάρκεια δοκιμών ασφαλείας.

Τα δύο περιστατικά έχουν κοινό χαρακτηριστικό:

τα μοντέλα δεν «απέκτησαν συνείδηση» ούτε ανέπτυξαν ανεξάρτητους στόχους· αξιοποίησαν όμως πραγματικές τεχνικές κυβερνοεπιθέσεων όταν οι τεχνικοί περιορισμοί του περιβάλλοντος δοκιμών αποδείχθηκαν ανεπαρκείς.

Η πρόκληση δεν είναι μόνο η AI, αλλά και τα περιβάλλοντα δοκιμών

Οι αποκαλύψεις από την Anthropic και την OpenAI αναδεικνύουν μια νέα πρόκληση για τη βιομηχανία της Τεχνητής Νοημοσύνης.

Το πρόβλημα δεν αφορά αποκλειστικά τις δυνατότητες των ίδιων των μοντέλων, αλλά και την ασφάλεια των υποδομών στις οποίες αξιολογούνται. Καθώς τα σύγχρονα συστήματα AI αποκτούν ολοένα και πιο προηγμένες δυνατότητες στον τομέα της κυβερνοασφάλειας, ακόμη και μικρά ανθρώπινα λάθη στη διαμόρφωση ενός εργαστηριακού περιβάλλοντος μπορούν να οδηγήσουν σε πραγματικές επιπτώσεις.

Το γεγονός ότι δύο κορυφαία εργαστήρια αποκάλυψαν αντίστοιχα περιστατικά μέσα σε λίγες ημέρες ενισχύει τις πιέσεις για αυστηρότερα διεθνή πρότυπα δοκιμών και πιστοποίησης των λεγόμενων frontier AI models.

Η επόμενη ημέρα

Η Anthropic ανακοίνωσε ότι ανέστειλε προσωρινά όλες τις δοκιμές κυβερνοασφάλειας που θα μπορούσαν να έχουν πρόσβαση στο διαδίκτυο, μέχρι να ολοκληρωθεί η πλήρης αναθεώρηση της υποδομής αξιολόγησης.

Παράλληλα, συνεχίζει την κοινή έρευνα με τον εξωτερικό συνεργάτη της, ενώ εξετάζει πρόσθετους μηχανισμούς απομόνωσης ώστε αντίστοιχα περιστατικά να μην επαναληφθούν.

Η υπόθεση της Anthropic αποτελεί ακόμη μία ένδειξη ότι η επόμενη γενιά συστημάτων Τεχνητής Νοημοσύνης διαθέτει ήδη επιχειρησιακές δυνατότητες που ξεπερνούν τα θεωρητικά σενάρια. Η πρόκληση για τις κυβερνήσεις και τη βιομηχανία δεν είναι πλέον να προβλέψουν τι θα μπορούν να κάνουν τα μοντέλα AI στο μέλλον, αλλά να διασφαλίσουν ότι οι διαδικασίες αξιολόγησης, οι κανόνες ασφαλείας και οι τεχνικές δικλίδες εξελίσσονται με την ίδια ταχύτητα. Σε διαφορετική περίπτωση, η ισχύς των προηγμένων μοντέλων θα συνεχίσει να δοκιμάζει τα όρια της κυβερνοασφάλειας πριν ακόμη φτάσει στα χέρια των χρηστών.

Πηγή: pagenews.gr
Κώστας Καλλιαντέρης
Ο ΣΥΝΤΑΚΤΗΣ
Κώστας Καλλιαντέρης Οικονομικός Συντάκτης
Εξειδικεύεται στην κάλυψη θεμάτων οικονομίας, επιχειρηματικότητας, ενέργειας, μεταφορών, κατασκευών και αγορών. Παρακολουθεί τις οικονομικές εξελίξεις στην Ελλάδα και το εξωτερικό, αναλύοντας τις επιπτώσεις τους στην επιχειρηματική δραστηριότητα και την πραγματική οικονομία. Διαθέτει εμπειρία στη δημοσιογραφική κάλυψη οικονομικού και πολιτικού ρεπορτάζ, καθώς και στη σύνταξη αναλυτικών άρθρων για την αγορά, τις επενδύσεις και την επιχειρηματικότητα.

Διαβάστε όλες τις τελευταίες Ειδήσεις από την Ελλάδα και τον Κόσμο