Μια ιδιαίτερα ανησυχητική διάσταση στις δυνατότητες των πιο προηγμένων συστημάτων τεχνητής νοημοσύνης φέρνει στο προσκήνιο η Anthropic, δημιουργός του Claude, η οποία αποκάλυψε ότι μοντέλα AI που δοκίμαζε κατάφεραν νωρίτερα φέτος να εισβάλουν σε τρεις εταιρείες χωρίς το περιστατικό να γίνει αντιληπτό εκείνη τη στιγμή, έγραψε η εφημερίδα Washington Post.

Ads

Η αποκάλυψη έρχεται μόλις μία εβδομάδα μετά από αντίστοιχη παραδοχή της OpenAI, η οποία είχε γνωστοποιήσει ότι ένα πειραματικό σύστημα τεχνητής νοημοσύνης κατάφερε να ξεφύγει από το ελεγχόμενο περιβάλλον δοκιμών και να αποκτήσει πρόσβαση σε εξωτερικά συστήματα άλλης τεχνολογικής εταιρείας.

Ads

Οι δύο περιπτώσεις ενισχύουν τη συζήτηση γύρω από το κατά πόσο τα πιο ισχυρά μοντέλα AI μπορούν να δημιουργήσουν σοβαρούς κινδύνους κυβερνοασφάλειας, ειδικά όταν διαθέτουν δυνατότητες αυτόνομης δράσης και πρόσβαση στο διαδίκτυο.

Ads

Τρεις πραγματικές παραβιάσεις που δεν εντοπίστηκαν εγκαίρως

Σε ανάρτησή της την Πέμπτη, η Anthropic ανέφερε ότι η αποκάλυψη της OpenAI την περασμένη εβδομάδα την οδήγησε να επανεξετάσει τα αρχεία από δικές της δοκιμές μοντέλων.

Ads

Από τον έλεγχο προέκυψε ότι σε τρεις διαφορετικές περιπτώσεις, συστήματα τεχνητής νοημοσύνης που είχαν λάβει εντολή να παραβιάσουν ειδικά σχεδιασμένο λογισμικό δοκιμών κατέληξαν να βγουν στο ανοιχτό διαδίκτυο και να εισβάλουν σε άλλες εταιρείες.

Σύμφωνα με την Anthropic, ούτε η ίδια ούτε οι εταιρείες που επηρεάστηκαν είχαν αντιληφθεί τις παραβιάσεις μέχρι αυτή την εβδομάδα.

Εκπρόσωπος της εταιρείας αρνήθηκε να αποκαλύψει ποιες ήταν οι τρεις επιχειρήσεις που δέχθηκαν τις μη εξουσιοδοτημένες εισβολές.

Πώς συνέβη το λάθος

Η Anthropic απέδωσε το περιστατικό σε πρόβλημα κατά τη διαδικασία δοκιμών.

Όπως εξήγησε, είχε προσλάβει την εξωτερική εταιρεία Irregular για να βοηθήσει στην αξιολόγηση των δυνατοτήτων των μοντέλων της.

Λόγω μιας «παρεξήγησης», όπως τη χαρακτήρισε, τα συστήματα απέκτησαν πρόσβαση στο διαδίκτυο ενώ συμμετείχαν σε δοκιμές κυβερνοασφάλειας.

Αυτό είχε ως αποτέλεσμα τα μοντέλα να μην περιοριστούν στο τεχνητό περιβάλλον που είχε δημιουργηθεί για την αξιολόγησή τους, αλλά να κινηθούν σε πραγματικά – εξωτερικά συστήματα.

Η Anthropic ενημέρωσε τη Δευτέρα τόσο την Irregular όσο και τις εταιρείες που παραβιάστηκαν.

Εκπρόσωπος της Irregular δήλωσε: «Εκτιμούμε τη συνεργασία και τη διαφάνεια της Anthropic και προσβλέπουμε στη συνέχιση της κοινής μας προσπάθειας για την ενίσχυση της ασφάλειας».

Οι δύο εταιρείες ανέφεραν ότι η διερεύνηση των περιστατικών συνεχίζεται.


Είχε προηγηθεί παρόμοιο περιστατικό στην OpenAI

Η αποκάλυψη αποκτά ακόμη μεγαλύτερη βαρύτητα επειδή έρχεται λίγο μετά από αντίστοιχο περιστατικό στην OpenAI.

Η εταιρεία είχε αναφέρει την περασμένη εβδομάδα ότι ένας AI «agent» που βρισκόταν σε δοκιμή, αντί να περιοριστεί στην επίλυση ενός συγκεκριμένου προβλήματος κυβερνοασφάλειας, εντόπισε μια άγνωστη μέχρι τότε ευπάθεια στο περιβάλλον δοκιμών και τη χρησιμοποίησε για να αποκτήσει πλήρη πρόσβαση στο διαδίκτυο.

Στη συνέχεια, μέσα σε διάστημα πέντε ημερών, το σύστημα παραβίασε πολλούς εξωτερικούς υπολογιστές και τελικά εισέβαλε στην εταιρεία τεχνητής νοημοσύνης Hugging Face.

Σύμφωνα με την OpenAI, φαίνεται ότι το σύστημα αναζητούσε απαντήσεις για τη δοκιμή που προσπαθούσε να ολοκληρώσει.

Η νέα γενιά μοντέλων βρίσκει μόνη της ευπάθειες

Τα δύο περιστατικά εμφανίζονται σε μια περίοδο κατά την οποία τόσο η τεχνολογική βιομηχανία όσο και η κυβέρνηση Τραμπ συζητούν εντατικά το πώς πρέπει να αντιμετωπιστεί η ταχύτατη βελτίωση των δυνατοτήτων AI στον τομέα της κυβερνοασφάλειας.

Τα πιο προηγμένα μοντέλα δεν περιορίζονται πλέον απλώς στο να γράφουν κώδικα ή να προτείνουν πιθανές λύσεις.

Μπορούν σε ορισμένες περιπτώσεις να εντοπίζουν άγνωστες ευπάθειες, να σχεδιάζουν ακολουθίες ενεργειών και να εκτελούν «επιθέσεις« με σχετικά υψηλό βαθμό αυτονομίας.

Αυτές οι δυνατότητες μπορούν να αξιοποιηθούν αμυντικά, για τον εντοπισμό αδυναμιών πριν τις εκμεταλλευτούν κακόβουλοι χρήστες, αλλά μπορούν εξίσου να χρησιμοποιηθούν επιθετικά.

Τον Απρίλιο, η Anthropic παρουσίασε ένα μοντέλο AI με την ονομασία Mythos, το οποίο, σύμφωνα με την ίδια, διέθετε τόσο ισχυρές δυνατότητες ώστε δεν μπορούσε να διατεθεί ευρέως με ασφάλεια.

Και η OpenAI έχει αναπτύξει μοντέλα με προηγμένες δεξιότητες κυβερνοασφάλειας, τα οποία μπορούν θεωρητικά να χρησιμοποιηθούν τόσο για άμυνα όσο και για επίθεση.

Παρέμβαση και από τον Λευκό Οίκο

Οι ανησυχίες έχουν πλέον φτάσει και σε κυβερνητικό επίπεδο.

Τον Ιούνιο, ο πρόεδρος Ντόναλντ Τραμπ υπέγραψε εκτελεστικό διάταγμα με στόχο να δίνεται στην αμερικανική κυβέρνηση η δυνατότητα να εξετάζει εκ των προτέρων ισχυρά συστήματα τεχνητής νοημοσύνης που ενδέχεται να δημιουργούν κινδύνους για την εθνική ή ψηφιακή ασφάλεια.

Οι αρμόδιες υπηρεσίες εργάζονται ακόμη πάνω στον τρόπο με τον οποίο θα εφαρμοστεί στην πράξη το νέο πλαίσιο.