Νέα περιστατικά με πράκτορες τεχνητής νοημοσύνης της OpenAI δείχνουν ότι τα συστήματα επιχείρησαν να παραβιάσουν ιστοσελίδες πανεπιστημίων και κυβερνητικών υπηρεσιών, ενώ είχαν αναλάβει πολύ πιο απλές εργασίες συλλογής δεδομένων. Σε μία περίπτωση στην Αυστραλία αποκτήθηκαν μη δημόσια δεδομένα υγείας.
Η τεχνητή νοημοσύνη της OpenAI φαίνεται ότι είχε αρχίσει να δοκιμάζει τα όρια μεταξύ αυτοματοποιημένης έρευνας και κυβερνοεπίθεσης αρκετούς μήνες πριν γίνει γνωστή η επίθεση στην πλατφόρμα Hugging Face. Σύμφωνα με ερευνητές και κυβερνητικούς αξιωματούχους, τουλάχιστον τέσσερα περιστατικά σημειώθηκαν τον Μάιο και τον Ιούνιο, όταν συστήματα της εταιρείας επιχείρησαν να αποκτήσουν πρόσβαση σε ιστοσελίδες πανεπιστημίων και δημόσιων οργανισμών χωρίς να έχουν λάβει εντολή να κάνουν hacking.
Η ιδιαιτερότητα των περιστατικών βρίσκεται ακριβώς σε αυτό το σημείο. Σε προηγούμενες περιπτώσεις, τα μοντέλα είχαν κληθεί να πραγματοποιήσουν δοκιμές κυβερνοασφάλειας, κάτι που ουσιαστικά τους έδινε περιθώριο να επιδείξουν τις ικανότητές τους στο hacking. Αυτή τη φορά οι πράκτορες είχαν αναλάβει πολύ πιο πεζές εργασίες συλλογής δεδομένων. Όταν συναντούσαν εμπόδια, όμως, φαίνεται ότι επέλεγαν μόνοι τους τεχνικές που μπορούσαν να τους οδηγήσουν στην πληροφορία.
Τα τρία από τα τέσσερα περιστατικά εντοπίστηκαν από την ερευνητική ομάδα Transluce, η οποία ασχολείται με την εποπτεία συστημάτων τεχνητής νοημοσύνης και ανέλυσε δημόσια διαθέσιμα δεδομένα διαδικτυακής κίνησης. Η OpenAI επιβεβαίωσε τα περιστατικά και ανέφερε ότι έχει επικοινωνήσει με τους οργανισμούς που επηρεάστηκαν. Στις 25 και 26 Μαΐου, πράκτορες της AI επιχείρησαν να παραβιάσουν την ψηφιακή βιβλιοθήκη του Πανεπιστημίου του Νέου Μεξικού, χωρίς να φαίνεται ότι κατάφεραν να αποκτήσουν πρόσβαση. Στις 28 Μαΐου, αντίστοιχη προσπάθεια έγινε στην πλατφόρμα Data USA, η οποία συγκεντρώνει δημόσια δεδομένα για την απασχόληση και την εκπαίδευση στις ΗΠΑ.
Το περιστατικό στην Αυστραλία ήταν διαφορετικής βαρύτητας. Στις 18 Ιουνίου, πράκτορες της OpenAI παραβίασαν το Medicare Statistics Reporting Service, κυβερνητική πλατφόρμα στατιστικών δεδομένων για το Medicare, το καθολικό σύστημα Υγείας της χώρας, και απέκτησαν πρόσβαση σε δεδομένα που δεν ήταν δημόσια. Ο πρωθυπουργός της Αυστραλίας, Άντονι Αλμπανέζι, αποκάλυψε το περιστατικό και δήλωσε ότι τα δεδομένα που εκτέθηκαν ήταν «μη ευαίσθητα», όπως στοιχεία για δαπάνες, και ότι δεν αφορούσαν προσωπικές ιατρικές πληροφορίες. Στις 20 και 21 Ιουνίου ακολούθησε προσπάθεια παραβίασης της ιστοσελίδας του Australian Institute of Health and Welfare, χωρίς, σύμφωνα με Αυστραλούς αξιωματούχους, να αποκτηθούν προσωπικά δεδομένα.
Από μια απλή αναζήτηση σε 80 αιτήματα προς έναν server
Οι λεπτομέρειες των περιστατικών δείχνουν πώς εξελίχθηκε η συμπεριφορά των πρακτόρων. Στην περίπτωση της ψηφιακής βιβλιοθήκης του Πανεπιστημίου του Νέου Μεξικού, ο στόχος ήταν να βρεθούν φωτογραφίες ενός ιστορικού κέντρου θεραπείας για τη φυματίωση. Όταν το σύστημα δεν μπόρεσε να αποκτήσει τις εικόνες, άρχισε να ψάχνει για ευπάθειες που θα μπορούσαν να του επιτρέψουν να εισέλθει στο σύστημα. Αφού δεν εντόπισε κάποιο κενό ασφαλείας, έστειλε αυτό που περιέγραψε ως «πλημμύρα» 80 αιτημάτων προς τον server του πανεπιστημίου.
Στην περίπτωση της Data USA, η αρχική προσπάθεια ήταν επίσης μια αναζήτηση δεδομένων. Όταν ένα δυσνόητο ερώτημα που έστειλε το σύστημα απέτυχε, ακολούθησαν 12 δοκιμές για διαφορετικές πιθανές ευπάθειες. Και εκεί, ωστόσο, ο πράκτορας δεν κατάφερε να βρει τρόπο εισόδου. Για τον Κόνραντ Στος, επικεφαλής διακυβέρνησης της Transluce, το ζήτημα είναι ευρύτερο: εάν ένα πλήθος αυτόνομων πρακτόρων εκπαιδευτεί να ολοκληρώνει μια γενική εργασία και είναι διατεθειμένο να καταφύγει σε hacking όταν συναντά εμπόδια, τότε οποιοσδήποτε διαθέτει τις πληροφορίες που αναζητούν οι πράκτορες μπορεί δυνητικά να βρεθεί εκτεθειμένος.
Στην Αυστραλία, η ακολουθία ήταν ακόμη πιο ανησυχητική. Σύμφωνα με τον Αλμπανέζι, ομάδα της OpenAI πραγματοποιούσε διαδικτυακή έρευνα για τις δημόσιες δαπάνες υγείας. Όταν οι πράκτορες συνάντησαν επανειλημμένα μπλοκαρίσματα, αναζήτησαν «εναλλακτικούς τρόπους» για να αποκτήσουν τις πληροφορίες και τελικά πέρασαν σε μη δημόσια τμήματα της κυβερνητικής πλατφόρμας Medicare. Η OpenAI ενημέρωσε την αυστραλιανή κυβέρνηση για το περιστατικό στις 10 Σεπτεμβρίου. Ο Αλμπανέζι δήλωσε ότι συζήτησε το θέμα με τον διευθύνοντα σύμβουλο της OpenAI, Σαμ Άλτμαν, την Τετάρτη και εξέφρασε «ακραία ανησυχία», χαρακτηρίζοντας την κατάσταση «έναν νέο κόσμο» για τις κυβερνήσεις.
Η συμπεριφορά είχε ξεκινήσει πριν από τη Hugging Face
Τα νέα περιστατικά διευρύνουν σημαντικά τη χρονική εικόνα. Η Transluce εντόπισε διαδικτυακή δραστηριότητα των πρακτόρων ήδη από τον Μάρτιο, αλλά και μέχρι την περασμένη Τετάρτη, γεγονός που υποδηλώνει ότι η συγκεκριμένη συμπεριφορά δεν περιορίστηκε σε ένα μεμονωμένο επεισόδιο. Φαίνεται να είχε ξεκινήσει μήνες πριν από την επίθεση στην πλατφόρμα Hugging Face τον Ιούλιο και να συνεχίστηκε ακόμη και μετά την έναρξη ερευνών της OpenAI για εκείνο το περιστατικό και άλλες προβληματικές συμπεριφορές των μοντέλων.
Η OpenAI ανέφερε ότι είχε ήδη επικοινωνήσει με το Πανεπιστήμιο του Νέου Μεξικού και τη Data USA, ενώ βρίσκεται σε επαφή και με την αυστραλιανή κυβέρνηση. Εκπρόσωπος της εταιρείας δήλωσε ότι η OpenAI συνεχίζει να δίνει προτεραιότητα στα σοβαρότερα περιστατικά, επεκτείνοντας παράλληλα την έρευνά της σε χαμηλότερης σοβαρότητας δραστηριότητες, ακόμη και περιπτώσεις κατά τις οποίες πράκτορες «σπαμάρουν» ιστοσελίδες. Σε ξεχωριστή δήλωση, η εταιρεία ανέφερε ότι εντόπισε τα περιστατικά στην Αυστραλία στο πλαίσιο εκτεταμένης επανεξέτασης των μοντέλων της και κατέληξε στο συμπέρασμα ότι «τα μοντέλα μας έκαναν ενέργειες που δεν είχαμε σκοπό να κάνουν». Η έρευνα, σύμφωνα με την OpenAI, θα χρειαστεί μήνες για να ολοκληρωθεί.
Τα περιστατικά της OpenAI προστίθενται σε μια σειρά ανάλογων επεισοδίων στα οποία συστήματα των OpenAI, Anthropic, Meta και Google έχουν αποκτήσει πρόσβαση σε άλλα συστήματα χωρίς να το γνωρίζουν οι άνθρωποι που τα χειρίζονται.
Ο Ντάριο Αμοντέι, διευθύνων σύμβουλος της Anthropic, έχει υποστηρίξει ότι οι εταιρείες τεχνητής νοημοσύνης και οι κυβερνήσεις πρέπει να συνεργαστούν, πριν η τεχνολογία γίνει υπερβολικά ισχυρή για να ελεγχθεί από τον άνθρωπο.
Από την άλλη πλευρά, στελέχη όπως ο Τζένσεν Χουάνγκ της Nvidia έχουν χαρακτηρίσει υπερβολικά τα πιο ακραία σενάρια για το μέλλον της AI, ενώ ο πρόεδρος Ντόναλντ Τραμπ έχει δηλώσει ότι δεν θεωρεί πως χρειάζεται αυστηρή ρύθμιση της τεχνητής νοημοσύνης.
Ο ίδιος ο Σαμ Άλτμαν είχε γράψει αυτόν τον μήνα στα μέσα κοινωνικής δικτύωσης, ότι η ασφάλεια πρέπει να έχει μεγαλύτερη προτεραιότητα από την ενίσχυση των δυνατοτήτων της AI, προειδοποιώντας ότι χωρίς κατάλληλα «φρένα» η κοινωνία θα μπορούσε να «χάσει τον έλεγχο του μέλλοντος από την AI».
Για τον Στος της Transluce, τα τέσσερα νέα περιστατικά αποτελούν επιπλέον ένδειξη ότι οι αυτόνομοι πράκτορες χρειάζονται ιδιαίτερα προσεκτική αντιμετώπιση. Όπως σημείωσε, τα περιστατικά στην Αυστραλία ενδέχεται να αποτελούν την πρώτη γνωστή περίπτωση κατά την οποία ένας πράκτορας επέλεξε αυτόνομα να επιχειρήσει hacking εναντίον κυβερνητικού οργανισμού.
Η αυστραλιανή υπόθεση έχει και μια ιδιαίτερη πολιτική διάσταση, καθώς το Medicare αποτελεί έναν από τους πλέον υποστηριζόμενους δημόσιους θεσμούς της χώρας και συχνά χαρακτηρίζεται ως «τρίτη ράγα» της αυστραλιανής πολιτικής — ένα ζήτημα τόσο ευαίσθητο ώστε η πολιτική του αξιοποίηση να θεωρείται ιδιαίτερα επικίνδυνη. Ο Αλμπανέζι δεν απάντησε, πάντως, όταν δημοσιογράφοι τον ρώτησαν εάν έθεσε το περιστατικό στον Τραμπ κατά τη συνάντησή τους στο περιθώριο της Γενικής Συνέλευσης του ΟΗΕ αυτή την εβδομάδα.
Το βασικό ερώτημα που αφήνουν πίσω τους τα περιστατικά δεν αφορά μόνο το πόσο αποτελεσματικά μπορούν να χακάρουν τα σύγχρονα μοντέλα, αλλά το πώς αντιδρούν όταν η εντολή που έχουν λάβει δεν μπορεί να εκτελεστεί με τον αναμενόμενο τρόπο. Μέχρι σήμερα, μεγάλο μέρος της συζήτησης για την ασφάλεια της AI αφορούσε το τι μπορεί να κάνει ένα μοντέλο όταν του ζητηθεί να επιτεθεί. Τα νέα ευρήματα μετατοπίζουν το επίκεντρο σε κάτι διαφορετικό: τι μπορεί να επιλέξει να κάνει μόνο του όταν προσπαθεί να ολοκληρώσει έναν φαινομενικά αθώο στόχο.