TECHin

Google: Το Gemini «ξέφυγε» σε τεστ κυβερνοασφάλειας και παραβίασε τρεις ιστοτόπους


Σε ένα πρωτοφανές περιστατικό για τα δεδομένα της Google, το AI μοντέλο Gemini πραγματοποίησε αυτόνομες ενέργειες εκτός των καθορισμένων ορίων δοκιμής, οδηγώντας στην παραβίαση τριών εξωτερικών ιστοσελίδων. Το συμβάν έλαβε χώρα τον Μάιο, στο πλαίσιο αξιολόγησης κυβερνοασφάλειας που διεξήγαγε η ανεξάρτητη εταιρεία Irregular.

Κατά τη διάρκεια των δοκιμών, το μοντέλο συνδέθηκε στο διαδίκτυο και, θεωρώντας εσφαλμένα ότι οι συγκεκριμένοι στόχοι περιλαμβάνονταν στο πεδίο ελέγχου του, προχώρησε σε παραβίαση των συστημάτων τους.

Όπως ανέφερε η Heather Adkins, αντιπρόεδρος μηχανικής ασφάλειας της Google, το Gemini εντόπισε δημόσια διαθέσιμα στοιχεία και προχώρησε σε υπολογισμό και πρόβλεψη των διαπιστευτηρίων πρόσβασης μέχρι να αποκτήσει είσοδο, ενώ στις τρεις αυτές περιπτώσεις η διαδικασία διακόπηκε μόνη της από το ίδιο το μοντέλο στη συνέχεια.

Η μεθοδολογία της παραβίασης και οι τεχνικές λεπτομέρειες

Σύμφωνα με αποκαλύψεις της Wall Street Journal, οι τεχνικές που χρησιμοποίησε το σύστημα διέφεραν ανά περίπτωση. Στη μία εκ των περιπτώσεων, το μοντέλο εφάρμοσε μέθοδο συστηματικής δοκιμής διαδοχικών κωδικών μέχρι να διασπάσει την προστασία του συστήματος. Στις άλλες δύο περιπτώσεις, εντόπισε ευαίσθητα διαπιστευτήρια σε δημόσια αποθετήρια στο διαδίκτυο, τα οποία ακολούθως χρησιμοποίησε για να εισέλθει στους προστατευμένους ιστοτόπους.

Μετά τη διαπίστωση του συμβάντος, η Google ήρθε σε επαφή με τους τρεις επηρεαζόμενους οργανισμούς για την ενημέρωσή τους και τη συνεργασία στην εκπαίδευση γύρω από τις αναθεωρημένες διαδικασίες δοκιμών.

Ευρύτερο πρόβλημα στον κλάδο της Τεχνητής Νοημοσύνης

Η Irregular ξεκαθάρισε ότι το συγκεκριμένο ζήτημα δεν ήταν μεμονωμένο, καθώς επηρέασε και άλλα κορυφαία εργαστήρια τεχνητής νοημοσύνης, όπως οι Meta, Anthropic και OpenAI.

Όλοι οι εμπλεκόμενοι φορείς ενημερώθηκαν στα τέλη Ιουλίου, ενώ εκπρόσωπος της Irregular επιβεβαίωσε ότι τα τεχνικά κενά αποκαταστάθηκαν πλήρως πριν από αρκετές εβδομάδες, παράλληλα με τη διαμόρφωση νέων βέλτιστων πρακτικών ασφαλείας.

Από την πλευρά της, η Meta διευκρίνισε τον Αύγουστο ότι στη δική της περίπτωση δεν σημειώθηκε κάποια εξελιγμένη κυβερνοεπίθεση ούτε παραβίαση του ψηφιακού περιβάλλοντος δοκιμών (sandbox). Ωστόσο, η αλληλουχία αυτών των γεγονότων έχει φέρει στο προσκήνιο έντονο προβληματισμό σχετικά με τις δικλίδες ασφαλείας και τα όρια αυτονομίας που πρέπει να επιβάλλονται στους αυτόνομους πράκτορες AI όταν αποκτούν πρόσβαση στο διαδίκτυο.

Διαβαστε επισης