TECHin

Anthropic: Εντόπισε απόπειρες χρήσης AI για βιολογικά όπλα


Νέα διάσταση παίρνει η συζήτηση για τους κινδύνους από την τεχνητή νοημοσύνη, καθώς η Anthropic ανακοίνωσε ότι εντόπισε και απέτρεψε πέντε περιπτώσεις στις οποίες επιστήμονες χρησιμοποίησαν τα μοντέλα Claude για έρευνα που θα μπορούσε να υποστηρίξει την ανάπτυξη βιολογικών όπλων. Η εταιρεία υπογραμμίζει, ωστόσο, ότι δεν ήταν σε θέση να διαπιστώσει εάν οι ερευνητές είχαν πράγματι κακόβουλη πρόθεση, καθώς η ίδια βιολογική γνώση μπορεί να χρησιμοποιηθεί τόσο για την αντιμετώπιση ασθενειών όσο και για την ανάπτυξη επικίνδυνων παθογόνων.

Οι αποκαλύψεις περιλαμβάνονται σε εκτενή έκθεση της Anthropic για τη νέα γενιά απειλών που συνδέονται με τη χρήση των μοντέλων τεχνητής νοημοσύνης. Η εταιρεία αναφέρει ότι οι συγκεκριμένες υποθέσεις αποτελούν «τα πιο αξιοσημείωτα και νέα περιστατικά απειλής» που έχει εντοπίσει μέχρι σήμερα. Στην ίδια έκθεση καταγράφονται περιστατικά που αφορούν κυβερνοεπιθέσεις, επιχειρήσεις επιρροής, παρακολούθηση, απάτες, ανάπτυξη συμβατικών όπλων και προσπάθειες παράνομης αντιγραφής μοντέλων AI.

Η Anthropic χαρακτηρίζει την πιθανή κακόβουλη χρήση της τεχνητής νοημοσύνης στη βιολογία ως «έναν από τους σοβαρότερους κινδύνους των προηγμένων μοντέλων AI». Παράλληλα, όμως, βάζει μια κρίσιμη παράμετρο στην υπόθεση: τα περιστατικά που εντόπισε «παρέχουν στοιχεία για τις δυνατότητες» των μοντέλων, αλλά «δεν μπορούν να αποδείξουν συγκεκριμένα ότι αυτή η δυνατότητα θα χρησιμοποιηθεί ποτέ για την ανάπτυξη βιολογικών όπλων στον πραγματικό κόσμο».

Οι άνθρωποι που εμπλέκονται στις συγκεκριμένες υποθέσεις ήταν εργαζόμενοι επιστήμονες, τα στοιχεία των οποίων η Anthropic αποφάσισε να μην δημοσιοποιήσει. Η εταιρεία σημειώνει ότι δεν μπορεί να «ισχυριστεί ότι είχαν πρόθεση να προκαλέσουν βλάβη», γεγονός που αναδεικνύει και τη δυσκολία διάκρισης ανάμεσα στη νόμιμη επιστημονική έρευνα και στην έρευνα που θα μπορούσε να αποκτήσει στρατιωτική ή καταστροφική εφαρμογή.

Ένα από τα βασικά προβλήματα που αναδεικνύει η έκθεση είναι ακριβώς ο χαρακτήρας διπλής χρήσης της βιολογικής γνώσης. Όπως επισημαίνει η Anthropic, «οι ίδιες πληροφορίες που μπορούν να χρησιμοποιηθούν για την ανάπτυξη ενός βιολογικού όπλου θα μπορούσαν επίσης να χρησιμοποιηθούν, για παράδειγμα, για την ανάπτυξη ενός εμβολίου ή μιας θεραπείας για μια ασθένεια».

Η εταιρεία αναφέρει ότι, μόλις εντόπισε και διερεύνησε τις συγκεκριμένες περιπτώσεις, μπλόκαρε τους λογαριασμούς των χρηστών και ενσωμάτωσε τα ευρήματα στις διαδικασίες προστασίας των μοντέλων, στην επιβολή των κανόνων και στη συλλογή πληροφοριών για απειλές. Στόχος, όπως αναφέρει, είναι να βελτιωθεί η δυνατότητα πρόληψης, εντοπισμού και διακοπής αντίστοιχων δραστηριοτήτων στο μέλλον.

Η εξέλιξη έρχεται καθώς τα μοντέλα τεχνητής νοημοσύνης αποκτούν ολοένα μεγαλύτερες δυνατότητες στην επεξεργασία επιστημονικής πληροφορίας. Η ίδια η Anthropic έχει προειδοποιήσει ότι τα προηγμένα μοντέλα μπορούν να λειτουργήσουν ως ερευνητικοί βοηθοί, παρέχοντας γρήγορη επεξεργασία δεδομένων και πρόσβαση σε γνώση που προηγουμένως ήταν δύσκολα προσβάσιμη. Η εταιρεία θεωρεί ότι η βιολογική ασφάλεια αποτελεί ιδιαίτερα κρίσιμο πεδίο επειδή μια επιτυχημένη βιολογική επίθεση μπορεί να έχει επιπτώσεις πολύ ευρύτερες από τον αρχικό στόχο.

Μάλιστα, σε προηγούμενες δοκιμές της Anthropic, ερευνητές εξέτασαν κατά πόσο η πρόσβαση σε μοντέλα Claude μπορούσε να ενισχύσει τις δυνατότητες ανθρώπων χωρίς εξειδικευμένη εμπειρία στη σύνταξη σχεδίων σχετικών με βιολογικές απειλές. Η εταιρεία αναφέρει ότι σε συγκεκριμένες αξιολογήσεις οι συμμετέχοντες που είχαν πρόσβαση σε Claude 4 πέτυχαν υψηλότερες επιδόσεις και παρουσίασαν λιγότερα κρίσιμα λάθη από την ομάδα που είχε πρόσβαση μόνο στο διαδίκτυο.

Η Anthropic τονίζει πάντως ότι τέτοιες δοκιμές δεν αποτελούν απόδειξη ότι ένα μοντέλο μπορεί από μόνο του να δημιουργήσει ένα βιολογικό όπλο. Υπάρχει σημαντική απόσταση ανάμεσα στην παροχή πληροφοριών, στην υποστήριξη ενός θεωρητικού σχεδίου και στην πραγματική εργαστηριακή ανάπτυξη ενός βιολογικού παράγοντα. Για τον λόγο αυτό η εταιρεία έχει επενδύσει σε πρόσθετες αξιολογήσεις και συνεργασίες με ειδικούς στη βιοασφάλεια.

Παράλληλα, η Anthropic έχει ενισχύσει τις δικλίδες ασφαλείας στα νεότερα μοντέλα της. Σύμφωνα με την εταιρεία, τα πιο προηγμένα μοντέλα διαθέτουν αυστηρότερους περιορισμούς στην πρόσβαση σε «ένα ευρύ φάσμα βιολογικών ερωτημάτων διπλής χρήσης», ενώ εφαρμόζονται μηχανισμοί που παρακολουθούν σε πραγματικό χρόνο τις εισόδους και τις εξόδους των μοντέλων και μπλοκάρουν συγκεκριμένες κατηγορίες δυνητικά επιβλαβούς πληροφορίας.

Η έκθεση δεν περιορίζεται, πάντως, στη βιολογική ασφάλεια. Η Anthropic αναφέρει ότι εντόπισε επίσης χρήση του Claude σε επιχειρήσεις επιρροής και προπαγάνδας, παρακολούθηση και καταστολή αντιφρονούντων, κυβερνοεπιχειρήσεις, απάτες και ανάπτυξη συμβατικών όπλων. Μεταξύ άλλων, η εταιρεία εντόπισε τρεις λογαριασμούς που συνδέονταν με κρατικούς φορείς του Ιράν και χρησιμοποιούσαν το Claude για επιχειρήσεις διαμόρφωσης της κοινής γνώμης.

Σύμφωνα με την Anthropic, οι συγκεκριμένοι λογαριασμοί χρησιμοποιούσαν το AI για τη δημιουργία περιεχομένου, την εμφάνιση αναρτήσεων ως δήθεν ανεξάρτητων ειδησεογραφικών πηγών και τη διάδοση υλικού σε πλατφόρμες κοινωνικής δικτύωσης όπως το X, το Instagram και το TikTok. Παράλληλα, η εταιρεία εντόπισε περιπτώσεις χρήσης του Claude για επιχειρήσεις παρακολούθησης στην Κίνα και τη Δυτική Αφρική.

Η αποκάλυψη των περιστατικών έρχεται σε μια περίοδο κατά την οποία η ταχεία εξέλιξη των λεγόμενων frontier AI models έχει μεταφέρει τη συζήτηση από τους θεωρητικούς κινδύνους σε πραγματικές περιπτώσεις κατάχρησης. Η ίδια η Anthropic χαρακτηρίζει τους κινδύνους από την τεχνητή νοημοσύνη και τη βιοασφάλεια ως σενάρια «χαμηλής πιθανότητας/υψηλού αντίκτυπου», υπογραμμίζοντας ότι η πρόληψη πρέπει να προηγείται ενός πραγματικού περιστατικού.

Το μήνυμα της εταιρείας είναι ότι η αντιμετώπιση του κινδύνου δεν μπορεί να βασίζεται αποκλειστικά στους ίδιους τους παρόχους AI. Η Anthropic ζητά ενισχυμένη συνεργασία με κυβερνήσεις και ειδικούς στη βιοασφάλεια, περισσότερη ανταλλαγή πληροφοριών και διαφάνεια στις αξιολογήσεις των μοντέλων. Παράλληλα, θεωρεί απαραίτητη την ανάπτυξη μηχανισμών που θα επιτρέπουν τον έγκαιρο εντοπισμό της κακόβουλης χρήσης, πριν αυτή μετατραπεί σε πραγματική απειλή.

Διαβαστε επισης