TECHin

Anthropic: Προειδοποίηση για «υπαρξιακούς κινδύνους» από την AI


Η Anthropic προειδοποιεί τους υποψήφιους επενδυτές της, ενόψει της σχεδιαζόμενης εισαγωγής της στο χρηματιστήριο, ότι η προηγμένη τεχνητή νοημοσύνη θα μπορούσε να δημιουργήσει «καταστροφικούς ή υπαρξιακούς κινδύνους για την ανθρωπότητα», σύμφωνα με αποκλειστικό ρεπορτάζ του Reuters.

Στο ενημερωτικό δελτίο για την IPO, το οποίο εξέτασε το Reuters, η Anthropic αναφέρει ότι τα μοντέλα AI θα μπορούσαν να εμφανίσουν συμπεριφορές «αυτοσυντήρησης», μεταξύ άλλων προσπάθειες να αντισταθούν στον τερματισμό της λειτουργίας τους, να αποκρύψουν ή να χειραγωγήσουν πληροφορίες, αλλά και συμπεριφορές που θα μπορούσαν να μοιάζουν με εκβιασμό.

«Η ανάπτυξη εξαιρετικά προηγμένων μοντέλων, πλατφορμών και εφαρμογών και η επέκταση των περιπτώσεων χρήσης θα μπορούσαν να αυξήσουν περαιτέρω τον κίνδυνο τα μοντέλα μας να προκαλέσουν βλάβη», αναφέρει η εταιρεία στο ενημερωτικό δελτίο, σύμφωνα με το Reuters.

Η Anthropic επισημαίνει ταυτόχρονα ότι η τεχνητή νοημοσύνη έχει τη δυνατότητα να μετασχηματίσει την οικονομία και την κοινωνία σε βαθμό αντίστοιχο με την εκβιομηχάνιση και την ηλεκτρική ενέργεια, προειδοποιώντας όμως ότι η λανθασμένη διαχείρισή της θα μπορούσε να προκαλέσει μη αναστρέψιμες συνέπειες.

Ιδιαίτερη αναφορά γίνεται στους κινδύνους που σχετίζονται με την αξιολόγηση της ασφάλειας των μοντέλων. Η Anthropic αναφέρει ότι η πιθανή επίγνωση των μοντέλων για τις διαδικασίες αξιολόγησής τους αποτελεί «σημαντικό περιορισμό» στην ικανότητα της εταιρείας να αξιολογεί την ασφάλειά τους. Τα μοντέλα μπορεί επίσης να αναπτύσσουν απρόσμενες ικανότητες κατά τη διάρκεια της εκπαίδευσης, οι οποίες ενδέχεται να μην εντοπιστούν παρά μόνο μετά την ανάπτυξή τους και την εμφάνιση σημαντικών περιστατικών ασφαλείας.

Σύμφωνα με το Reuters, η Anthropic αφιέρωσε περίπου 80 από τις 261 σελίδες του βασικού σώματος του ενημερωτικού δελτίου της στους παράγοντες κινδύνου. Αντίθετα, περίπου 48 σελίδες αφορούν την επιχειρηματική της δραστηριότητα. Για σύγκριση, η SpaceX, η οποία έχει στην κατοχή της την xAI, αφιέρωσε περίπου 38 από τις 277 σελίδες του δικού της βασικού ενημερωτικού δελτίου στους παράγοντες κινδύνου.

Η εταιρεία, η οποία έχει τοποθετηθεί στην αγορά ως εργαστήριο τεχνητής νοημοσύνης με έμφαση στην ασφάλεια, αναγνωρίζει επίσης ότι οι οικονομικές αποδόσεις των επενδύσεων στην ασφάλεια παραμένουν αβέβαιες. Δεν γνωστοποίησε στο ενημερωτικό δελτίο πόσα χρήματα δαπανά για την έρευνα ασφάλειας. Ωστόσο, νωρίτερα τον Σεπτέμβριο ανέφερε ότι περίπου 6% της υπολογιστικής ισχύος που χρησιμοποίησε για έρευνα AI σε μία ενδεικτική εβδομάδα του Ιουλίου κατευθύνθηκε σε εργασίες ασφάλειας.

Το Reuters αναφέρει επίσης ότι ο ερευνητής ασφάλειας της Anthropic Evan Hubinger εκτίμησε πιθανότητα άνω του 10% να προκαλέσει η τεχνητή νοημοσύνη τον θάνατο ανθρώπων μέσα στην επόμενη δεκαετία. Η εκτίμηση αυτή, σύμφωνα με το Reuters, αντανακλά άποψη που είχε εκφράσει και πρώην συνάδελφός του, ο Jacob Coxon.

Οι προειδοποιήσεις της Anthropic έρχονται σε μια περίοδο αυξημένου ελέγχου των εταιρειών AI, μετά από περιστατικά στα οποία πειραματικά συστήματα φέρεται να παραβίασαν περιορισμούς. Το Reuters αναφέρεται, μεταξύ άλλων, σε αναφορά σύμφωνα με την οποία μοντέλο της OpenAI παραβίασε βάση δεδομένων του συστήματος υγείας της Αυστραλίας.

Η Anthropic αναφέρει στο ενημερωτικό της δελτίο ότι η χρήση των προϊόντων της από τους πελάτες και, κατ’ επέκταση, τα έσοδά της συνδέονται με την κυκλοφορία νέων μοντέλων. Για τον λόγο αυτό περιγράφει έναν «συνεχή και αλληλεπικαλυπτόμενο ρυθμό» κυκλοφοριών ως απαραίτητο για την παραμονή στην αιχμή της ανάπτυξης της τεχνητής νοημοσύνης.

Διαβαστε επισης