Το σενάριο γίνεται πραγματικότητα: Χρήστες χρησιμοποιούν την ΑΙ για τη δημιουργία βιολογικών όπλων και πυραύλων

Η Anthropic, μια από τις μεγαλύτερες εταιρίες ΑΙ και δημιουργός του Claude, παραδέχθηκε ότι χρήστες της προσπάθησαν να φτιάξουν πυραύλους και πιθανά βιολογικά όπλα


Ένα εφιαλτικό σενάριο βγαλμένο από ταινίες post-apocalyptic φαίνεται να γίνεται πλέον πραγματικότητα, σύμφωνα με τα όσα αποκαλύπτονται.

Όπως έγινε γνωστό, χρήστες του Claude επιχείρησαν να χρησιμοποιήσουν προηγμένα μοντέλα ΑΙ για την ανάπτυξη πυραύλων, drones, βομβών και έρευνας που θα μπορούσε να συμβάλει στη δημιουργία επικίνδυνων βιολογικών όπλων.

Σύμφωνα με τα όσα αποκάλυψε σε νέα έκθεση η Anthropic, δημιουργός του Claude, εντόπισε και διέκοψε σειρά ενεργειών κατά τις οποίες χρήστες επιχείρησαν να αξιοποιήσουν τα μοντέλα της σε στρατιωτικά και δυνητικά βιολογικά προγράμματα.

Σύμφωνα με τα ευρήματα που παρουσιάζουν οι Financial Times και οι New York Times οι προσπάθειες ήταν πολλαπλές: από μια ομάδα στη βόρεια Υεμένη που σχετίζεται με τους Χούθι και χρησιμοποίησε το Claude για να γράψει λογισμικό καθοδήγησης πυραύλων, μέχρι επιστήμονες που προσπάθησαν να το αξιοποιήσουν σε έρευνες οι οποίες, υπό συγκεκριμένες συνθήκες, θα μπορούσαν να οδηγήσουν στη δημιουργία ισχυρότερων παθογόνων οργανισμών.

Η Anthropic τονίζει ότι δεν έχει αποδείξεις πως τα βιολογικά ερευνητικά προγράμματα είχαν κατ' ανάγκη σκοπό την κατασκευή όπλων. Ωστόσο, το γεγονός ότι ορισμένοι χρήστες έκρυβαν τον πραγματικό σκοπό της έρευνάς τους και επιχειρούσαν να παρακάμψουν τους μηχανισμούς ασφαλείας ήταν αρκετό για την εταιρεία ώστε να διακόψει την πρόσβασή σε αυτούς.

«Δεν βλέπεις κάποιον, σαν σε κόμικ, να λέει “θέλω να φτιάξω ένα βιολογικό όπλο για να σκοτώσω τους πάντες”», δήλωσε στους New York Times ο επικεφαλής Threat Intelligence της Anthropic, Τζέικομπ Κλάιν. «Είναι μια απίστευτα σύνθετη κατάσταση».

Οι πύραυλοι των Χούθι

Μία από τις πιο ανησυχητικές υποθέσεις αφορά μια ομάδα που δραστηριοποιούνταν στη βόρεια Υεμένη. Η Anthropic δεν την ταυτοποίησε επισήμως με τους Χούθι, ωστόσο η γεωγραφική περιοχή βρίσκεται σε μεγάλο βαθμό υπό τον έλεγχο της υποστηριζόμενης από το Ιράν οργάνωσης και, όπως σημειώνουν οι New York Times, όλα τα στοιχεία παραπέμπουν σε αυτήν.

Σύμφωνα με την Anthropic, η ομάδα εργαζόταν πάνω σε τρία διαφορετικά προγράμματα όπλων: έναν βαλλιστικό πύραυλο, έναν πύραυλο με διαφορετικές παραλλαγές και μία κατευθυνόμενη ρουκέτα. Το πλέον ανησυχητικό είναι ότι οι χρήστες δεν αντιμετώπιζαν το Claude απλώς ως εργαλείο αναζήτησης πληροφοριών.

Όπως αναφέρει η Anthropic, το χρησιμοποίησαν ώστε να «υποδυθεί» ανθρώπους μηχανικούς λογισμικού, προκειμένου να αναπτύξουν το σύστημα καθοδήγησης, πλοήγησης και ελέγχου των όπλων.

Το μοντέλο χρησιμοποιήθηκε για την ενσωμάτωση autopilot ανοικτού κώδικα σε υπολογιστή πτήσης επιπέδου smartphone, για τη συγγραφή λογισμικού ελέγχου και υπολογισμού θέσης, την προσαρμογή παραμέτρων, την παραγωγή firmware και ακόμη και για προσομοίωση πτήσης. Οι χρήστες επιχείρησαν ουσιαστικά να μετατρέψουν την ΑΙ σε ψηφιακό συνεργάτη ενός προγράμματος ανάπτυξης οπλικών συστημάτων.

Η εν λόγω ομάδα προχώρησε μάλιστα και πέρα από την θεωρία και πραγματοποίησε δοκιμαστική εκτόξευση κατευθυνόμενης ρουκέτας. Η δοκιμή φαίνεται ότι απέτυχε. Μέσα σε λίγες ώρες, οι χρήστες επέστρεψαν στο Claude για να αναλύσουν τι είχε πάει στραβά και να επιχειρήσουν να διορθώσουν τα προβλήματα.

Η εταιρεία διευκρινίζει ότι δεν διαθέτει στοιχεία για το πώς το συγκεκριμένο πρόγραμμα κατέληξε σε λειτουργικό όπλο. Το γεγονός, όμως, ότι η τεχνητή νοημοσύνη χρησιμοποιήθηκε σε πραγματικό κύκλο σχεδιασμού, δοκιμής και διόρθωσης αποτελεί ποιοτικά διαφορετικό επίπεδο απειλής.

Πώς παρέκαμψαν τις δικλίδες ασφαλείας

Οι μηχανισμοί του Claude απέρριψαν αυτόματα πολλά από τα σχετικά αιτήματα, όχι όμως όλα. Σύμφωνα με την Anthropic, οι χρήστες είχαν αναπτύξει τεχνικές ώστε να αποκρύπτουν τι πραγματικά κατασκεύαζαν. Δεν αποκάλυπταν εξαρχής τον τελικό σκοπό του λογισμικού και μοίραζαν την εργασία σε πολλές διαφορετικές συνομιλίες, έτσι ώστε καμία μεμονωμένη συνεδρία να μην καταγράφει ολόκληρο το σχέδιο.

Η τακτική αυτή καταγράφεται και σε άλλες περιπτώσεις κατάχρησης του Claude, γεγονός που δημιουργεί ένα δύσκολο πρόβλημα για τις εταιρείες ΑΙ: ένα μεμονωμένο αίτημα μπορεί να μοιάζει απολύτως αθώο, αλλά αν συνδυαστεί με δεκάδες άλλα τότε αποκαλύπτεται ο πραγματικός στόχος.

Επόμενος στόχος: Βιολογικά όπλα

Ίσως μια ακόμα πιο ανησυχητική χρήση της ΑΙ εκτός από την κατασκευή πυραύλων αποτελεί και η έρευνα που έγινε για βιολογικά όπλα.

Η Anthropic αποκάλυψε ότι μέσα στη χρονιά διέκοψε αρκετές περιπτώσεις στις οποίες επιστήμονες χρησιμοποιούσαν προηγμένα μοντέλα Claude για έρευνα που θα μπορούσε να συμβάλει στην ανάπτυξη βιολογικών όπλων.

Χρήστες χρησιμοποίησαν το Claude για έρευνες πάνω σε ιούς και μεταλλάξεις, οι οποίες μπορεί από τη μια να οδηγήσουν σε νέα εμβόλια και θεραπείες, αλλά μπορούν και να χρησιμοποιηθούν και για τη δημιουργία πιο επικίνδυνων παθογόνων. Αυτό ακριβώς είναι το λεγόμενο πρόβλημα διπλής χρήσης της σύγχρονης βιοτεχνολογίας.

Η Anthropic αναφέρει ότι δεν μπόρεσε να διαπιστώσει με βεβαιότητα εάν οι επιστήμονες είχαν νόμιμους ή κακόβουλους σκοπούς. Επέλεξε, ωστόσο, να διακόψει τις σχετικές δραστηριότητες λόγω των δυνητικά καταστροφικών συνεπειών ενός λάθους.

Ο ιός chikungunya

Σύμφωνα με την έκθεση της Anthropic, μία από τις πιο ανησυχητικές περιπτώσεις καταγράφηκε τον Μάιο. Επιστήμονας ζήτησε τη βοήθεια του Claude για τη σύνταξη πρότασης χρηματοδότησης έρευνας πάνω στον ιό chikungunya, ο οποίος μεταδίδεται από κουνούπια και μπορεί να προκαλέσει έντονους πόνους και άλλα σοβαρά συμπτώματα επί μήνες.

Η σχεδιαζόμενη έρευνα αφορούσε πειράματα τύπου gain-of-function, κατά τα οποία ένας παθογόνος οργανισμός τροποποιείται ώστε να μελετηθούν μεταλλάξεις και χαρακτηριστικά του. Τέτοιες μελέτες μπορούν να έχουν απολύτως θεμιτή επιστημονική αξία και να οδηγήσουν στην ανάπτυξη εμβολίων.

Όμως, στη συγκεκριμένη περίπτωση, ο χρήστης προσπαθούσε να δημιουργήσει μεταλλάξεις που θα μπορούσαν να κάνουν τον ιό περισσότερο επιβλαβή με την επανειλημμένη μετάδοση σε ζώα. Η ανησυχία της Anthropic έγινε ακόμη μεγαλύτερη όταν διαπίστωσε ότι η έρευνα προοριζόταν να πραγματοποιηθεί σε στρατιωτικό ερευνητικό ινστιτούτο.

«Αυτό που δεν γνωρίζουμε είναι αν η έρευνα προοριζόταν για στρατιωτική αξιοποίηση», δήλωσε ο Κλάιν. «Αλλά ένα στρατιωτικό ίδρυμα που πραγματοποιεί έρευνα gain-of-function είναι ανησυχητικό».

Κίνα, Ρωσία και Υεμένη πίσω από ύποπτες ενέργειες

Η έκθεση της Anthropic περιλαμβάνει και άλλες περιπτώσεις χρήσης του Claude για στρατιωτικούς σκοπούς. Στην έκθεση καταγράφονται τρεις υποθέσεις στην Κίνα, δύο στη Ρωσία και μία στην Υεμένη, στις οποίες το μοντέλο επιχειρήθηκε να χρησιμοποιηθεί για ανάπτυξη συμβατικών οπλικών συστημάτων, από πυροβόλα και drones έως πυραύλους και βόμβες.

Παράλληλα, η εταιρεία εντόπισε ύποπτους χρήστες που συνδέονταν με την Κίνα και το Ιράν να χρησιμοποιούν το Claude για παρακολούθηση αντιφρονούντων και κοινοτήτων της διασποράς.

Τέλος, ρωσικά κρατικά μέσα αξιοποίησαν επίσης το μοντέλο για την παραγωγή διαδικτυακής προπαγάνδας που παρουσιαζόταν ως ανεξάρτητη δημοσιογραφία, ακόμη και με κατασκευασμένους ισχυρισμούς γύρω από εκλογές στη Μολδαβία.

«Επικίνδυνοι χρήστες κρύβονται σε κοινή θέα»

Η Σούζαν Μονάρεζ, μικροβιολόγος και ειδικός στη δημόσια υγεία, η οποία εργαζόταν για την εθνική ετοιμότητα βιοασφάλειας των ΗΠΑ επί κυβέρνησης Ομπάμα, χαρακτήρισε τα ευρήματα πραγματική ένδειξη ότι κακόβουλοι χρήστες προσπαθούν ήδη να αξιοποιήσουν κρυφά τα πιο προηγμένα μοντέλα.

Σύμφωνα με την ίδια, οι ίδιες δυνατότητες που μπορούν να οδηγήσουν σε θεαματικές ιατρικές ανακαλύψεις μπορούν ταυτόχρονα να επιτρέψουν σε επικίνδυνους χρήστες να «κρύβονται σε κοινή θέα», χρησιμοποιώντας φαινομενικά νόμιμη επιστημονική έρευνα για την ανάπτυξη παθογόνων, οι οποίοι μπορεί να είναι εξαιρετικά δύσκολο να σταματήσουν μετά την απελευθέρωσή τους.

Από την πλευρά του, ο Άντριου Γουέμπερ, πρώην υφυπουργός Άμυνας των ΗΠΑ για προγράμματα πυρηνικής, χημικής και βιολογικής άμυνας, χαρακτήρισε τις περιπτώσεις «ανατριχιαστικά παραδείγματα» κρατικά υποστηριζόμενων ερευνητών που επιχειρούν να αξιοποιήσουν τις ταχύτατα εξελισσόμενες δυνατότητες των προηγμένων μοντέλων ΑΙ.

Όπως αναφέρει, η πρόσβαση σε συστήματα ικανά να υποστηρίζουν τόσο προηγμένη βιολογική έρευνα θα πρέπει να περιορίζεται σε απολύτως αξιόπιστους επιστήμονες.

Ο νέος αγώνας δρόμου των εταιρειών ΑΙ

Η έκθεση της Anthropic με τα ανησυχητικά ευρήματα έρχεται τη στιγμή κατά την οποία τα κορυφαία μοντέλα ΑΙ γίνονται όλο και πιο ικανά να εκτελούν σύνθετες επιστημονικές και τεχνικές εργασίες. Η ίδια η Anthropic αναφέρει ότι οι παλαιότερες εκδόσεις των μοντέλων της, όταν εξετάστηκαν πέρυσι, δεν ήταν ακόμη σε θέση να προσφέρουν ουσιαστική βοήθεια σε τέτοιου είδους έρευνες και εργασίες.

Τα σημερινά μοντέλα, όμως, έχουν πλέον πολύ μεγαλύτερες δυνατότητες. Γι’ αυτό, ήδη η Anthropic έχει αυστηροποιήσει τις δικλίδες ασφαλείας για ένα ευρύ φάσμα βιολογικών ερωτημάτων διπλής χρήσης.

Το πρόβλημα είναι ότι η άμυνα εξελίσσεται ταυτόχρονα με την επίθεση. Όσο τα συστήματα γίνονται πιο έξυπνα, τόσο περισσότερο μπορούν να βοηθήσουν επιστήμονες, προγραμματιστές και μηχανικούς. Παράλληλα, τόσο μεγαλύτερη γίνεται η αξία τους για κυβερνήσεις, ένοπλες οργανώσεις ή μεμονωμένους χρήστες που θέλουν να πετύχουν ακριβώς το αντίθετο από εκείνο για το οποίο σχεδιάστηκαν τα μοντέλα ΑΙ.

Η Anthropic ανακοίνωσε ότι απαγόρευσε τους λογαριασμούς που συνδέονταν με τις επικίνδυνες δραστηριότητες και μοιράστηκε τις πληροφορίες σχετικά με αυτούς με κυβερνητικούς και ιδιωτικούς φορείς.

Στην περίπτωση της Υεμένης, όμως, διαπίστωσε κάτι ακόμη πιο ανησυχητικό. Η ομάδα είχε ήδη κατασκευάσει offline εργαλεία προσομοίωσης, τα οποία μπορούσαν να λειτουργήσουν χωρίς περαιτέρω πρόσβαση στο Claude. Αυτό πρακτικά σημαίνει ότι όταν η εταιρεία μπλόκαρε αυτούς τους λογαριασμούς ένα μέρος της τεχνογνωσίας που είχαν ήδη παράγει είχε φύγει από τον έλεγχό της και βρισκόταν πλέον στα χέρια αυτών των χρηστών.