Η OpenAI αποκάλυψε ένα περιστατικό που προκαλεί ανησυχία και εγρήγορση
Μια αποκάλυψη που θυμίζει σενάριο από ταινία επιστημονικής φαντασίας έκανε η OpenAI, η εταιρία-δημιουργός του ChatGPT. Όπως ενημέρωσε, ένας συνδυασμός μοντέλων AI agent, συμπεριλαμβανομένου του GPT-5.6 Sol και ενός «ακόμα πιο ισχυρού pre-release μοντέλου»- κατάφερε να παρακάμψει τα μέτρα περιορισμού κατά τη διάρκεια ελεγχόμενης δοκιμής, να αποκτήσει πρόσβαση στο διαδίκτυο και να παραβιάσει την υποδομή της πλατφόρμας Hugging Face.
Η εταιρεία χαρακτήρισε το περιστατικό «πρωτοφανές», ανακοινώνοντας ότι ενισχύει άμεσα τις δικλίδες ασφαλείας των μοντέλων της καθώς το γεγονός ενισχύει την ανησυχία για την ασφάλεια των πιο προηγμένων συστημάτων τεχνητής νοημοσύνης.
Τι ακριβώς συνέβη
Σύμφωνα με την OpenAI, το περιστατικό συνέβη κατά τη
διάρκεια μιας εσωτερικής δοκιμής, η οποία είχε στόχο να μετρήσει πόσο ικανό
είναι ένα μοντέλο τεχνητής νοημοσύνης να εντοπίζει και να εκμεταλλεύεται
αδυναμίες σε συστήματα υπολογιστών. Για να γίνει η μέτρηση όσο το δυνατόν πιο
ρεαλιστική, η δοκιμή πραγματοποιήθηκε χωρίς τα συνηθισμένα μέτρα ασφαλείας που
υπάρχουν στα κανονικά μοντέλα και τα εμποδίζουν να επιχειρούν επικίνδυνες
ενέργειες.
Αυτό που τονίζει ωστόσο η OpenAI, είναι ότι η δοκιμή γινόταν
σε ένα απομονωμένο περιβάλλον, χωρίς ολοκληρωμένη πρόσβαση στο Διαδίκτυο. Η μόνη
δυνατότητα που είχαν τα μοντέλα ήταν να εγκαθιστούν απαραίτητα πακέτα
λογισμικού μέσω ενός ειδικού εσωτερικού συστήματος.
Ωστόσο, ο αυτόνομος AI agent εντόπισε αδυναμίες τόσο στο
εσωτερικό περιβάλλον της OpenAI όσο και στα συστήματα της Hugging Face.
Συνδυάζοντας αυτές τις αδυναμίες, κατάφεραν να αποκτήσουν πρόσβαση στις
απαντήσεις της δοκιμής που βρίσκονταν στη βάση δεδομένων της Hugging Face. Η OpenAI
εκτιμά ότι ο μοναδικός στόχος του μοντέλου ήταν να βρει σωστά τη λύση της
συγκεκριμένης δοκιμασίας, ακόμη κι αν αυτό απαιτούσε πολύπλοκες και ακραίες
ενέργειες.
Έτσι, αφιέρωσαν μεγάλο μέρος της υπολογιστικής τους ισχύος,
για να βρουν τον τρόπο να αποκτήσουν πρόσβαση στο κανονικό Διαδίκτυο.
Ανακάλυψαν μια άγνωστη μέχρι τότε αδυναμία ασφαλείας της OpenAI και την
εκμεταλλεύτηκαν. Στη συνέχεια απέκτησαν σταδιακά περισσότερα δικαιώματα μέσα
στο δοκιμαστικό περιβάλλον, μέχρι να φτάσουν σε έναν υπολογιστή που είχε
πρόσβαση στο διαδίκτυο.
Αφού συνδέθηκαν στο Διαδίκτυο, υπέθεσαν ότι η Hugging Face
ίσως φιλοξενούσε αρχεία και πληροφορίες σχετικές με τη δοκιμή. Έτσι αναζήτησαν
τρόπους να αποκτήσουν πρόσβαση σε μυστικά δεδομένα που θα τους επέτρεπαν να
«κλέψουν» στις εξετάσεις. Σε μία περίπτωση, χρησιμοποίησαν συνδυασμό
διαφορετικών τεχνικών, όπως κλεμμένα στοιχεία σύνδεσης και άγνωστες αδυναμίες
ασφαλείας, για να αποκτήσουν τη δυνατότητα να τρέξουν τον κώδικα στους
διακομιστές της Hugging Face.
Η ασυνήθιστη αυτή δραστηριότητα εντοπίστηκε από την ομάδα
ασφαλείας της OpenAI. Παράλληλα, η ομάδα ασφαλείας της Hugging Face είχε επίσης
εντοπίσει και σταματήσει τις ενέργειες στα δικά της συστήματα και είχε ήδη
ξεκινήσει τη διερεύνηση του περιστατικού. Η OpenAI τονίζει ότι οι δύο εταιρείες
συνεργάζονται για να κατανοήσουν πλήρως τι συνέβη και να αποτρέψουν παρόμοια
περιστατικά στο μέλλον.
Αυτόνομη ΑΙ επίθεση
Το Hugging Face είναι μία από τις μεγαλύτερες πλατφόρμες φιλοξενίας ανοικτών
μεγάλων γλωσσικών μοντέλων (LLMs)
και συνόλων δεδομένων. Μάλιστα, την προηγούμενη εβδομάδα είχε αποκαλύψει ότι
δέχθηκε μια κυβερνοεπίθεση «διαφορετική από οτιδήποτε είχε αντιμετωπίσει μέχρι
σήμερα».
Η εταιρεία είχε αναφέρει ότι η επίθεση πραγματοποιήθηκε εξ
ολοκλήρου από ένα αυτόνομο σύστημα τεχνητής νοημοσύνης, χωρίς ανθρώπινη
παρέμβαση.
Ο συνιδρυτής της πλατφόρμας, Κλεμάν Ντελάνγκ, σχολίασε μέσω
της πλατφόρμας X ότι η
εταιρεία αρχικά υπέθεσε πως η επίθεση προερχόταν από κάποιο κορυφαίο εργαστήριο
ανάπτυξης AI, λόγω της
πολυπλοκότητας του συστήματος.
«Αποδείχθηκε ότι πράγματι συνέβη. Είναι πραγματικά
εντυπωσιακό ότι όλα αυτά έγιναν αυτόνομα», ανέφερε χαρακτηριστικά.
Η εταιρεία παραδέχτηκε ότι αναμένει τέτοια περιστατικά να
«γίνουν πιο συνηθισμένα με την αύξηση όλο και cyber-capable μοντέλων».
Η παραδοχή της OpenAI ότι η παραβίαση προήλθε από δικά της προηγμένα μοντέλα,
παρά το γεγονός ότι βρίσκονταν σε αυτό που η ίδια περιέγραψε ως «υψηλά
απομονωμένο περιβάλλον», εντείνει τη συζήτηση γύρω από τους κινδύνους που
ενδέχεται να συνεπάγεται η ανάπτυξη ολοένα ισχυρότερων συστημάτων τεχνητής
νοημοσύνης.
Ο Αμερικανός βουλευτής Γκρεγκ Κασάρ χαρακτήρισε το
περιστατικό ιδιαίτερα ανησυχητικό. «Η
τεχνητή νοημοσύνη εξελίσσεται με εξαιρετικά γρήγορους ρυθμούς, χωρίς να
υπάρχουν ουσιαστικοί κανονισμοί που να μας προστατεύουν», δήλωσε, ζητώντας την
καθιέρωση υποχρεωτικών ανεξάρτητων ελέγχων ασφαλείας, την υποχρεωτική
γνωστοποίηση περιστατικών κυβερνοασφάλειας και στενότερη διεθνή συνεργασία.
Η διευθύνουσα σύμβουλος της Luta Security, Κέιτι Μουσούρις,
εκτίμησε ότι το περιστατικό αποτελεί προάγγελο όσων ενδέχεται να ακολουθήσουν
στο μέλλον. «Τα σημερινά μοντέλα μοιάζουν με τα πιο ευφυή χταπόδια-δραπέτες
στον κόσμο, με απεριόριστους βραχίονες και την ικανότητα να ξεγλιστρούν από
οποιοδήποτε σημείο», σχολίασε, τονίζοντας ότι σήμερα δεν υπάρχουν επαρκείς
μηχανισμοί περιορισμού, παρακολούθησης και έγκαιρης ενημέρωσης όταν ένα σύστημα
AI ξεφεύγει από τον
έλεγχο.
