Πρωτοφανές: “Πράκτορες” της OpenAI αυτονομήθηκαν και χάκαραν εταιρεία

Διαβάζεται σε 5'
Large Language Model
Large Language Model iStock

Η OpenAI δήλωσε ότι αυτόνομος agent της διέφυγε από τις δικλείδες ασφαλείας και τους περιορισμούς που του είχαν τεθεί και χάκαρε startup τεχνητής νοημοσύνης κλέβοντας δεδομένα της.

Η OpenAI ανακοίνωσε την Τρίτη ότι ένας αυτόνομος πράκτορας που τροφοδοτείται από τα προηγμένα μοντέλα τεχνητής νοημοσύνης της, ξέφυγε από τον έλεγχο κατά τη διάρκεια δοκιμής ασφαλείας και προκάλεσε κυβερνοεπίθεση που παραβίασε την υποδομή της τεχνολογικής startup τεχνητής νοημοσύνης Hugging Face την περασμένη εβδομάδα. Σε ανάρτηση στο blog της, η OpenAI ανέφερε ότι δοκίμαζε τις δυνατότητες ορισμένων από τα πιο προηγμένα μοντέλα της σε ελεγχόμενο περιβάλλον, ωστόσο ο πράκτορας κατάφερε να ξεφύγει από τον περιορισμό, να αποκτήσει πρόσβαση στο διαδίκτυο και να εισβάλει στο Hugging Face προκειμένου να επιτύχει τον στόχο της δοκιμής του.

Η OpenAI δήλωσε ότι η παραβίαση ήταν “ένα πρωτοφανές κυβερνοπεριστατικό, που περιελάμβανε τελευταίας τεχνολογίας κυβερνοδυνατότητες” και ότι η εταιρεία ενισχύει τις δικλείδες της. Ο Sam Altman, CEO της εταιρείας, παραδέχθηκε πως τέτοια περιστατικά “θα γίνουν πιο συχνά καθώς θα πολλαπλασιάζονται τα ολοένα και πιο ικανά μοντέλα LLM στον κυβερνοχώρο”. “Θα συνεχίσουμε να διεξάγουμε μια διεξοδική έρευνα σε συνεργασία με τη Hugging Face και θα κοινοποιήσουμε περισσότερες λεπτομέρειες σχετικά με τα τρωτά σημεία, το περιστατικό και τα ευρήματα όταν ολοκληρωθεί η έρευνά μας”, ανέφερε. Δήλωσε πως ο agent απέκτησε πρόσβαση στο διαδίκτυο και βρήκε με επιτυχία τρόπους για να αποκτήσει πρόσβαση σε μυστικές πληροφορίες που θα μπορούσε να χρησιμοποιήσει για να παραπλανήσει την αξιολόγηση της Hugging Face.

Το τελευταίο περιστατικό αφορούσε έναν συνδυασμό μοντέλων της OpenAI, συμπεριλαμβανομένου του GPT-5.6 Sol, που κυκλοφόρησε νωρίτερα αυτόν τον μήνα, καθώς και ένα πιο ικανό μοντέλο που δοκιμαζόταν πριν από την κυκλοφορία του.

Η OpenAI είχε μειώσει σκόπιμα τις κυβερνοασφάλειές της για να αξιολογήσει και τα δύο μοντέλα σε ένα δοκιμαστικό περιβάλλον. Ωστόσο, οι πράκτορες λειτουργούσαν σε ένα λεγόμενο sandbox, σχεδιασμένο για να ελέγχει τα συστήματα και να τα εμποδίζει να έχουν πρόσβαση στο διαδίκτυο.

Η ομάδα ασφαλείας της OpenAI ανακάλυψε αυτήν την ασυνήθιστη δραστηριότητα εσωτερικά.

Η Hugging Face, μια πλατφόρμα που χρησιμοποιείται για τη φιλοξενία ανοιχτού κώδικα μεγάλων γλωσσικών μοντέλων και συνόλων δεδομένων, προκάλεσε αναταραχή στην κοινότητα κυβερνοασφάλειας όταν ανέφερε σε ανάρτηση στο επίσημο blog της την περασμένη εβδομάδα ότι είχε πέσει θύμα επίθεσης που “ήταν διαφορετική από οτιδήποτε είχαμε αντιμετωπίσει στο παρελθόν”, καθώς “ήταν καθοδηγούμενη από ένα αυτόνομο σύστημα τεχνητής νοημοσύνης”.

“Το κύριο μάθημα από αυτό το περιστατικό είναι ότι η ασφάλεια και η προστασία των μοντέλων πρέπει να συμβαδίζουν με τις ταχέως εξελισσόμενες δυνατότητες. Ενισχύουμε τις πρακτικές περιορισμού, παρακολούθησης, ελέγχου πρόσβασης και αξιολόγησης που χρησιμοποιούνται κατά την ανάπτυξη μοντέλων” σημείωσε η OpenAI για την “αυτονόμηση” του agent.

Σε ανάρτησή του στο X, ο συνιδρυτής της Hugging Face, Clement Delangue, δήλωσε ότι η εταιρεία υποπτευόταν ότι η επίθεση “μπορεί να προήλθε από ένα εργαστήριο αιχμής, δεδομένης της εξελιγμένης φύσης του πράκτορα. Αποδείχθηκε ότι πράγματι έτσι ήταν!” Πρόσθεσε: “Είναι εντελώς εκπληκτικό που όλα αυτά συνέβησαν αυτόνομα!”.

Η Hugging Face χρησιμοποίησε τους δικούς της πράκτορες για να εντοπίσει και να σταματήσει τη δραστηριότητα στην δική της υποδομή. Η OpenAI δήλωσε στους FT ότι επικοινώνησε με τις αρχές επιβολής του νόμου και άλλες κυβερνητικές αρχές σχετικά με το περιστατικό.

Αυξάνεται η ανησυχία για την αυτόνομη AI

Η αποκάλυψη της OpenAI ότι τα προηγμένα μοντέλα της ήταν υπεύθυνα για την παραβίαση, παρά το γεγονός ότι τα είχε τοποθετήσει σε αυτό που περιέγραψε ως “ένα εξαιρετικά απομονωμένο περιβάλλον”, είναι πιθανό να εντείνει την ανησυχία για τη δύναμη και τον κίνδυνο των μοντέλων αιχμής.

Ο Δημοκρατικός βουλευτής από το Τέξας Greg Casar, δήλωσε ότι το περιστατικό ήταν ανησυχητικό.

“Η τεχνητή νοημοσύνη αναπτύσσεται εξαιρετικά γρήγορα χωρίς πραγματικούς κανονισμούς που να μας κρατούν ασφαλείς”, είπε σε δήλωσή του, ζητώντας υποχρεωτικές ανεξάρτητες δοκιμές ασφαλείας, υποχρεωτική γνωστοποίηση περιστατικών ασφαλείας και διεθνή συνεργασία “για να προστατευτούν οι άνθρωποι από απόλυτη καταστροφή”.

Το Γραφείο της Εθνικής Διεύθυνσης Κυβερνοχώρου των ΗΠΑ, η αμερικανική υπηρεσία κυβερνοάμυνας CISA και η Υπηρεσία Εθνικής Ασφάλειας των ΗΠΑ δεν απάντησαν άμεσα σε σχετικές ερωτήσεις του Reuters.

Η Katie Moussouris, διευθύνουσα σύμβουλος της Luta Security, δήλωσε ότι το περιστατικό ήταν οιωνός παραβιάσεων που θα ακολουθήσουν, λέγοντας ότι τα σημερινά μοντέλα είναι “σαν τα πιο έξυπνα χταπόδια του κόσμου που δραπετεύουν από παντού, με απεριόριστα εύκαμπτα πλοκάμια και την ικανότητα να χώνονται οπουδήποτε”.

Δήλωσε ότι “τα εργαστήρια και οι κυβερνητικοί αξιωματούχοι πρέπει να εργαστούν για την ικανότητα να περιορίζουν, να παρακολουθούν και να γνωστοποιούν στα εμπλεκόμενα μέρη, όταν μια τεχνητή νοημοσύνη κάνει τον “Χουντίνι”, πριν προλάβει να βλάψει κάποιο τρίτο μέρος. Τίποτα τέτοιο δεν υπάρχει σήμερα”.

Ο Matt Suiche, μηχανικός στην εταιρεία κυβερνοασφάλειας αυτόνομης τεχνητής νοημοσύνης Tolmo, δήλωσε ότι το περιστατικό έδειξε ότι τα μοντέλα αιχμής “μειώνουν την απόστασή τους με τους πιο εξελιγμένους χάκερς”. Ωστόσο, είπε ότι οι τύποι παραβιάσεων που περιγράφονται στην ανάρτηση blog της OpenAI ήταν δυνατό να πραγματοποιηθούν και με τεχνολογία που ήταν διαθέσιμη και έξω από το περιβάλλον των εργαστηρίων αιχμής.

“Αυτό είναι κάτι που έχουμε ήδη δει εσωτερικά· με τους πράκτορές μας έχουμε ήδη αποτελέσματα σαν αυτά”, είπε ο Suiche. “Δεν χρειάζεται καν να χρησιμοποιούμε τα πιο πρόσφατα μοντέλα AI”.

Ροή Ειδήσεων

Περισσότερα