Χάκαραν την OpenAI χρησιμοποιώντας εργαλεία της Anthropic

Διαβάζεται σε 4'
Χάκαραν την OpenAI χρησιμοποιώντας εργαλεία της Anthropic
Μοντέλα AI ISTOCK

Ερευνητές κυβερνοασφάλειας απέκτησαν πρόσβαση σε λογαριασμό εργαζομένου της OpenAI, αναδεικνύοντας νέα κενά ασφαλείας την ώρα που εντείνονται οι ανησυχίες για την αυτονομία των ισχυρών μοντέλων AI

Ερευνητές κυβερνοασφάλειας παραβίασαν συστήματα της OpenAI χρησιμοποιώντας λογισμικό της βασικής ανταγωνίστριάς της, Anthropic, αναδεικνύοντας ευπάθειες στην ασφάλεια της εταιρείας που δημιούργησε το ChatGPT, την ώρα που οι κορυφαίες εταιρείες τεχνητής νοημοσύνης βρίσκονται αντιμέτωπες με αυξανόμενο έλεγχο για ζητήματα ασφάλειας.

Μια μικρή ομάδα κυβερνοασφάλειας απέκτησε πρόσβαση στον λογαριασμό ChatGPT ενός εργαζομένου της OpenAI, γεγονός που της επέτρεψε να διαβάσει ιδιωτικές πληροφορίες σχετικά με λογισμικό και να προτείνει αλλαγές.

Συγκεκριμένα, όπως αναφέρουν οι Financial Times, οι ερευνητές είχαν αποκτήσει πρόσβαση σε ένα εργαλείο της Anthropic, ειδικά σχεδιασμένο για επαγγελματίες της ασφάλειας, και πληρώθηκαν για την εργασία τους στο πλαίσιο ενός προγράμματος εντοπισμού ευπαθειών προτού αυτές μπορέσουν να αξιοποιηθούν από κακόβουλους παράγοντες.

Η δυνατότητά τους να παραβιάσουν γρήγορα ένα από τα δύο κορυφαία εργαστήρια τεχνητής νοημοσύνης στον κόσμο εγείρει εκ νέου ανησυχίες για την ασφάλεια της OpenAI, εν μέσω αυξανόμενων φόβων ότι ισχυρά μοντέλα μπορούν να χρησιμοποιηθούν από χάκερ και ξένους αντιπάλους.

Τους τελευταίους μήνες, οι ΗΠΑ προσπαθούν να διαχειριστούν τον έλεγχο και τη διάθεση των πιο πρόσφατων μοντέλων, φτάνοντας ακόμη και στο σημείο να μπλοκάρουν προσωρινά ορισμένα εργαλεία της Anthropic.

Το τελευταίο περιστατικό σημειώθηκε μόλις δύο εβδομάδες αφότου ένα σμήνος περισσότερων από 1.000 agents της OpenAI ξέφυγε από ένα δοκιμαστικό περιβάλλον και παραβίασε τη start-up Hugging Face, γεγονός που προκάλεσε ευρεία ανησυχία για την ικανότητα της τεχνητής νοημοσύνης να πραγματοποιεί αυτόνομα κυβερνοεπιθέσεις, χωρίς ανθρώπινη πρόθεση.

Οι τρεις ερευνητές της Hacktron AI, μιας μικρής εταιρείας κυβερνοασφάλειας, έλαβαν 6.500 δολάρια από την OpenAI στο πλαίσιο ενός προγράμματος bug bounty, μιας συνηθισμένης πρακτικής κατά την οποία οι τεχνολογικές εταιρείες πληρώνουν ηθικούς χάκερ για να δοκιμάζουν την ασφάλειά τους.

Εκμεταλλεύτηκαν ένα κενό ασφαλείας στη διαμόρφωση του φόρουμ κοινότητας της OpenAI, το οποίο φιλοξενείται από τρίτο πάροχο, τη Discourse, και το χρησιμοποίησαν για να αποκτήσουν πρόσβαση σε εσωτερικά συστήματα σύνδεσης και, τελικά, στον λογαριασμό ChatGPT ενός εργαζομένου της OpenAI. Ο συγκεκριμένος λογαριασμός ChatGPT είχε πρόσβαση σε εσωτερικό κώδικα μέσω του GitHub.

«Ευχαριστούμε τους ερευνητές που επικοινώνησαν μαζί μας και μοιράστηκαν τα ευρήματά τους», ανέφερε η OpenAI, προσθέτοντας ότι διόρθωσε τα ζητήματα. Η Anthropic αρνήθηκε να σχολιάσει. Η Hacktron δεν απάντησε άμεσα.

Η αποκάλυψη της Πέμπτης (17/9), την οποία μετέδωσε πρώτη η Wall Street Journal, έγινε την ώρα που η Anthropic δημοσίευσε ένα νέο σύνολο δεδομένων, το οποίο έδειξε ταχεία αύξηση στον βαθμό στον οποίο το εργαστήριο χρησιμοποιούσε τεχνητή νοημοσύνη για την ανάπτυξη των νέων μοντέλων του.

Η εταιρεία ανέφερε ότι το 26% της εργασίας έρευνας και ανάπτυξης «καθοδηγούνταν από» το μοντέλο Claude, από 1% τον Μάρτιο, πράγμα που σημαίνει ότι η τεχνητή νοημοσύνη ολοκλήρωνε την πλειονότητα των εργασιών βάσει ανθρώπινων οδηγιών και υπό επίβλεψη.

Η εταιρεία ανέφερε ότι, καθώς τα συστήματα τεχνητής νοημοσύνης γίνονται ισχυρότερα, «χρησιμοποιούνται ολοένα και περισσότερο για να δημιουργούν την επόμενη εκδοχή του εαυτού τους».

Η Anthropic ανέφερε ότι δημοσιοποίησε τα δεδομένα προκειμένου να βοηθήσει το κοινό να «κατανοήσει πόσο κοντά βρίσκεται ο κόσμος στην επίτευξη της αναδρομικής αυτοβελτίωσης», του σημείου δηλαδή στο οποίο η τεχνητή νοημοσύνη μπορεί να εκπαιδεύει και να βελτιώνει τον εαυτό της ή νέα μοντέλα.

Αυτό το όριο βρίσκεται στον πυρήνα των ανησυχιών ότι τα συστήματα τεχνητής νοημοσύνης θα γίνουν δυσκολότερο να εποπτευθούν, οδηγώντας σε απώλεια του ανθρώπινου ελέγχου.

Η Anthropic πρόσθεσε ότι τα μοντέλα της δεν λειτουργούσαν ακόμη πλήρως αυτόνομα σε καμία από τις ερευνητικές εργασίες που μελέτησε. Στο 90% των εργασιών, η τεχνητή νοημοσύνη «συνεργάζεται» με έναν άνθρωπο και αναλαμβάνει μεγάλα τμήματα της δουλειάς.

Ροή Ειδήσεων

Περισσότερα