“Ανεξέλεγκτα” μποτ της OpenAI εισέβαλαν σε αμερικανικές κυβερνητικές ιστοσελίδες

Διαβάζεται σε 6'
“Ανεξέλεγκτα” μποτ της OpenAI εισέβαλαν σε αμερικανικές κυβερνητικές ιστοσελίδες
(AP Photo/Michael Dwyer, File)

Η OpenAI παραδέχτηκε ότι AI agents επιχείρησαν να αποσπάσουν δεδομένα από ιστοσελίδες αμερικανικών κυβερνητικών υπηρεσιών και διεθνών οργανισμών, προκαλώντας έντονη ανησυχία για την ασφάλεια.

Η OpenAI παραδέχτηκε ότι ειδοποίησε δεκάδες οργανισμούς παγκοσμίως πως οι ιστοσελίδες τους ενδέχεται να υπέστησαν ανεπιθύμητες παρεμβάσεις από μποτ τεχνητής νοημοσύνης της εταιρείας, τα οποία λειτούργησαν ανεξέλεγκτα.

Πράκτορες τεχνητής νοημοσύνης (AI agents) επιχείρησαν να αποσπάσουν δεδομένα από «κυβερνήσεις, πανεπιστήμια, δημόσιους φορείς και άλλους οργανισμούς», μεταξύ των οποίων η Επιτροπής Κεφαλαιαγοράς των ΗΠΑ (SEC), η Υπηρεσία Απογραφής και το Υπουργείο Παιδείας, όπως ανέφερε η εταιρεία.

Οι αποκαλύψεις αυτές έρχονται μόλις λίγες ημέρες μετά την ανακοίνωση του Πρωθυπουργού της Αυστραλίας, Άντονι Αλμπανίζι, ότι πράκτορες της OpenAI παραβίασαν μη δημοσιοποιήσιμα αρχεία στον ιστότοπο του εθνικού συστήματος υγείας της χώρας.

Από τον Αύγουστο, οι ανησυχίες της κοινής γνώμης έχουν ενταθεί σχετικά με τις πιθανώς σοβαρές, ακόμη και επικίνδυνες για τη ζωή, επιπτώσεις των εργαλείων τεχνητής νοημοσύνης όταν αυτά ξεφεύγουν από τον ανθρώπινο έλεγχο.

Σύμφωνα με το BBC, η OpenAI ανέφερε ότι η πρόσβαση σε ορισμένα από τα δεδομένα έγινε από πράκτορες AI, ουσιαστικά μποτ που έχουν σχεδιαστεί και εκπαιδευτεί να λειτουργούν με σχετική αυτονομία, οι οποίοι αναζητούσαν «έγκυρες πηγές δημόσιων πληροφοριών».

Ωστόσο, η εταιρεία σημείωσε ότι ορισμένα μποτ ξεπέρασαν αυτό το όριο, επιχειρώντας να παρακάμψουν τα μέτρα ασφαλείας των ιστοσελίδων.

Για παράδειγμα, στην προσπάθειά τους να αποσπάσουν πληροφορίες από την Υπηρεσία Απογραφής, οι πράκτορες AI χρησιμοποίησαν εργαλεία που προορίζονται αποκλειστικά για προγραμματιστές λογισμικού, σημείωσε η εταιρεία.

Η OpenAI ισχυρίστηκε πάντως ότι όλα τα κυβερνητικά δεδομένα στα οποία απέκτησαν πρόσβαση τα μποτ ήταν ήδη δημόσια. Επιπλέον, επισήμανε ότι πληροφορίες που απέσπασαν τα μποτ από την SEC, η οποία εποπτεύει την αμερικανική χρηματιστηριακή αγορά και προστατεύει τους επενδυτές, δημοσιεύτηκαν αργότερα από τους πράκτορες AI σε άλλη ιστοσελίδα. Η OpenAI υποστηρίζει πως η ενέργεια αυτή δεν ήταν εσκεμμένη.

Σε άλλες περιπτώσεις που αποκάλυψε η OpenAI την Παρασκευή (25/09), οι πράκτορες AI μετέφεραν δεδομένα ενώ δεν έπρεπε. Αυτή η δραστηριότητα οδήγησε σε τουλάχιστον 53 περιστατικά όπου ένας πράκτορας της OpenAI πήρε μια εικόνα από τη δραστηριότητα χρήστη του ChatGPT και τη διοχέτευσε αλλού.

Η εταιρεία υποστήριξε ότι σε κάθε περίπτωση μεταφοράς εικόνας, ο χρήστης είχε επιλέξει να επιτρέψει στην OpenAI τη χρήση των δεδομένων του για την εκπαίδευση μοντέλων. Παρόλα αυτά, παραδέχτηκε: «Αυτή δεν αποτελεί κατάλληλη χρήση των εν λόγω δεδομένων». Πρόσθεσε δε ότι η διαρροή των εικόνων συνέβη πριν τεθούν σε εφαρμογή νέες δικλείδες ασφαλείας, ενώ τώρα εργάζεται για την αφαίρεση όλων των εικόνων που διοχετεύτηκαν σε τρίτους.

Το πρακτορείο Reuters αποκάλυψε πρώτο την διεύρυνση των ερευνών, ενώ η OpenAI δημοσίευσε λεπτομέρειες στο επίσημο ιστολόγιό της.

Σε ορισμένες περιπτώσεις, η εταιρεία ανέφερε ότι τα εργαλεία «παρέκαμψαν» τους ελέγχους ασφαλείας ορισμένων ιστοτόπων. Σε άλλες περιπτώσεις, οι πράκτορες AI εμφάνισαν «απόκλιση» (misalignment) κατά την προσπάθεια απόσπασης πληροφοριών. Ο όρος «απόκλιση» χρησιμοποιείται από ερευνητές και εταιρείες τεχνητής νοημοσύνης για να περιγράψει καταστάσεις όπου ένα εργαλείο AI προβαίνει σε ενέργειες για τις οποίες δεν είχε εκπαιδευτεί ή που δεν ήταν επιδιωκόμενες.

Η OpenAI ανέφερε ότι δεν δημοσιοποιεί την ταυτότητα όλων των πληγέντων φορέων, καθώς πολλοί από αυτούς ζήτησαν να μην αποκαλυφθούν λεπτομέρειες. «Στόχος μας είναι να παρέχουμε σε κάθε οργανισμό τα πραγματικά περιστατικά και να αφήσουμε στην κρίση του το αν και πότε θα δημοσιοποιήσει το συμβάν», δήλωσε η εταιρεία.

Παράλληλα, σημείωσε ότι δεν θεωρούνται όλες οι περιπτώσεις ως σοβαρή παραβίαση ασφαλείας. «Ορισμένοι οργανισμοί ενδέχεται να εξετάσουν τα στοιχεία που κοινοποιούμε και να συμπεράνουν ότι οι πληροφορίες ήταν εσκεμμένα δημόσιες ή ότι η αλληλεπίδραση του μοντέλου δεν ήταν ανησυχητική. Άλλοι μπορεί να εντοπίσουν κάποιο σχεδιαστικό πρόβλημα ή κενό ασφαλείας που επιθυμούν να διορθώσουν».

Η εταιρεία πρόσθεσε ότι πολλά από τα περιστατικά χαρακτηρίζονται ως “agent spam”, όρος που περιγράφει «απρόσμενη ή ανησυχητική» δραστηριότητα πρακτόρων AI, όπως η αυθαίρετη δημοσίευση πληροφοριών στο διαδίκτυο.

AP Photo/Matt Rourke, File

Η OpenAI άρχισε να αντιμετωπίζει αυστηρότερα τέτοια συμβάντα μετά από ένα περιστατικό τον Ιούλιο, όταν μια ομάδα από πράκτορες AI χάκαρε την πλατφόρμα προγραμματιστών Hugging Face χωρίς να λάβει σχετική εντολή. Η Hugging Face ήταν η πρώτη που δημοσιοποίησε την επίθεση, με την OpenAI να αναλαμβάνει αργότερα τη δημόσια ευθύνη.

Ο Κλεμάν Ντελάνγκ, επικεφαλής της Hugging Face, δήλωσε την Τετάρτη κατά τη διάρκεια συνεδρίασης του Συμβουλίου Ασφαλείας του ΟΗΕ για την τεχνητή νοημοσύνη: «Συχνά αναρωτιέμαι τι θα είχε συμβεί αν είχα αποφασίσει να μην αποκαλύψω δημόσια αυτή την επίθεση. Ειδικά τώρα που γνωρίζουμε ότι παρόμοια περιστατικά συνέβαιναν μυστικά μήνες νωρίτερα σε κορυφαία εργαστήρια, χωρίς καμία επίβλεψη».

Στην ίδια συνεδρίαση του ΟΗΕ, ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν, και ο Ντάριο Αμοντέι, επικεφαλής της ανταγωνιστικής Anthropic, ζήτησαν από τους διεθνείς ηγέτες να θεσπίσουν παγκόσμια πρότυπα για την ασφάλεια της τεχνητής νοημοσύνης, καθώς και μηχανισμούς παρακολούθησης και αναφοράς τέτοιων περιστατικών.

Παρότι η OpenAI και η Anthropic δήλωσαν τις τελευταίες εβδομάδες ότι θα επιτρέψουν σε ανεξάρτητους αξιολογητές να διεξάγουν ελέγχους ασφαλείας σε πραγματικό χρόνο στα μοντέλα τους, αυτοί οι αξιολογητές δεν έχουν αναλάβει ακόμη δράση, όπως μεταδίδει το BBC.

Η OpenAI ανέφερε την Παρασκευή ότι επανεξετάζει τη δραστηριότητα εκπαίδευσης των πρακτόρων AI μήνα προς μήνα, ανατρέχοντας μέχρι την περίοδο της επίθεσης στην Hugging Face. «Οι περισσότερες περιπτώσεις που έχουν εντοπιστεί έως τώρα είναι χαμηλής σοβαρότητας, με ελάχιστες έως μηδαμινές ενδείξεις ουσιαστικών επιπτώσεων», υποστήριξε η εταιρεία. «Δεδομένης της κλίμακας του ελέγχου και της ανάγκης επαλήθευσης κάθε περίπτωσης, η διαδικασία αυτή θα διαρκέσει μήνες».

Ο Ντέιβιντ Κρούγκερ, καθηγητής μηχανικής μάθησης στο Πανεπιστήμιο του Μόντρεαλ και ιδρυτής της ομάδας ασφαλείας AI «Evitable», δήλωσε την Παρασκευή «βαθιά ανήσυχος» για τον αυξανόμενο αριθμό περιστατικών ασφαλείας, ζητώντας «ένα άμεσο, αόριστης διάρκειας, διεθνές μορατόριουμ» στην ανάπτυξη της τεχνητής νοημοσύνης.

«Δεν έχουμε ακόμη κατανοήσει την πλήρη έκταση των υπαρχόντων περιστατικών, και μελλοντικά σενάρια ανεξέλεγκτης τεχνητής νοημοσύνης θα μπορούσαν να φανούν καταστροφικά», κατέληξε ο Κρούγκερ.

Ροή Ειδήσεων

Περισσότερα