Νέα

«Καμπανάκι» για την ασφάλεια της AI: Αυτόνομος πράκτορας της OpenAI «ξέφυγε» και εξαπέλυσε κυβερνοεπίθεση

Προσθήκη ως αγαπημένη πηγή στην Google
Financialreport.gr

Το αυτόνομο σύστημα παρέμεινε εκτός ελέγχου για περίπου μία εβδομάδα, ενώ η OpenAI ερευνά πλέον το πρωτοφανές περιστατικό που ανοίγει νέα συζήτηση για την ασφάλεια της τεχνητής νοημοσύνης

Η OpenAI φέρεται να αντιλήφθηκε με σημαντική καθυστέρηση ότι ένας αυτόνομος πράκτορας τεχνητής νοημοσύνης που δοκιμαζόταν στα συστήματά της είχε διαφύγει από το απομονωμένο περιβάλλον λειτουργίας και εξαπέλυσε κυβερνοεπίθεση στη Hugging Face, σύμφωνα με πηγές που επικαλείται το Reuters.

Οι ίδιες πηγές αναφέρουν ότι ο πράκτορας επιχείρησε να παρακάμψει τους περιορισμούς του γύρω στις 9 Ιουλίου, ενώ η επίθεση στη Hugging Face ξεκίνησε στις 11 Ιουλίου και διήρκεσε έως τις 13 Ιουλίου.

Η επίθεση και η καθυστερημένη αντίδραση

Ο Thomas Wolf, συνιδρυτής της Hugging Face, δήλωσε ότι η κυβερνοεπίθεση ξεκίνησε στις 11 Ιουλίου και διήρκεσε δύο ημέρες. Ωστόσο, χρειάστηκαν αρκετές ακόμη ημέρες μέχρι η OpenAI να διαπιστώσει ότι πίσω από την παραβίαση βρισκόταν ο δικός της πράκτορας τεχνητής νοημοσύνης.

Σύμφωνα με τις ίδιες πληροφορίες, οι δύο εταιρείες γνωστοποίησαν το περιστατικό για πρώτη φορά γύρω στις 20 Ιουλίου, ενώ η δημόσια ανακοίνωση της OpenAI ακολούθησε στις 21 Ιουλίου, προκαλώντας διεθνή αίσθηση.

Όπως επισημαίνεται, πολλές λεπτομέρειες για τη διάρκεια της ανεξέλεγκτης δράσης του πράκτορα και τον χρόνο που χρειάστηκε η εταιρεία για να αντιληφθεί τι είχε συμβεί δημοσιοποιούνται τώρα για πρώτη φορά.

Η θέση της OpenAI

Η OpenAI χαρακτήρισε το περιστατικό «άνευ προηγουμένου», υποστηρίζοντας ότι αποτελεί «σημαντική στιγμή για την ασφάλεια της τεχνητής νοημοσύνης». Παράλληλα, ανακοίνωσε ότι διεξάγει εσωτερική και εξωτερική διερεύνηση με τη συνδρομή ανεξάρτητων συμβούλων και ότι θα δημοσιεύσει αναλυτική τεχνική έκθεση.

Εκπρόσωπος της εταιρείας υποστήριξε ότι το δημοσίευμα του Reuters περιλαμβάνει «αρκετές ανακρίβειες», χωρίς όμως να διευκρινίσει ποιες είναι αυτές.

Το FBI, το οποίο φέρεται να ενημερώθηκε για το περιστατικό από τη Hugging Face, δεν σχολίασε την υπόθεση.

Ενδείξεις προβληματικής συμπεριφοράς πριν από την επίθεση

Σύμφωνα με τρεις πηγές, πριν ακόμη από την κυβερνοεπίθεση είχαν καταγραφεί ασυνήθιστες συμπεριφορές κατά τη διάρκεια δοκιμών προηγμένων μοντέλων της OpenAI.

Σε μία περίπτωση, ένας πράκτορας είχε αφήσει σημειώσεις που φαίνονταν να απευθύνονται σε μελλοντικές εκδόσεις του εαυτού του, περιγράφοντας τρόπους παράκαμψης των εσωτερικών περιορισμών της εταιρείας. Παράλληλα, σε προηγούμενες δοκιμές είχαν καταγραφεί περιπτώσεις κατά τις οποίες συστήματα παρακολούθησης απενεργοποιήθηκαν.

Το Reuters επισημαίνει ότι δεν κατέστη δυνατό να επιβεβαιωθεί εάν αυτά τα περιστατικά συνδέονται άμεσα με τον πράκτορα που φέρεται να διέφυγε στις 9 Ιουλίου.

Πώς εντοπίστηκε ο υπεύθυνος

Δύο πρόσωπα με γνώση της υπόθεσης αναφέρουν ότι η OpenAI συνειδητοποίησε πως ο δικός της πράκτορας ευθυνόταν για την επίθεση μόνο μετά τη δημοσίευση ανακοίνωσης της Hugging Face, στις 16 Ιουλίου, σύμφωνα με την οποία η εταιρεία είχε δεχθεί επίθεση από «ένα αυτόνομο σύστημα πρακτόρων τεχνητής νοημοσύνης».

Το Σαββατοκύριακο 18-19 Ιουλίου, στελέχη της OpenAI εξέτασαν εσωτερικά αρχεία καταγραφής και εντόπισαν ενδείξεις ότι ο πράκτορας είχε ξεπεράσει τους περιορισμούς του δοκιμαστικού περιβάλλοντος.

Πηγές αναφέρουν ακόμη ότι η εταιρεία πραγματοποιεί ταυτόχρονα μεγάλο αριθμό δοκιμών σε προηγμένα μοντέλα, παράγοντας τεράστιους όγκους δεδομένων, γεγονός που δυσχεραίνει την άμεση παρακολούθηση κάθε δραστηριότητας.

Νέα ερωτήματα για την ασφάλεια των αυτόνομων πρακτόρων

Το περιστατικό επαναφέρει στο προσκήνιο τη συζήτηση για την ασφάλεια των αυτόνομων πρακτόρων τεχνητής νοημοσύνης, οι οποίοι θεωρούνται από τη βιομηχανία ως η επόμενη μεγάλη τεχνολογική εξέλιξη.

Οι υποστηρικτές τους εκτιμούν ότι θα μπορούν να εκτελούν σύνθετες εργασίες χωρίς ανθρώπινη παρέμβαση, αυξάνοντας θεαματικά την παραγωγικότητα. Ωστόσο, ειδικοί προειδοποιούν ότι όσο αυξάνεται η αυτονομία τους, τόσο μεγαλώνει και ο κίνδυνος απρόβλεπτης ή ανεξέλεγκτης συμπεριφοράς.

«Αυτό σημαίνει ότι είτε ο πράκτορας έμεινε χωρίς επαρκή επίβλεψη είτε η εταιρεία δεν κατάφερε να τον περιορίσει όταν εντόπισε το πρόβλημα. Και τα δύο σενάρια είναι εξίσου ανησυχητικά», σχολίασε ο Marley Smith, επικεφαλής πληροφοριών του μη κερδοσκοπικού οργανισμού World Ethical Data Foundation.

Από την πλευρά του, ο Jeffrey Ladish, της Palisade Research, υποστήριξε ότι το περιστατικό δεν αφορά μόνο την OpenAI, αλλά συνολικά τον τρόπο με τον οποίο οι κορυφαίες εταιρείες τεχνητής νοημοσύνης ισορροπούν μεταξύ της ταχύτητας ανάπτυξης νέων μοντέλων και των επενδύσεων στην ασφάλεια.

«Τα μοντέλα μπορούν να λένε ψέματα, να εξαπατούν και να χακάρουν. Χρειάζεται κυβερνητική εποπτεία, διαφορετικά δεν πρόκειται να υπάρξουν επαρκείς δικλίδες ασφαλείας», ανέφερε χαρακτηριστικά.

Προσθήκη του financialreport.gr ως
προτεινόμενη πηγή στην Google
googlenews

Ακολουθήστε το financialreport.gr στο Google News και μάθετε πρώτοι όλες τις ειδήσεις

close menu