Λανθασμένη ρύθμιση επέτρεψε στα μοντέλα Claude να συνδεθούν στο ανοιχτό διαδίκτυο με τα περιστατικά ΝΑ εντείνουν τις ανησυχίες για τον έλεγχο των αυτόνομων συστημάτων τεχνητής νοημοσύνης
Μοντέλα τεχνητής νοημοσύνης της αμερικανικής εταιρείας με το ελληνικό όνομα, Anthropic, απέκτησαν μη εξουσιοδοτημένη πρόσβαση στις πραγματικές υποδομές τριών οργανισμών, κατά τη διάρκεια δοκιμών που είχαν σχεδιαστεί για να αξιολογήσουν τις δυνατότητές τους στον τομέα της κυβερνοασφάλειας. Τα περιστατικά αποκαλύφθηκαν στις 30 Ιουλίου 2026, έπειτα από εσωτερική έρευνα της εταιρείας. Σύμφωνα με την Anthropic, μια λανθασμένη ρύθμιση στα συστήματα δοκιμών επέτρεψε στα μοντέλα της οικογένειας Claude να συνδεθούν στο ανοιχτό διαδίκτυο, παρότι το περιβάλλον αξιολόγησης υποτίθεται ότι ήταν πλήρως απομονωμένο.
Η έρευνα ξεκίνησε μετά την αποκάλυψη ενός διαφορετικού περιστατικού από την OpenAI, κατά το οποίο μοντέλα της εταιρείας κατάφεραν να ξεφύγουν από ένα περιορισμένο περιβάλλον δοκιμών και να αποκτήσουν πρόσβαση στην παραγωγική υποδομή της πλατφόρμας Hugging Face. Η Anthropic αποφάσισε τότε να εξετάσει αναδρομικά εάν κάτι αντίστοιχο είχε συμβεί και στα δικά της συστήματα.
Έλεγχος περισσότερων από 141.000 δοκιμών
Η εταιρεία ανέλυσε συνολικά 141.006 δοκιμαστικές εκτελέσεις στις οποίες υπήρχε πιθανότητα τα μοντέλα να αποκτήσουν πρόσβαση στο διαδίκτυο. Από την εξέταση προέκυψαν τρία ξεχωριστά περιστατικά, τα οποία αφορούσαν συνολικά έξι δοκιμές και τρία διαφορετικά μοντέλα: το Claude Opus 4.7, το Claude Mythos 5 και ένα εσωτερικό, μη διαθέσιμο στο κοινό ερευνητικό μοντέλο. Τα πρώτα περιστατικά χρονολογούνται από τον Απρίλιο του 2026.
Οι δοκιμές πραγματοποιούνταν σε συνεργασία με την εταιρεία αξιολόγησης κυβερνοασφάλειας Irregular και περιλάμβαναν ασκήσεις τύπου «capture the flag». Πρόκειται για ελεγχόμενα σενάρια στα οποία ένα σύστημα καλείται να εντοπίσει μια κρυμμένη πληροφορία, τη λεγόμενη «σημαία», παρακάμπτοντας τις άμυνες ενός υποθετικού δικτύου.
Στις συγκεκριμένες περιπτώσεις, τα μοντέλα είχαν ενημερωθεί ότι βρίσκονταν μέσα σε προσομοίωση χωρίς πρόσβαση στο διαδίκτυο. Ωστόσο, λόγω παρανόησης μεταξύ της Anthropic και του εξωτερικού συνεργάτη της, ορισμένα μηχανήματα παρέμεναν συνδεδεμένα στο δημόσιο δίκτυο. Έτσι, όταν τα μοντέλα εντόπισαν πραγματικά συστήματα, τα αντιμετώπισαν ως τμήμα της άσκησης.
Αδύναμοι κωδικοί και απροστάτευτα σημεία πρόσβασης
Σύμφωνα με την Anthropic, τα μοντέλα δεν ανακάλυψαν ιδιαίτερα σύνθετες ή άγνωστες ευπάθειες. Χρησιμοποίησαν σχετικά βασικές τεχνικές, όπως την εκμετάλλευση αδύναμων κωδικών πρόσβασης και μη προστατευμένων ψηφιακών σημείων εισόδου. Σε μία περίπτωση, η πλασματική εταιρεία που είχε δημιουργηθεί για τις ανάγκες της άσκησης είχε το ίδιο όνομα με έναν πραγματικό οργανισμό. Το Claude εντόπισε την πραγματική ιστοσελίδα και απέκτησε πρόσβαση σε διαπιστευτήρια και σε βάση δεδομένων, θεωρώντας ότι επρόκειτο για μέρος της προσομοίωσης.
Η Anthropic διευκρίνισε ότι τα μοντέλα δεν προσπάθησαν να «αντιγράψουν» ή να μεταφέρουν τον εαυτό τους εκτός του συστήματος δοκιμών, ούτε επιχείρησαν συνειδητά να αποδράσουν από αυτό. Παρ’ όλα αυτά, ένα παλαιότερο μοντέλο συνέχισε τη δραστηριότητά του ακόμη και όταν εμφανίστηκαν ενδείξεις ότι βρισκόταν στο πραγματικό διαδίκτυο. Αντίθετα, το νεότερο ερευνητικό μοντέλο σταμάτησε μόνο του την επίθεση όταν αντιλήφθηκε ότι ο στόχος ήταν πραγματικός.
Η δεύτερη συμπεριφορά δημιουργεί, σύμφωνα με την εταιρεία, μια «συγκρατημένη αισιοδοξία» ότι η εκπαίδευση ασφαλείας μπορεί να βοηθήσει τα μοντέλα να αναγνωρίζουν τα όρια των εντολών τους. Η Anthropic υπογράμμισε, ωστόσο, ότι χρειάζονται πολύ περισσότερες δοκιμές πριν εξαχθούν ασφαλή συμπεράσματα.
Οι οργανισμοί δεν είχαν εντοπίσει τη δραστηριότητα
Η Anthropic σταμάτησε όλες τις σχετικές δοκιμές κυβερνοασφάλειας στις 23 Ιουλίου, μόλις εντόπισε τις πρώτες ύποπτες καταγραφές. Στις 27 Ιουλίου ενημέρωσε την Irregular και τους επηρεαζόμενους οργανισμούς. Οι δύο οργανισμοί με τους οποίους κατόρθωσε να επικοινωνήσει δεν είχαν προηγουμένως αντιληφθεί την παραβίαση. Η εταιρεία συνέχιζε να προσπαθεί να επικοινωνήσει με τον τρίτο οργανισμό, ενώ δεν δημοσιοποίησε τα ονόματα κανενός από τους εμπλεκομένους. Η Anthropic χαρακτήρισε τα περιστατικά «λειτουργική αποτυχία» και ανέλαβε την ευθύνη για την ανεπαρκή απομόνωση των περιβαλλόντων αξιολόγησης. Αναγνώρισε επίσης ότι τόσο η ίδια όσο και ο συνεργάτης της θα μπορούσαν να είχαν ελέγξει λεπτομερέστερα τα αρχεία δραστηριότητας και την εξερχόμενη διαδικτυακή κίνηση.
Η διαφορά με το περιστατικό της OpenAI
Το περιστατικό της Anthropic διαφοροποιείται από εκείνο της OpenAI σε ένα κρίσιμο σημείο. Στην περίπτωση της Anthropic, η πρόσβαση στο διαδίκτυο ήταν ήδη διαθέσιμη εξαιτίας λανθασμένης ρύθμισης. Αντίθετα, τα μοντέλα της OpenAI εντόπισαν και εκμεταλλεύτηκαν μια μέχρι τότε άγνωστη ευπάθεια, γνωστή ως «zero-day» σε λογισμικό που χρησιμοποιούνταν στο περιβάλλον δοκιμών. Στη συνέχεια απέκτησαν πρόσβαση στο διαδίκτυο και παραβίασαν υποδομές της Hugging Face, αναζητώντας τις απαντήσεις ενός τεστ κυβερνοασφάλειας.
Η Hugging Face ανέφερε ότι εντοπίστηκε μη εξουσιοδοτημένη πρόσβαση σε περιορισμένο αριθμό εσωτερικών συνόλων δεδομένων και διαπιστευτηρίων. Δεν βρέθηκαν, πάντως, στοιχεία αλλοίωσης δημόσιων μοντέλων, συνόλων δεδομένων ή πακέτων λογισμικού της πλατφόρμας.
Ο κίνδυνος των αυτόνομων AI agents
Τα περιστατικά δεν αποδεικνύουν ότι η τεχνητή νοημοσύνη απέκτησε «κακόβουλη πρόθεση». Αναδεικνύουν, όμως, τον κίνδυνο που δημιουργείται όταν ένα ιδιαίτερα ικανό σύστημα λαμβάνει έναν συγκεκριμένο στόχο, αποκτά πρόσβαση σε εργαλεία και μπορεί να εκτελεί ενέργειες χωρίς συνεχή ανθρώπινη επίβλεψη. Οι λεγόμενοι AI agents μπορούν να συνδυάζουν πολλές διαφορετικές ικανότητες: να αναζητούν πληροφορίες, να γράφουν και να εκτελούν κώδικα, να εντοπίζουν διαπιστευτήρια, να κινούνται μεταξύ συστημάτων και να προσαρμόζουν τη στρατηγική τους. Το στοιχείο που ανησυχεί περισσότερο τους ειδικούς είναι η ταχύτητα και η κλίμακα με την οποία μπορούν να πραγματοποιούν χιλιάδες ενέργειες, πολύ ταχύτερα από έναν ανθρώπινο εισβολέα.
Οι αποκαλύψεις ενισχύουν τις πιέσεις για αυστηρότερα πρωτόκολλα ασφαλείας, ανεξάρτητους ελέγχους και συνεχή παρακολούθηση των πειραμάτων. Μεταξύ των μέτρων που προτείνονται είναι η πλήρης απαγόρευση της εξερχόμενης διαδικτυακής κίνησης ως προεπιλογή, η απομόνωση των διαπιστευτηρίων, η παρακολούθηση των ενεργειών σε πραγματικό χρόνο και η δυνατότητα άμεσης διακοπής ενός μοντέλου.
Η αμερικανική κυβέρνηση έχει ήδη ζητήσει τη δημιουργία εθελοντικού πλαισίου κυβερνοασφάλειας για τα πιο προηγμένα συστήματα τεχνητής νοημοσύνης. Την ίδια στιγμή, η Anthropic κάλεσε και τα υπόλοιπα εργαστήρια AI να εξετάσουν αναδρομικά τις δοκιμές τους, ώστε να διαπιστώσουν εάν έχουν σημειωθεί παρόμοια περιστατικά που παρέμειναν απαρατήρητα.
ΕΙΔΗΣΕΙΣ ΣΗΜΕΡΑ:
- Φωτιά και στο Καλαμάκι στον Άγιο Βασίλειο στη Θήβα, μήνυμα από 112 για απομάκρυνση
- Θερινές εκπτώσεις στον Πειραιά: Συγκρατημένοι οι καταναλωτές τον πρώτο μήνα
- Φιλοδωρήματα: Διορθώθηκε η γκάφα Πιτσιλή με αύξηση του αφορολόγητου ορίου στα €6.000 ετησίως από €300 ευρώ το μήνα
- MIG: Επιστροφή σε κερδοφορία το πρώτο εξάμηνο του 2026
- Anthropic: Παραβιάστηκαν τα συστήματα τριών οργανισμών κατά τη διάρκεια δοκιμών
- MIG ΑΝΩΝΥΜΟΣ ΕΤΑΙΡΕΙΑ ΣΥΜΜΕΤΟΧΩΝ - ΔΕΛΤΙΟ ΤΥΠΟΥ – Οικονομικά αποτελέσματα A’ εξαμήνου 2026
- MIG ΑΝΩΝΥΜΟΣ ΕΤΑΙΡΕΙΑ ΣΥΜΜΕΤΟΧΩΝ - Οικονομική έκθεση MIG ΑΝΩΝΥΜΟΣ ΕΤΑΙΡΕΙΑ ΣΥΜΜΕΤΟΧΩΝ (2026,Εξαμηνιαία,Ενοποιημένη)
- Σύγκρουση Ιταλίας – Ισπανίας για μεταναστευτικό, εξωτερικά σύνορα
προτεινόμενη πηγή στην Google
Ακολουθήστε το financialreport.gr στο Google News και μάθετε πρώτοι όλες τις ειδήσεις








