Η Anthropic παραδέχεται ότι μοντέλα Claude παραβίασαν κατά λάθος πραγματικά εταιρικά συστήματα

Anthropic

Η Anthropic αποκάλυψε ότι τρία μοντέλα της οικογένειας Claude απέκτησαν χωρίς άδεια πρόσβαση σε πληροφοριακά συστήματα πραγματικών οργανισμών κατά τη διάρκεια δοκιμών κυβερνοασφάλειας, εξαιτίας λανθασμένης διαμόρφωσης του περιβάλλοντος ελέγχου.

Η αποκάλυψη έρχεται λίγες ημέρες μετά την ανακοίνωση της OpenAI ότι ένα δικό της μοντέλο πραγματοποίησε μη εξουσιοδοτημένη πρόσβαση στην πλατφόρμα Hugging Face, εντείνοντας τις ανησυχίες για τον έλεγχο των ολοένα και πιο ισχυρών συστημάτων τεχνητής νοημοσύνης.

Λάθος στη διαμόρφωση του περιβάλλοντος δοκιμών

Σύμφωνα με την Anthropic, τα περιστατικά σημειώθηκαν κατά τη διάρκεια ασκήσεων τύπου «capture-the-flag», οι οποίες χρησιμοποιούνται για την αξιολόγηση των δυνατοτήτων κυβερνοασφάλειας ενός μοντέλου τεχνητής νοημοσύνης.

Οι δοκιμές υποτίθεται ότι εκτελούνταν σε πλήρως απομονωμένο περιβάλλον. Ωστόσο, μια λανθασμένη ρύθμιση επέτρεψε στα συστήματα που χρησιμοποιούσαν τα μοντέλα να έχουν πρόσβαση στο πραγματικό διαδίκτυο.

Παράλληλα, όλα τα μοντέλα είχαν ενημερωθεί ότι δεν διέθεταν σύνδεση στο internet. Ως αποτέλεσμα, όταν συνάντησαν πραγματικά δίκτυα, θεώρησαν ότι αποτελούσαν μέρος της προσομοίωσης και συνέχισαν να εκτελούν τις εντολές τους.

Τρία διαφορετικά μοντέλα εμπλέκονται

Τα πρώτα περιστατικά καταγράφηκαν τον Απρίλιο και αφορούσαν τα μοντέλα Claude Opus 4.7, Mythos 5, καθώς και ένα εσωτερικό ερευνητικό μοντέλο της εταιρείας.

Κατά τη διάρκεια αυτών των δοκιμών, τα μοντέλα δεν διέθεταν τα συνήθη προστατευτικά μέτρα που εφαρμόζει η Anthropic για να περιορίζει πιο επικίνδυνες συμπεριφορές, καθώς στόχος ήταν να αξιολογηθούν οι δυνατότητές τους σε σενάρια κυβερνοασφάλειας.

Η ανακάλυψη έγινε μετά το περιστατικό της OpenAI

Η Anthropic ανέφερε ότι εντόπισε τα συμβάντα αφού εξέτασε περισσότερες από 141.000 εκτελέσεις δοκιμών κυβερνοασφάλειας. Η αναδρομική αυτή ανάλυση πραγματοποιήθηκε μόνο μετά τη δημοσιοποίηση του περιστατικού με το μοντέλο της OpenAI που απέκτησε μη εξουσιοδοτημένη πρόσβαση στην πλατφόρμα Hugging Face.

Η εταιρεία σημειώνει ότι τα τρία μοντέλα αντέδρασαν με διαφορετικό τρόπο όταν συνάντησαν ενδείξεις ότι τα συστήματα που εξερευνούσαν ήταν πραγματικά και όχι μέρος της προσομοίωσης.

Αυξάνονται οι ανησυχίες για τον έλεγχο των προηγμένων AI μοντέλων

Το περιστατικό ενισχύει τον προβληματισμό γύρω από την ασφάλεια των προηγμένων μοντέλων τεχνητής νοημοσύνης. Παράλληλα με την κυκλοφορία ολοένα και ισχυρότερων μοντέλων ανοιχτών βαρών, αυξάνονται οι εκκλήσεις από ερευνητές και στελέχη του κλάδου για διεθνείς κανόνες διακυβέρνησης και αυστηρότερη εποπτεία.

Στις Ηνωμένες Πολιτείες, νομοθέτες εξετάζουν ήδη την επιβολή αυστηρότερων κανόνων σχετικά με την ανάπτυξη και τη διάθεση προηγμένων μοντέλων τεχνητής νοημοσύνης, καθώς και με το ποιοι μπορούν να αποκτούν πρόσβαση σε αυτά.

Scroll to Top