Ρώσος χάκερ «ξεκλείδωσε» το Claude και το μετατρέπεψε σε πλατφόρμα αυτόματων κυβερνοεπιθέσεων

Claude

Ένας ρωσόφωνος threat actor με το όνομα «Trim» φέρεται να κατάφερε να παρακάμψει τους μηχανισμούς ασφαλείας προηγμένων μοντέλων τεχνητής νοημοσύνης και να τα μετατρέψει σε μια αυτοματοποιημένη πλατφόρμα penetration testing με την ονομασία AI Pentest Checker.

Η δραστηριότητα αναδεικνύει τον τρόπο με τον οποίο εγκληματίες μπορούν να αξιοποιήσουν νόμιμες υπηρεσίες τεχνητής νοημοσύνης και γνωστά εργαλεία κυβερνοασφάλειας για να επιταχύνουν την αναγνώριση στόχων, τον εντοπισμό ευπαθειών και τη δημιουργία αναφορών.

Πώς φέρεται να παρακάμφθηκαν τα φίλτρα ασφαλείας

Σύμφωνα με αναφορές της Cato, ο Trim εμφανίστηκε για πρώτη φορά σε ρωσόφωνο forum κυβερνοεγκληματιών στις 13 Μαρτίου 2026, όπου φέρεται να μοιράστηκε μεθόδους για την παράκαμψη των μηχανισμών ασφαλείας του Claude Opus.

Οι τεχνικές βασίζονταν σε χειρισμό των prompts, με στόχο το μοντέλο να αντιμετωπίζει επιθετικά αιτήματα ως εξουσιοδοτημένη έρευνα κυβερνοασφάλειας.

Μεταξύ των μεθόδων που φέρεται να προωθούσε ήταν η δημιουργία ενός αθώου πλαισίου πριν από την υποβολή ενός επικίνδυνου αιτήματος, η αλλαγή της διατύπωσης ώστε οι οδηγίες να φαίνονται ότι αφορούν αποκλειστικά τη δομή κώδικα και η επαναδιατύπωση αιτημάτων που είχαν προηγουμένως απορριφθεί.

Οι τεχνικές αυτές είναι γνωστές ως «jailbreaking» και στοχεύουν στην παράκαμψη των κανόνων συμπεριφοράς ενός μοντέλου μέσω ειδικά διαμορφωμένων εισόδων, χωρίς να απαιτείται εκμετάλλευση της ίδιας της υποδομής του παρόχου.

Το AI Pentest Checker αυτοματοποιεί την αναζήτηση ευπαθειών

Στις 21 Ιουνίου, ο Trim φέρεται να προώθησε το AI Pentest Checker, μια πλατφόρμα που συνδυάζει δυνατότητες τεχνητής νοημοσύνης με εργαλεία offensive security.

Σύμφωνα με τις αναφορές, το σύστημα ενσωματώνει εργαλεία όπως τα Nuclei, ffuf, katana, subfinder και Gitleaks για την αυτοματοποίηση διαδικασιών όπως η ανακάλυψη στόχων, η χαρτογράφηση endpoints, ο εντοπισμός secrets και ο έλεγχος για γνωστές ευπάθειες.

Τα ίδια τα εργαλεία δεν είναι παράνομα ή κακόβουλα. Χρησιμοποιούνται ευρέως από επαγγελματίες penetration testers και ομάδες άμυνας για εξουσιοδοτημένους ελέγχους ασφαλείας.

Ο κίνδυνος προκύπτει από τον συνδυασμό τους με έναν AI assistant που μπορεί να συντονίζει τα διαφορετικά στάδια μιας διαδικασίας επίθεσης, να ερμηνεύει τα αποτελέσματα των σαρώσεων, να ιεραρχεί τα ευρήματα και να δημιουργεί αναφορές με πολύ μικρότερη ανθρώπινη παρέμβαση.

Η τεχνητή νοημοσύνη ως επιχειρησιακό επίπεδο για κυβερνοεπιθέσεις

Το AI Pentest Checker φέρεται να χρησιμοποιούσε το Claude Opus σε διαδικασίες κλιμάκωσης κρίσιμων ευρημάτων, ενώ άλλο μοντέλο χρησιμοποιούνταν για τη δημιουργία αναφορών σχετικά με πιθανές εκμεταλλεύσεις.

Ορισμένοι ισχυρισμοί σχετικά με τη χρήση τροποποιημένου system prompt από configuration με την ονομασία «Fable 5» θα πρέπει να αντιμετωπίζονται με επιφύλαξη, εκτός εάν επιβεβαιωθούν ανεξάρτητα.

Ωστόσο, η υπόθεση αναδεικνύει μια ευρύτερη τάση. Η τεχνητή νοημοσύνη δε χρησιμοποιείται πλέον μόνο ως εργαλείο για τη σύνταξη κειμένων ή τη δημιουργία κώδικα από κυβερνοεγκληματίες. Μπορεί να λειτουργήσει ως επιχειρησιακό επίπεδο που οργανώνει και επιταχύνει σύνθετες διαδικασίες αναγνώρισης και επίθεσης.

Οι ερευνητές ασφαλείας προειδοποιούν ότι τα ολοένα ισχυρότερα frontier AI models μπορούν να υποστηρίξουν δραστηριότητες όπως η ανάλυση ευπαθειών και η ανάπτυξη περιεχομένου σχετικού με exploits, ακόμη και όταν οι πάροχοι εφαρμόζουν μηχανισμούς ασφαλείας.

Οι οργανισμοί πρέπει να ενισχύσουν την άμυνά τους

Οι οργανισμοί θα πρέπει να περιορίζουν την εκτεθειμένη επιφάνεια επίθεσης, να πραγματοποιούν συνεχή έλεγχο των assets που είναι προσβάσιμα από το διαδίκτυο, να εφαρμόζουν πολυπαραγοντικό έλεγχο ταυτότητας (MFA) και να ανανεώνουν άμεσα credentials που ενδέχεται να έχουν παραβιαστεί.

Παράλληλα, η παρακολούθηση ασυνήθιστης δραστηριότητας αναγνώρισης μπορεί να βοηθήσει στον εντοπισμό αυτοματοποιημένων εκστρατειών.

Η τεχνητή νοημοσύνη μπορεί πλέον να επιταχύνει την αναζήτηση ευπαθειών, τη δημιουργία phishing περιεχομένου και την ανάπτυξη exploit. Για τις ομάδες κυβερνοασφάλειας, αυτές οι απειλές δεν αποτελούν πλέον μακρινό σενάριο, αλλά μια εξέλιξη που απαιτεί άμεση προσαρμογή των αμυντικών μηχανισμών.

Scroll to Top