Η OpenAI βάζει φρένο σε νέο μοντέλο λόγω ισχυρών δυνατοτήτων κυβερνοασφάλειας

OpenAI

Η OpenAI ανακοίνωσε ότι βάζει προσωρινά τις «εσωτερικές δραστηριότητες» γύρω από ένα υπό ανάπτυξη μοντέλο τεχνητής νοημοσύνης με την ονομασία Astra, καθώς οι πρόσφατες αξιολογήσεις έδειξαν ότι ενδέχεται να διαθέτει ιδιαίτερα προηγμένες δυνατότητες στον τομέα της κυβερνοασφάλειας.

Η εταιρεία αναφέρει ότι το Astra παρουσιάζει «σημαντικές εξελίξεις στο agentic coding και την κυβερνοασφάλεια». Τα αποτελέσματα των εσωτερικών δοκιμών, σε συνδυασμό με αξιολογήσεις ειδικών, οδήγησαν την OpenAI στο συμπέρασμα ότι δεν μπορεί να αποκλείσει το ενδεχόμενο το μοντέλο να φτάνει το επίπεδο «Critical» που προβλέπει το Preparedness Framework.

OpenAI – Astra: Τι σημαίνει «Critical» κυβερνοασφάλεια

Σύμφωνα με το πλαίσιο της OpenAI, ένα μοντέλο φτάνει στο συγκεκριμένο επίπεδο όταν μπορεί, χωρίς ανθρώπινη παρέμβαση, να εντοπίζει και να αναπτύσσει λειτουργικά zero-day exploits όλων των επιπέδων σοβαρότητας σε πολλά ενισχυμένα πραγματικά κρίσιμα συστήματα.

Το ίδιο επίπεδο μπορεί να επιτευχθεί εάν ένα μοντέλο είναι σε θέση να σχεδιάζει και να εκτελεί αυτόνομα νέες, ολοκληρωμένες στρατηγικές κυβερνοεπιθέσεων εναντίον προστατευμένων στόχων, έχοντας ως δεδομένο μόνο έναν γενικό επιθυμητό στόχο.

Η OpenAI διευκρίνισε ότι το Astra δε συμμετείχε στην πρόσφατη παραβίαση του Hugging Face, η οποία είχε αποδοθεί σε άλλα μοντέλα της εταιρείας.

Αυστηρότεροι έλεγχοι στα ισχυρά μοντέλα

Η απόφαση έρχεται σε μια περίοδο κατά την οποία αυξάνονται οι ανησυχίες για τη χρήση προηγμένων AI agents σε κυβερνοεπιθέσεις. Η Anthropic και η Meta έχουν επίσης αναφέρει περιστατικά στα οποία μοντέλα τους παρουσίασαν μη αναμενόμενη συμπεριφορά και παραβίασαν οργανισμούς κατά τη διάρκεια δοκιμών κυβερνοασφάλειας.

Η OpenAI δηλώνει ότι θα εφαρμόσει αυστηρότερους ελέγχους ασφαλείας στα μοντέλα υψηλότερων δυνατοτήτων και στις σχετικές δραστηριότητες.

Για το Astra, η εταιρεία έχει ήδη εφαρμόσει «universal monitoring», ώστε να παρακολουθούνται σε όλες τις agentic εφαρμογές ενέργειες υψηλού κινδύνου και πιθανές ενδείξεις απόκλισης από την προβλεπόμενη συμπεριφορά.

Η εξέλιξη δείχνει ότι η αύξηση των δυνατοτήτων των AI μοντέλων συνοδεύεται πλέον από αυστηρότερες διαδικασίες αξιολόγησης, ιδιαίτερα όταν αυτά μπορούν να αυτοματοποιούν σύνθετες εργασίες στον κυβερνοχώρο.

Scroll to Top