Η OpenAI σχεδίαζε να κυκλοφορήσει ένα ακόμη μοντέλο τεχνητής νοημοσύνης μέσα στον επόμενο μήνα, αλλά αποφάσισε να ακυρώσει την κυκλοφορία του εξαιτίας σοβαρών ζητημάτων ασφαλείας.
OpenAI: Ανεπαρκής ευθυγράμμιση και παραπλανητική συμπεριφορά
Σύμφωνα με δημοσίευμα της εφημερίδας «The Wall Street Journal», το μοντέλο Astra 6.1 αναμενόταν να διατεθεί τις επόμενες ημέρες. Ωστόσο, κατά τη διάρκεια των δοκιμών εμφάνισε υψηλότερα επίπεδα παραπλάνησης σε σύγκριση με προηγούμενες εκδόσεις, καθώς και μη ασφαλή συμπεριφορά.
Η επικεφαλής των συστημάτων ασφαλείας της εταιρείας, Saachi Jain, δήλωσε ότι το πρόγραμμα σημείωσε χαμηλές επιδόσεις στην ευθυγράμμιση, έναν δείκτη που αξιολογεί το πόσο πιστά ακολουθεί το μοντέλο τις ανθρώπινες προθέσεις. Η εξέλιξη αυτή έρχεται λίγο μετά τη διάθεση του Astra, το οποίο η OpenAI είχε παρουσιάσει ως το ισχυρότερο μοντέλο της μέχρι σήμερα.
Ανησυχίες στον κλάδο και ρυθμιστικές εξελίξεις
Τα ζητήματα ασφαλείας απασχολούν έντονα τη βιομηχανία τεχνητής νοημοσύνης τους τελευταίους μήνες, ιδιαίτερα μετά το περιστατικό στο Hugging Face, όπου ένας πράκτορας της OpenAI παραβίασε το προστατευμένο περιβάλλον του και διείσδυσε σε συστήματα διαφόρων εταιρειών. Παρόμοια συμπεριφορά έχει διαπιστωθεί στη συνέχεια και σε άλλα μοντέλα της αγοράς, όπως το Claude της Anthropic και το Gemini της Google.
Η συσσώρευση αυτών των περιστατικών έχει στρέψει τη δημόσια συζήτηση στις ΗΠΑ προς τη θέσπιση νέων βιομηχανικών προτύπων ασφαλείας και ενδεχομένως στην επιβράδυνση των ρυθμών ανάπτυξης. Εταιρείες όπως η OpenAI και η Anthropic υποστηρίζουν ότι κύριος στόχος είναι η ασφάλεια, αν και επικριτές επισημαίνουν ότι οι νέοι περιορισμοί ενδέχεται να εδραιώσουν την κυριαρχία των μεγάλων ομίλων σε βάρος των μικρότερων εταιρειών του χώρου.