FOXreport.gr

Η Anthropic βελτιώνει τα φίλτρα ασφαλείας της βιολογίας του Claude Fable 5 για τη μείωση των ψευδών θετικών αποτελεσμάτων

Εικόνα: cybersecuritynews.com

Η Anthropic ανακοίνωσε σημαντική αναβάθμιση στα συστήματα ασφαλείας του μοντέλου τεχνητής νοημοσύνης Claude Fable 5, μειώνοντας κατά περίπου 85% τις λανθασμένες ενεργοποιήσεις των φίλτρων που αφορούν ερωτήματα βιολογίας. Η αλλαγή επιτρέπει στους χρήστες να λαμβάνουν πιο συχνά απαντήσεις από το ισχυρότερο μοντέλο, χωρίς άσκοπες διακοπές κατά την υποβολή νόμιμων επιστημονικών ή ιατρικών ερωτημάτων.

Anthropic: Λιγότερα λανθασμένα μπλοκαρίσματα

Όταν παρουσιάστηκε το Claude Fable 5, η Anthropic είχε επιλέξει ιδιαίτερα αυστηρούς μηχανισμούς ανίχνευσης για θέματα βιολογίας, ώστε να αποτρέψει πιθανή κατάχρηση σε τομείς όπως η ανάπτυξη βιολογικών όπλων.

Ωστόσο, η αυστηρή αυτή προσέγγιση είχε ως αποτέλεσμα να χαρακτηρίζονται ως δυνητικά επικίνδυνα ακόμη και πολλά αθώα ερωτήματα. Σε αυτές τις περιπτώσεις, το σύστημα μετέφερε αυτόματα τη συνομιλία στο λιγότερο ισχυρό μοντέλο Opus 5.

Νέοι κανόνες αξιολόγησης

Τις τελευταίες εβδομάδες, η εταιρεία ανασχεδίασε το σύνολο των κανόνων που χρησιμοποιεί ο ταξινομητής ασφαλείας, εισάγοντας περισσότερες εξαιρέσεις για νόμιμες χρήσεις. Παράλληλα, αξιοποίησε σχόλια από εσωτερικούς και εξωτερικούς ειδικούς, δημιούργησε νέο εκπαιδευτικό υλικό και επανεκπαίδευσε το σύστημα, ώστε να μειωθούν οι ψευδείς συναγερμοί χωρίς να περιοριστεί η δυνατότητα εντοπισμού πραγματικά επικίνδυνων αιτημάτων.

Τι αλλάζει για τους χρήστες

Μετά την αναβάθμιση, όσοι χρησιμοποιούν το Claude Fable 5 για εκπαίδευση, μελέτη βιολογίας, ερμηνεία εργαστηριακών εξετάσεων ή αναζήτηση πληροφοριών για θέματα υγείας αναμένεται να αντιμετωπίζουν πολύ λιγότερες άσκοπες ανακατευθύνσεις στο Opus 5. Βελτιωμένη εμπειρία αναμένεται και για επαγγελματίες του χώρου της υγείας κατά τη διαχείριση καθημερινών κλινικών εργασιών.

Παράλληλα, το μοντέλο θα συνεχίσει να εφαρμόζει αυστηρότερους περιορισμούς σε τομείς διπλής χρήσης, όπως η ιολογία, η τοξικολογία και ο μοριακός σχεδιασμός, όπου εξακολουθεί να γίνεται αυτόματη μετάβαση στο Opus 5.

Η Anthropic επισημαίνει ότι τα μέτρα ασφαλείας δεν είναι ακόμη τέλεια και ορισμένα χαμηλού κινδύνου ερωτήματα ενδέχεται να συνεχίσουν να ενεργοποιούν τα φίλτρα. Η εταιρεία δηλώνει ότι θα συνεχίσει να βελτιώνει το σύστημα, εξετάζοντας παράλληλα τρόπους ασφαλούς πρόσβασης σε προηγμένες δυνατότητες βιολογίας για πιστοποιημένους ερευνητές.

Exit mobile version