Η Google DeepMind παρουσίασε τη νέα έκδοση του μοντέλου τεχνητής νοημοσύνης Gemini Robotics 2, η οποία μπορεί να ελέγχει ολόκληρο το σώμα ενός ανθρωποειδούς ρομπότ, από τα πόδια μέχρι τα δάχτυλα. Η προηγούμενη έκδοση επικεντρωνόταν κυρίως στον έλεγχο του άνω μέρους του σώματος, ενώ η νέα έκδοση επιτρέπει πιο ολοκληρωμένες κινήσεις και συντονισμό.
Το μοντέλο μπορεί να επιτρέψει σε ρομπότ να περπατούν, να σκύβουν, να τεντώνονται και να χειρίζονται αντικείμενα με μεγαλύτερη ακρίβεια. Σε βίντεο που δημοσίευσε η Google, το ανθρωποειδές ρομπότ Apollo 2 της Apptronik εμφανίζεται να σκύβει για να σηκώσει ένα ποτιστήρι, αλλά και να εντοπίζει και να παίρνει συγκεκριμένα αντικείμενα από ένα ράφι.
Καλύτερος συντονισμός και επιδεξιότητα
Η Google DeepMind αναφέρει ότι τα ρομπότ χρειάζονται ακόμη βελτιώσεις στην ταχύτητα κίνησης, όμως η νέα έκδοση αποτελεί σημαντικό βήμα προς την εκτέλεση πιο σύνθετων εργασιών στον πραγματικό κόσμο, οι οποίες απαιτούν συνεργασία πολλών μερών του σώματος.
Το Gemini Robotics 2 βελτιώνει επίσης τον χειρισμό αντικειμένων, καθώς μπορεί να ελέγχει πιο σύνθετα χέρια με πέντε δάχτυλα. Αυτό επιτρέπει σε ρομπότ να εκτελούν λεπτές κινήσεις, όπως να κλείνουν σακούλες τύπου Ziploc, να δένουν σακούλες απορριμμάτων ή να ξεβιδώνουν μια λάμπα.
Νέα δυνατότητα κατανόησης του περιβάλλοντος
Παράλληλα, η Google αναβάθμισε το Gemini Robotics ER 2, ένα μοντέλο οπτικοχωρικής κατανόησης που βοηθά τα ρομπότ να αναλύουν το περιβάλλον τους, να κατανοούν οδηγίες και να ολοκληρώνουν εργασίες πολλών βημάτων.
Η νέα έκδοση μπορεί να παρακολουθεί καλύτερα τη διάρκεια μιας εργασίας, αναγνωρίζοντας πότε ξεκινά και πότε ολοκληρώνεται. Επιπλέον, επιτρέπει σε διαφορετικού τύπου ρομπότ να συνεργάζονται μεταξύ τους. Σε ένα παράδειγμα, το Apollo 2 δίνει οδηγίες σε ένα διπλό βραχίονα ρομπότ της Google ώστε να τοποθετήσει εργαλεία σε ένα δοχείο κατά τη διάρκεια καθαρισμού ενός γκαράζ.
Έμφαση στην ασφάλεια και την αυτόνομη λειτουργία
Η Google χαρακτηρίζει το Gemini Robotics ER 2 ως το ασφαλέστερο μοντέλο ρομποτικής της μέχρι σήμερα. Το σύστημα μπορεί να εντοπίζει καλύτερα την παρουσία ανθρώπων, να ενεργοποιεί μηχανισμούς ασφαλείας και να σταματά το ρομπότ όταν κάποιος πλησιάζει υπερβολικά.
Παράλληλα, η εταιρεία βελτίωσε το Gemini Robotics On-Device Model, το οποίο λειτουργεί τοπικά πάνω στο ίδιο το ρομπότ χωρίς ανάγκη σύνδεσης στο διαδίκτυο. Το μοντέλο μπορεί πλέον να προσαρμόζεται ταχύτερα σε διαφορετικούς τύπους ρομπότ με διαφορετικά σχήματα, αισθητήρες και βαθμούς ελευθερίας.
Η εξέλιξη αυτή δείχνει τη μετάβαση της ρομποτικής τεχνητής νοημοσύνης από απλές μηχανικές κινήσεις σε συστήματα που μπορούν να αντιλαμβάνονται, να σχεδιάζουν και να εκτελούν πολύπλοκες εργασίες με μεγαλύτερη αυτονομία.