bytedaily - Melansir laporan dari deepmind.google, Google DeepMind telah memperkenalkan Gemini Robotics 2, sebuah inovasi yang dirancang untuk memberikan kecerdasan menyeluruh pada robot, memungkinkan mereka untuk berpikir, bertindak, dan berinteraksi secara cerdas. Kemajuan ini merupakan langkah besar dalam mewujudkan robot yang dapat beradaptasi dan beroperasi secara mulus di dunia nyata, berbeda dengan robot konvensional yang umumnya diprogram untuk tugas-tugas sempit dan repetitif.
Gemini Robotics 2 mengatasi keterbatasan robot yang ada dalam hal kemampuan belajar mandiri dan adaptasi terhadap lingkungan yang tidak terduga. Model ini juga mempermudah transfer keterampilan yang telah dipelajari dari satu robot ke robot lain. Dengan kemampuan memahami multimodalitas Gemini, teknologi ini mampu mendorong tindakan nyata pada robot, membuka jalan bagi robot dengan berbagai bentuk dan ukuran untuk menyelesaikan tugas kompleks secara aman.
Lebih lanjut, Gemini Robotics 2 memungkinkan robot untuk merencanakan setiap gerakan, sehingga dapat melakukan berbagai tugas. Contohnya, robot humanoid dapat berjalan, jongkok, meregangkan badan, dan memanipulasi objek untuk membersihkan ruangan yang berantakan. Robot ini bahkan dapat bekerja sama dengan robot lain untuk menyelesaikan tugas lebih cepat. Kecerdasan ini dapat beroperasi secara lokal pada perangkat robot dan beradaptasi dengan robot baru hanya dalam beberapa jam.
Kemampuan ini didukung oleh tiga model utama: Gemini Robotics 2, model vision-language-action (VLA) paling canggih yang menerjemahkan masukan visual dan bahasa menjadi kontrol gerak; Gemini Robotics ER 2, model embodied reasoning (ER) yang bertindak sebagai agen untuk komunikasi dengan manusia, pemahaman dunia fisik, dan perencanaan tugas multi-langkah; serta Gemini Robotics On-Device 2, model VLA yang dioptimalkan untuk berjalan di perangkat robot secara lokal dan mampu beradaptasi dengan cepat pada robot baru.