Qué ha presentado Google DeepMind
El 30 de julio de 2026 Google DeepMind anunció Gemini Robotics 2, que no es un modelo sino tres. El primero es un modelo de visión, lenguaje y acción, la pieza que convierte lo que el robot ve y lo que se le pide en movimiento real. El segundo, Gemini Robotics ER 2, es el modelo de razonamiento encarnado que planifica tareas largas, pregunta al humano cuando algo no está claro y coordina a varios robots; está construido sobre Gemini 3.5 Flash. El tercero, Gemini Robotics On-Device 2, corre en el propio hardware del robot sin salir a la nube.
Solo ER 2 es accesible hoy, vía Google AI Studio y la API de Gemini. Los otros dos quedan reservados a socios de acceso anticipado.
Qué significa control de cuerpo entero
Hasta esta versión, el trabajo de la casa se concentraba en manipulación sobre una mesa: dos brazos y un torso quieto. Lo que añade Gemini Robotics 2 es coordinar el cuerpo completo, de los pies a los dedos, para andar, agacharse, mantener el equilibrio y manipular dentro de la misma secuencia.
Las demostraciones se hicieron sobre el humanoide Apollo 2 de Apptronik, con manos SharpaWave de cinco dedos o pinzas convencionales. En una de ellas el robot recibe la orden de meter una regadera en la papelera verde del estante de abajo, cruza la habitación, la recoge y la deposita donde toca.
