← Inicio

Google DeepMind lanza Gemini Robotics 2: IA que controla robots humanoides de pies a cabeza

Google DeepMind ha dado un salto significativo en robótica impulsada por IA con el lanzamiento de Gemini Robotics 2, un modelo de visión-lenguaje-acción (VLA) que permite el control completo de robots humanoides — desde los pies hasta las puntas de los dedos. Anunciado el 30 de julio de 2026, el modelo representa la evolución más ambiciosa de la serie Gemini Robotics, pasando de tareas de manipulación sobre mesas a movimientos que requieren coordinación corporal total.

La innovación principal de Gemini Robotics 2 es su arquitectura VLA unificada. A diferencia de enfoques anteriores que segmentaban el control robótico en módulos separados — visión, planificación, ejecución motora — el nuevo modelo integra todo en un solo sistema que recibe entrada visual y lingüística y produce comandos motores directamente. Esto permite que un robot no solo "vea" y "entienda" una instrucción como "toma la caja azul del estante superior", sino que también planifique y ejecute la secuencia completa de movimientos — inclinarse, estirar el brazo, girar el torso, agarrar — sin intervención humana.

El salto técnico es sustancial. Mientras que el Gemini Robotics original se centraba en el control del brazo y la manipulación de objetos en entornos de mesa (ya impresionante), el Gemini Robotics 2 se expande a humanoides completos. El modelo gestiona el centro de masa dinámico durante movimientos como agacharse para recoger algo del suelo o equilibrarse al transportar objetos pesados. También admite robots bi-brazo, abriendo posibilidades para tareas que requieren coordinación entre dos extremidades, como abrir una puerta mientras se carga una caja.

DeepMind también anunció avances en destreza fina con Gemini Robotics ER (Enhanced Research), que añade capacidad de manipulación con cinco dedos — algo que The Next Web observó que todavía está por detrás de la destreza humana, pero representa un progreso notable respecto a pinzas simples. También está Lyria 3.5, que integra capacidades musicales, pero el enfoque principal sigue siendo la robótica física.

Las implicaciones para la industria son enormes. Empresas de logística como Amazon y FedEx, que ya usan robots en almacenes, podrían beneficiarse de humanoides que navegan por espacios reducidos y realizan tareas variadas sin reconfiguración. En la manufactura, el control corporal completo abre el camino para robots que operan en líneas de montaje tradicionalmente diseñadas para humanos — sin requerir modificaciones en el piso de fábrica.

El anuncio también posiciona a Google DeepMind en ruta de colisión con empresas como Tesla (que desarrolla Optimus), Figure AI (con su Figure 02) y Unitree (con el H1). La diferencia es que Google no está construyendo el hardware — está proporcionando el "cerebro". Esto podría resultar más escalable: en lugar de competir en diseño mecánico, Google apuesta a que su modelo de IA será adoptado por múltiples fabricantes de robots, funcionando como el "Android de los robots".

Sin embargo, el camino hacia la adopción generalizada aún enfrenta obstáculos significativos. El costo de los robots humanoides sigue siendo prohibitivo para la mayoría de las aplicaciones comerciales, y las preocupaciones de seguridad — tanto física (un robot de 80 kg fuera de control) como digital (hackeo de sistemas robóticos) — deben abordarse. La gigantesca base de inversión en IA de Google, estimada en más de 50.000 millones de dólares anuales, sugiere que la empresa está preparada para el largo plazo. Queda por saber si el mercado está listo para adoptar robots con "inteligencia corporal total" — o si esto sigue siendo una tecnología en busca de un problema.

Fuentes: Google DeepMind, Wired, The Next Web

✓ Fuentes independientes cruzadas y verificadas antes de la publicación