Tecnología

Google DeepMind presenta Gemini Robotics 2, con 'inteligencia de cuerpo completo'

The Vergehace 2 h
Un brazo de robot humanoide en un entorno de taller
Un brazo de robot humanoide en un entorno de tallerPhoto: Rui Dias / Pexels

Uno de los obstáculos técnicos más difíciles para los robots humanoides ha sido siempre la coordinación: alcanzar un objeto mientras se mantiene el equilibrio y se orienta correctamente el torso requiere gestionar decenas de articulaciones de forma simultánea. Muchos sistemas robóticos han manejado esto históricamente dividiendo la tarea en partes —estabilizarse primero, luego mover el brazo—, lo que tiende a hacer que los movimientos sean lentos y de aspecto mecánico.

Google DeepMind anunció Gemini Robotics 2 el 30 de julio, una familia de modelos de IA orientada directamente a ese problema. Según la empresa, el sistema otorga a los robots la capacidad de planificar y ajustar todo su cuerpo, del torso a las piernas, como una única unidad coordinada, permitiendo que una máquina gire, se incline y alcance objetos al mismo tiempo.

En la práctica, esto se traduce en un único sistema de movimiento integrado que permite a un robot humanoide caminar, agacharse, estirarse y manipular objetos para ordenar una habitación desordenada. Las imágenes de demostración publicadas por la empresa muestran robots insertando una cinta en un radiocasete, atornillando una bombilla e incluso atando una bolsa de basura.

El sistema está compuesto por tres modelos especializados: un modelo de Visión-Lenguaje-Acción, un modelo de Razonamiento Encarnado y un controlador integrado en el dispositivo. Esta estructura tripartita separa la planificación de tareas de alto nivel —entender qué hacer— del control motor de bajo nivel —averiguar cómo hacerlo físicamente—, un enfoque arquitectónico que los investigadores en robótica llevan tiempo persiguiendo.

Los resultados de rendimiento varían considerablemente según la tarea. El sistema alcanzó una tasa de éxito del 92% en una tarea que exigía un control preciso de todo el cuerpo: desenroscar una bombilla, demostrando que la motricidad fina y la coordinación corporal más amplia se combinaban con eficacia.

Pero las pruebas con una plataforma robótica llamada Apollo 2 arrojaron resultados más desiguales: una tasa de éxito del 68,4% al recoger objetos de una mesa, del 45,7% desde el suelo y del 76,3% desde un estante.

La menor tasa de éxito al recoger objetos del suelo ilustra un desafío concreto que el campo todavía enfrenta: agacharse requiere desplazar el centro de gravedad del cuerpo mientras se mantiene el equilibrio, percibir la escena desde un ángulo visual distinto y aplicar un agarre preciso en un espacio a menudo más reducido para maniobrar la mano, todas variables que deben gestionarse simultáneamente y en tiempo real.

Aun así, los investigadores subrayan que esta diferencia de rendimiento entre tareas es esperable, ya que cada tarea exige una combinación distinta de equilibrio, percepción y manipulación. El objetivo no es la perfección en una sola tarea, sino una competencia general razonablemente fiable en una amplia variedad de tareas físicas.

Gemini Robotics 2 forma parte de un impulso más amplio de Google hacia sistemas de IA que operan en el mundo físico, un ámbito considerado especialmente difícil porque, a diferencia de los modelos de IA conversacionales, exige lidiar directamente con la incertidumbre y las restricciones físicas del mundo real.

Los expertos afirman que unos robots humanoides fiables y de propósito general para entornos domésticos o industriales probablemente sigan a años de uso cotidiano, pero el progreso en este tipo de coordinación de cuerpo completo se interpreta como una señal de que una de las barreras técnicas más fundamentales del campo —el control de movimiento fragmentado y secuencial— está empezando a superarse.

Este artículo es un resumen editorial asistido por IA basado en The Verge. La imagen es una foto de archivo de Rui Dias en Pexels.

Para seguir leyendo

Un chip de ordenador cuántico dentro de un criostato
Más de Tecnología

Ventaja cuántica: cómo sabemos que los resultados de un ordenador cuántico son correctos

Equipos que incluyen a IBM, la Universidad de Chicago, Algorithmiq, Qedma y RIKEN publicaron tres artículos distintos el mismo día, el 30 de julio, cada uno afirmando realizar cálculos fuera del alcance de los ordenadores clásicos, esta vez con métodos de verificación integrados que pueden confirmar que los resultados son correctos. El trabajo aborda la pregunta que durante mucho tiempo ha socavado las afirmaciones de «ventaja cuántica»: si no se puede comprobar la respuesta de forma clásica, ¿cómo se sabe que es correcta?

Ars Technica
Una sala de servidores de datos centrada en la seguridad
Tecnología

Filtración de datos de CareCloud: qué pasó con los registros médicos de 350.000 pacientes

La empresa estadounidense de tecnología sanitaria CareCloud confirmó que unos piratas informáticos accedieron a una de sus bases de datos de historiales médicos electrónicos durante al menos seis días en marzo, en una filtración que afectó a unas 350.000 personas. La empresa comenzó a enviar cartas de notificación en julio; ningún grupo de piratas conocido ha reivindicado el ataque hasta ahora.

TechCrunchhace 2 h
Código informático mostrado en una pantalla de seguridad
Tecnología

Cómo la IA está ayudando a Google a encontrar y corregir errores de Chrome más rápido

Google afirma haber corregido 1.072 fallos de seguridad en dos versiones de Chrome publicadas en junio, más que los 1.036 errores corregidos en 23 versiones durante los dos años anteriores. La empresa atribuye el salto a agentes de IA que escanean su código, incluido un flujo de trabajo que reveló una vulnerabilidad de escape de sandbox que había pasado inadvertida durante 13 años.

TechCrunchhace 2 h