PortadaMundo

Robot RL-100 aprende tareas imitando el aprendizaje infantil, según estudio chino

Científicos de la Universidad Jiao Tong de Shanghái desarrollaron un sistema robótico que combina observación humana y aprendizaje autónomo para dominar habilidades como servir jugo o doblar toallas, con una tasa de éxito del 100% en pruebas.

S

Por Redacción Sexta

miércoles, 22 de julio de 2026, 10:32 p. m. hs

Robot RL-100 aprende tareas imitando el aprendizaje infantil, según estudio chino

Taller SextaIA

Sexta (Buenos Aires, 22 de julio de 2026).- Un equipo de investigadores de la Universidad Jiao Tong de Shanghái presentó un robot que aprende tareas complejas mediante un proceso inspirado en el aprendizaje infantil. El sistema, denominado RL-100, alcanzó una tasa de éxito del 100% en 1.000 evaluaciones y operó durante siete horas continuas en un centro comercial sin fallos.

Etapas del aprendizaje: imitación y refuerzo

El proceso se divide en tres fases. En la primera, el robot observa a expertos ejecutar tareas mediante teleoperación para entrenar una política visuomotora basada en difusión. Esta asocia imágenes de cámaras RGB o nubes de puntos 3D con los movimientos necesarios para manipular objetos. En la segunda fase, aplica aprendizaje por refuerzo para perfeccionar sus habilidades a través de repetición y experiencia propia, utilizando el algoritmo Proximal Policy Optimization (PPO). Además, incorpora un mecanismo de evaluación offline que previene retrocesos en el rendimiento durante las actualizaciones.

​‌‌​​‌​‌‍​‌‌​‌‌​​‍​‌‌​​​‌​‍​‌‌​​‌​‌‍​‌‌‌​​‌​‍​‌‌​‌‌‌​‍​‌‌​​​​‌‍​‌‌​​​‌​‍​‌‌​​‌​‌

Resultados en tareas del mundo real

El marco RL-100 fue evaluado en ocho tareas de manipulación, que incluyen servir jugo de naranja, doblar toallas y destapar frascos. El robot igualó o superó la velocidad de teleoperadores humanos expertos, y demostró capacidad de adaptación frente a objetos desconocidos o cambios en el entorno sin reentrenamiento. Durante una experiencia en un centro comercial, operó de manera continua durante siete horas sirviendo jugo fresco sin registrar ningún fallo.

Soluciones técnicas para mejorar el rendimiento

Los investigadores resolvieron el desafío de la latencia computacional asociada a las políticas basadas en difusión mediante una técnica de destilación de modelos de consistencia, que redujo el tiempo de inferencia de 100 milisegundos a 10. El sistema es agnóstico respecto a la tarea, el tipo de robot o la representación sensorial, y puede aplicarse a brazos robóticos simples y sistemas bimanuales admitiendo imágenes RGB o nubes de puntos 3D sin modificar la estructura del aprendizaje.

#Robot#Aprendizaje autónomo#RL-100#Universidad Jiao Tong de Shanghái#Tecnología

Más de Mundo

Pacto nuclear entre Estados Unidos y Arabia Saudita genera alarma por posible proliferación

Pacto nuclear entre Estados Unidos y Arabia Saudita genera alarma por posible proliferación

Nicolás Maduro compareció en Nueva York y su juicio se fijó para 2027

Nicolás Maduro compareció en Nueva York y su juicio se fijó para 2027

El alcalde de Nueva York pide arrestar a Netanyahu y choca con Trump

El alcalde de Nueva York pide arrestar a Netanyahu y choca con Trump

Fuerte temporal en Chile deja más de 100.000 aislados y 10 muertos

Fuerte temporal en Chile deja más de 100.000 aislados y 10 muertos

¿Querés llegar a miles de lectores de todo el país?

Anunciate en Sexta

Banners, leaderboards, half page y más. Llegá a tu público con formatos digitales de alto impacto. Presupuesto sin cargo en 24 horas.

📋 Solicitar presupuesto →