PortadaMundo

Robot RL-100 aprende tareas imitando el aprendizaje infantil, según estudio chino

Científicos de la Universidad Jiao Tong de Shanghái desarrollaron un sistema robótico que combina observación humana y aprendizaje autónomo para dominar habilidades como servir jugo o doblar toallas, con una tasa de éxito del 100% en pruebas.

S

Por Redacción Sexta

miércoles, 22 de julio de 2026, 22:32 hs

Robot RL-100 aprende tareas imitando el aprendizaje infantil, según estudio chino

Taller SextaIA

Sexta (Buenos Aires, 22 de julio de 2026).- Un equipo de investigadores de la Universidad Jiao Tong de Shanghái presentó un robot que aprende tareas complejas mediante un proceso inspirado en el aprendizaje infantil. El sistema, denominado RL-100, alcanzó una tasa de éxito del 100% en 1.000 evaluaciones y operó durante siete horas continuas en un centro comercial sin fallos.

Etapas del aprendizaje: imitación y refuerzo

El proceso se divide en tres fases. En la primera, el robot observa a expertos ejecutar tareas mediante teleoperación para entrenar una política visuomotora basada en difusión. Esta asocia imágenes de cámaras RGB o nubes de puntos 3D con los movimientos necesarios para manipular objetos. En la segunda fase, aplica aprendizaje por refuerzo para perfeccionar sus habilidades a través de repetición y experiencia propia, utilizando el algoritmo Proximal Policy Optimization (PPO). Además, incorpora un mecanismo de evaluación offline que previene retrocesos en el rendimiento durante las actualizaciones.

‌‌‌‌‍‌‌‌‌‍‌‌‌‍‌‌‌‌‍‌‌‌‌‍‌‌‌‌‌‍‌‌‌‍‌‌‌‍‌‌‌‌

Resultados en tareas del mundo real

El marco RL-100 fue evaluado en ocho tareas de manipulación, que incluyen servir jugo de naranja, doblar toallas y destapar frascos. El robot igualó o superó la velocidad de teleoperadores humanos expertos, y demostró capacidad de adaptación frente a objetos desconocidos o cambios en el entorno sin reentrenamiento. Durante una experiencia en un centro comercial, operó de manera continua durante siete horas sirviendo jugo fresco sin registrar ningún fallo.

Soluciones técnicas para mejorar el rendimiento

Los investigadores resolvieron el desafío de la latencia computacional asociada a las políticas basadas en difusión mediante una técnica de destilación de modelos de consistencia, que redujo el tiempo de inferencia de 100 milisegundos a 10. El sistema es agnóstico respecto a la tarea, el tipo de robot o la representación sensorial, y puede aplicarse a brazos robóticos simples y sistemas bimanuales admitiendo imágenes RGB o nubes de puntos 3D sin modificar la estructura del aprendizaje.

#Robot#Aprendizaje autónomo#RL-100#Universidad Jiao Tong de Shanghái#Tecnología

Más de Mundo

El escándalo de De Moraes podría impactar las elecciones de octubre en Brasil

El escándalo de De Moraes podría impactar las elecciones de octubre en Brasil

Escalada entre Estados Unidos e Irán dispara el precio del petróleo

Escalada entre Estados Unidos e Irán dispara el precio del petróleo

Un juez cierra las causas contra Juan Orlando Hernández en Honduras

Un juez cierra las causas contra Juan Orlando Hernández en Honduras

Alemania acusa a Rusia por ataque con dron y cierra consulado de Moscú

Alemania acusa a Rusia por ataque con dron y cierra consulado de Moscú

¿Querés llegar a miles de lectores de todo el país?

Anunciate en Sexta

Banners, leaderboards, half page y más. Llegá a tu público con formatos digitales de alto impacto. Presupuesto sin cargo en 24 horas.

📋 Solicitar presupuesto →