
Reward AI lanzó OM-1 (Omnibody Model 1) —, una política de manipulación universal entrenada con demostraciones de personas mediante un guante portátil de siete grados de libertad. Según informa MarkTechPost, en el entrenamiento no se utilizaron telepresencia ni datos recopilados directamente en los robots.
Según la fuente, la política funciona en manipuladores industriales y robots humanoides a velocidad humana, y aprende una nueva tarea en menos de 30 minutos de datos. El sistema combina seguimiento electromagnético de la mano con una capa de control entrenada por refuerzo; para el seguimiento se afirma que hay un 60% menor exceso de trayectoria en comparación con el método visual-inercial, a una velocidad de 67.
La implicación práctica del enfoque es la posibilidad de transferir demostraciones humanas a diferentes plataformas robóticas sin telepresencia. Esta es una conclusión analítica, no un resultado de implementación confirmado: los pesos, el código y la API de OM-1 aún no están disponibles públicamente.
comentario editorial
Por qué importa
La consecuencia probable es un mayor interés en el entrenamiento de robots mediante demostraciones humanas en lugar de telepresencia. La siguiente señal observable será la publicación de los pesos, el código, la API o pruebas independientes de OM-1. Persiste una incertidumbre significativa debido a la existencia de una única fuente y la falta de materiales primarios.