Reward AI lanzó OM-1 (Omnibody Model 1) —, una política de manipulación universal entrenada con demostraciones de personas mediante un guante portátil de siete grados de libertad. Según informa MarkTechPost, en el entrenamiento no se utilizaron telepresencia ni datos recopilados directamente en los robots.

Según la fuente, la política funciona en manipuladores industriales y robots humanoides a velocidad humana, y aprende una nueva tarea en menos de 30 minutos de datos. El sistema combina seguimiento electromagnético de la mano con una capa de control entrenada por refuerzo; para el seguimiento se afirma que hay un 60% menor exceso de trayectoria en comparación con el método visual-inercial, a una velocidad de 67.

La implicación práctica del enfoque es la posibilidad de transferir demostraciones humanas a diferentes plataformas robóticas sin telepresencia. Esta es una conclusión analítica, no un resultado de implementación confirmado: los pesos, el código y la API de OM-1 aún no están disponibles públicamente.