Reward AI hat OM-1 (Omnibody Model 1) — veröffentlicht, eine universelle Manipulationsrichtlinie, die auf Demonstrationen von Menschen trainiert wurde, die mit einem tragbaren Handschuh mit sieben Freiheitsgraden aufgezeichnet wurden. Wie MarkTechPost berichtet, wurden beim Training weder Telepräsenz noch direkt am Roboter gesammelte Daten verwendet.

Laut der Quelle arbeitet die Richtlinie an industriellen Manipulatoren und humanoiden Robotern mit menschlicher Geschwindigkeit und erlernt neue Aufgaben in weniger als 30 Minuten an Daten. Das System kombiniert eine elektromagnetische Handverfolgung mit einer durch Verstärkungslernen trainierten Steuerungsschicht; für die Verfolgung wird eine um 60% geringere Abweichung von der Trajektorie im Vergleich zur visuell-inertialen Methode bei einer Geschwindigkeit von 67 beansprucht.

Die praktische Bedeutung des Ansatzes liegt in der Möglichkeit, menschliche Demonstrationen auf verschiedene robotische Plattformen ohne Telepräsenz zu übertragen. Dies ist eine analytische Schlussfolgerung und kein bestätigtes Implementierungsergebnis: Gewichte, Code und API von OM-1 sind derzeit öffentlich nicht verfügbar.