RESEARCH PAPER

IRL-VLA: Training an Vision-Language-Action Policy via Reward World Model

Anqing Jiang; Yu Gao; Yiru Wang; Zhigang Sun; Shuo Wang; Yuwen Heng; Hao Sun; Shichen Tang; Lijuan Zhu; Jinhao Chai; Jijun Wang; Zichong Gu; Hao Jiang; Li Sun

Classification

View four quadrants
Major category
WAMs
Architecture
Dual-system
Prediction paradigm
Other mechanisms
Source review status
Verified from primary sources
AT A GLANCE

Contribution

A contribution summary has not been added yet.

Abstract

An abstract has not been added yet.

Affiliations

Not listed in the collection.

BibTeX