NoisyRollout: Reinforcing Visual Reasoning with Data Augmentation

Liu, Xiangyan; Ni, Jinjie; Wu, Zijian; Du, Chao; Dou, Longxu; Wang, Haonan; Pang, Tianyu; Shieh, Michael Qizhe

Computer Science > Computer Vision and Pattern Recognition

arXiv:2504.13055 (cs)

[Submitted on 17 Apr 2025]

Title:NoisyRollout: Reinforcing Visual Reasoning with Data Augmentation

Authors:Xiangyan Liu, Jinjie Ni, Zijian Wu, Chao Du, Longxu Dou, Haonan Wang, Tianyu Pang, Michael Qizhe Shieh

View PDF HTML (experimental)

Abstract:Recent advances in reinforcement learning (RL) have strengthened the reasoning capabilities of vision-language models (VLMs). However, enhancing policy exploration to more effectively scale test-time compute remains underexplored in VLMs. In addition, VLMs continue to struggle with imperfect visual perception, which in turn affects the subsequent reasoning process. To this end, we propose NoisyRollout, a simple yet effective RL approach that mixes trajectories from both clean and moderately distorted images to introduce targeted diversity in visual perception and the resulting reasoning patterns. Without additional training cost, NoisyRollout enhances the exploration capabilities of VLMs by incorporating a vision-oriented inductive bias. Furthermore, NoisyRollout employs a noise annealing schedule that gradually reduces distortion strength over training, ensuring benefit from noisy signals early while maintaining training stability and scalability in later stages. With just 2.1K training samples, NoisyRollout achieves state-of-the-art performance among open-source RL-tuned models on 5 out-of-domain benchmarks spanning both reasoning and perception tasks, while preserving comparable or even better in-domain performance.

Comments:	Technical Report
Subjects:	Computer Vision and Pattern Recognition (cs.CV)
Cite as:	arXiv:2504.13055 [cs.CV]
	(or arXiv:2504.13055v1 [cs.CV] for this version)
	https://doi.org/10.48550/arXiv.2504.13055

Submission history

From: Xiangyan Liu [view email]
[v1] Thu, 17 Apr 2025 16:10:13 UTC (7,539 KB)

Computer Science > Computer Vision and Pattern Recognition

Title:NoisyRollout: Reinforcing Visual Reasoning with Data Augmentation

Submission history

Access Paper:

References & Citations

Bookmark

Bibliographic and Citation Tools

Code, Data and Media Associated with this Article

Demos

Recommenders and Search Tools

arXivLabs: experimental projects with community collaborators

Computer Science > Computer Vision and Pattern Recognition

Title:NoisyRollout: Reinforcing Visual Reasoning with Data Augmentation

Submission history

Access Paper:

References & Citations

BibTeX formatted citation

Bookmark

Bibliographic and Citation Tools

Code, Data and Media Associated with this Article

Demos

Recommenders and Search Tools

arXivLabs: experimental projects with community collaborators