Annotations as Rollouts: Efficient and Scalable Reinforcement Learning for Video MLLMs
Paper • 2608.20492 • Published • 108
Video Understanding, Audio-Visual, Multimodal LLMs, Video Captioning, Instruction Tuning, Dataset Curation, Qwen-based, Open-source, Fully-Open-MLLMs