Trimming the Long-Tail of Visual World Modeling Evaluation Paper • 2606.24256 • Published 28 days ago • 43
Crafter: A Multi-Agent Harness for Editable Scientific Figure Generation from Diverse Inputs Paper • 2605.30611 • Published May 28 • 252
asymmetric-VLM Collection Datasets for https://asymmetric-vlm-post-training.github.io/ • 3 items • Updated Jun 8
OpenVLThinkerV2: A Generalist Multimodal Reasoning Model for Multi-domain Visual Tasks Paper • 2604.08539 • Published Apr 9 • 52