Probing Perceptual Constancy in Large Vision Language Models Paper • 2502.10273 • Published Feb 14, 2025
Core Knowledge Deficits in Multi-Modal Language Models Paper • 2410.10855 • Published Oct 6, 2024 • 4
Vision Language Models See What You Want but not What You See Paper • 2410.00324 • Published Oct 1, 2024
Probing Mechanical Reasoning in Large Vision Language Models Paper • 2410.00318 • Published Oct 1, 2024
VBVR-Pro: A Scalable and Verifiable Suite for Native Visual Reasoning Paper • 2608.26105 • Published Aug 26 • 191
PhyGround: Benchmarking Physical Reasoning in Generative World Models Paper • 2605.10806 • Published May 11 • 3
Vision Language Models Cannot Reason About Physical Transformation Paper • 2603.07109 • Published Mar 7 • 2
Can Vision Language Models Infer Human Gaze Direction? A Controlled Study Paper • 2506.05412 • Published Jun 4, 2025 • 5
Senses Wide Shut: A Representation-Action Gap in Omnimodal LLMs Paper • 2605.13737 • Published May 13 • 1
VBVR-Pro: A Scalable and Verifiable Suite for Native Visual Reasoning Paper • 2608.26105 • Published Aug 26 • 191
SenseNova-U1.5: Towards Native Unified Visual Intelligence Paper • 2609.11929 • Published 17 days ago • 274
VBVR-Pro: A Scalable and Verifiable Suite for Native Visual Collection 23 items • Updated 20 days ago • 5