MetaRubric: Learning to Reward for Rubric-Based Reinforcement Learning Paper • 2610.02824 • Published 4 days ago • 14
Science Utopia? Closed-Loop LLM Simulation of Academic Research Ecosystems Paper • 2610.01257 • Published 5 days ago • 19
HyperBrowseComp: A Multilingual and Multimodal Stress Test for Web-Browsing Agents Paper • 2610.03574 • Published 4 days ago • 30
Native Action-Prior Learning from Videos for World Action Models Paper • 2610.03391 • Published 4 days ago • 55