Evaluation-Verification Reward for Consistent Multi-Reference Image Editing Paper • 2607.29025 • Published 5 days ago • 14
ExtractBench: A Benchmark for Schema-Guided Enterprise Document Extraction Paper • 2607.29677 • Published 5 days ago • 17
Meshy T2: Fast Native Mesh Generation with Flow Matching Paper • 2607.28675 • Published 8 days ago • 47
ReToken: One Token to Improve Vision-Language Models for Visual Retrieval Paper • 2607.28627 • Published 6 days ago • 7
Chimera: Designing and Chinchilla-Scaling Hybrid Visual Diffusion Transformers Paper • 2607.28611 • Published 6 days ago • 19
ACE-Data-0: Human-Centric Ambient Capture as Embodied Data Engine Paper • 2607.28625 • Published 6 days ago • 41
PhiZero: A World Model Built Around Physical Language Paper • 2607.28624 • Published 6 days ago • 165
OmegaUse-OfficeVal: Benchmarking LLM Agents on Long-Horizon Office-Suite Tasks with Economic Grounding Paper • 2607.27155 • Published 7 days ago • 12
Can AI agents conduct open-ended AI research? Early evidence from two case studies Paper • 2607.27191 • Published 7 days ago • 18
PerceptionBench: Evaluating Atomic Visual Perception in Multimodal Large Language Models Paper • 2607.24957 • Published 9 days ago • 18
OmniDelta: Skill-Driven Budget Allocation for Token Compression in OmniLLMs Paper • 2607.25669 • Published 8 days ago • 9
GNM Head: A Generative aNthropometric Model of the human head Paper • 2607.23687 • Published 10 days ago • 5
FilmBench: A Film-Grade Benchmark for Cinematic Video Generation Paper • 2607.24241 • Published 9 days ago • 6
Molt: A Scalable PyTorch-Native Training Framework for Agentic Reinforcement Learning Paper • 2607.21653 • Published 14 days ago • 32