LLaVA-OneVision-1.5: Fully Open Framework for Democratized Multimodal Training Paper • 2509.23661 • Published Sep 28, 2025 • 53
VisionHOPE: Visual Backbones as Self-Modifying Learning Systems Paper • 2609.33325 • Published 7 days ago • 321
TabFM-Auto: Self-Evolving Pipelines for Tabular Foundation Models Paper • 2609.37989 • Published 5 days ago • 11
view article Article NVIDIA Kumo Tabular Sets a New Accuracy-Efficiency Frontier for Tabular Prediction nvidia • 4 days ago • 68
Hard Vision, Easy Vision: What GPT-6 Astra Reveals Across Computer Vision Paper • 2609.35718 • Published 6 days ago • 21
YuE2: Unifying Symbolic and Audio Music Generation at Frontier Quality Paper • 2609.33757 • Published 7 days ago • 242
Self-Evolving Coding Agents: From Digital Programs to Physical-World Intelligence Paper • 2609.35432 • Published 6 days ago • 106
LEGO-Anything: Coding Agents for 3D Scene Reconstruction Paper • 2609.36380 • Published 6 days ago • 130
In-Context Learning for Robots: Methods and Applications Paper • 2609.36012 • Published 6 days ago • 376
Raven: The Harness of Harnesses for Composable Agentic Intelligence Paper • 2609.33439 • Published 7 days ago • 518
EmbodiedMemory-Bench: Benchmarking Embodied Memory for Long-Horizon Embodied Tasks Paper • 2609.28236 • Published 11 days ago • 39
Game Arena: Strategic LLM Evaluation in Competitive Environments Paper • 2609.31473 • Published 9 days ago • 12
TrackEverything: Long Horizon Dense Tracking via De-Duplicating 3D Scene Representations Paper • 2609.30222 • Published 10 days ago • 13