Towards Quantifying Benchmark Optimization in ASR Models Paper • 2608.19936 • Published 2 days ago • 8
huihui-ai/Huihui-Qwen3.8-27B-abliterated Image-Text-to-Text • 28B • Updated 5 days ago • 21.6k • • 237
Business Arena: Benchmarking LLM Agents in a Realistic Marketplace Paper • 2608.08621 • Published 13 days ago • 21
Towards Physics of Multimodal Pretraining: Knowledge Flow, Modality Synergy, Early Unification, and Recipes Paper • 2608.05000 • Published 16 days ago • 62
PAST-Bench: Benchmarking the Foundations of Recursive Self-Improvement in Personal Agents Paper • 2608.04003 • Published 18 days ago • 33