Puro-2B: Poor Lab's Qwen2-1.5B Trained on RTX 5090 within $5090 Paper • 2608.27370 • Published 19 days ago • 40
WideSeek-R1: Exploring Width Scaling for Broad Information Seeking via Multi-Agent Reinforcement Learning Paper • 2602.04634 • Published Feb 4 • 101
A Multi-Power Law for Loss Curve Prediction Across Learning Rate Schedules Paper • 2503.12811 • Published Mar 17, 2025 • 2