Selective Synergistic Learning for Video Object-Centric Learning Paper • 2606.15527 • Published Jun 14 • 4
Learning to Act under Noise: Enhancing Agent Robustness via Noisy Environments Paper • 2605.27209 • Published May 26 • 16
Gamma-World: Generative Multi-Agent World Modeling Beyond Two Players Paper • 2605.28816 • Published May 27 • 433
DelTA: Discriminative Token Credit Assignment for Reinforcement Learning from Verifiable Rewards Paper • 2605.21467 • Published May 20 • 207
TAUR-dev/rankalign-v6-gemma-2-2b-d0.15-e1-persona-v1-all-tcn-fsx-sm0.1 Text Generation • 3B • Updated May 21 • 2 • 1
AlphaGRPO: Unlocking Self-Reflective Multimodal Generation in UMMs via Decompositional Verifiable Reward Paper • 2605.12495 • Published May 12 • 35