arxiv:2608.00220
Shaohang Wei
SylvainWei
AI & ML interests
NLP, LLM
Recent Activity
liked a model 6 days ago
Accio-Lab/Metis-8B-ColdStart authored a paper 28 days ago
Verifier-Induced Support Reshaping in On-Policy Optimization authored a paper 28 days ago
Experience Augmented Policy Optimization for LLM Reasoning