Qi Tiansheng
TS789
AI & ML interests
None yet
Recent Activity
upvoted a paper about 14 hours ago
Best Practice Critic Optimization upvoted a paper 7 months ago
Rethinking the Trust Region in LLM Reinforcement Learning upvoted a paper over 1 year ago
Optimizing Anytime Reasoning via Budget Relative Policy OptimizationOrganizations
None yet