Dze
xinkekong
AI & ML interests
None yet
Recent Activity
upvoted a paper about 17 hours ago
ProRL: Effective Reinforcement Learning for Proactive Recommendation via Rectified Policy Gradient Estimation upvoted a paper about 17 hours ago
GLM-5: from Vibe Coding to Agentic Engineering updated a model 4 months ago
xinkekong/Qwen3-8B-dapo256-rlcr-64Organizations
None yet