Mingxuan Xia
MingxuanXia
AI & ML interests
None yet
Recent Activity
liked a dataset 42 minutes ago
m-a-p/COIG-CQIA upvoted a paper about 3 hours ago
CoRT: Counterfactual Replay for Token-Level Rubric-Guided Policy Optimization upvoted a paper 13 days ago
SEED: Self-Evolving On-Policy Distillation for Agentic Reinforcement LearningOrganizations
None yet