One to More, More to One: Category-Aware Iterative Expert Training for Software Engineering Agents Paper • 2609.23377 • Published 16 days ago • 50
Logics-MLLM/Logics-PPT-Qwen3.6-35B-A3B-RL Reinforcement Learning • 35B • Updated 16 days ago • 165 • 1