Rethinking Critic Learning in PPO: Understanding and Mitigating Value Flattening Paper • 2609.18708 • Published 13 days ago • 82
Continual Learning Mechanisms Compose for Long-Horizon Memorization Paper • 2609.06986 • Published 22 days ago • 375
Eliciting Weak-to-Strong Generalization with On-Policy Reverse Distillation Paper • 2609.08798 • Published 21 days ago • 83
Beyond Retrieval: Progressive Latent Memory Evolution for Streaming Video Understanding Paper • 2609.04131 • Published 26 days ago • 31
Repo-To-Skill: Distilling GitHub Repositories Into AI4AI Skills Paper • 2609.02749 • Published 27 days ago • 403
huihui-ai/Huihui-Qwen3.8-27B-abliterated-GGUF Image-Text-to-Text • 27B • Updated 8 days ago • 2.17M • 940
OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution Paper • 2608.00677 • Published Aug 1 • 265