Rethinking Critic Learning in PPO: Understanding and Mitigating Value Flattening Paper • 2609.18708 • Published 14 days ago • 82
Continual Learning Mechanisms Compose for Long-Horizon Memorization Paper • 2609.06986 • Published 23 days ago • 375
Eliciting Weak-to-Strong Generalization with On-Policy Reverse Distillation Paper • 2609.08798 • Published 22 days ago • 84
Beyond Retrieval: Progressive Latent Memory Evolution for Streaming Video Understanding Paper • 2609.04131 • Published 27 days ago • 31
Repo-To-Skill: Distilling GitHub Repositories Into AI4AI Skills Paper • 2609.02749 • Published 28 days ago • 403
huihui-ai/Huihui-Qwen3.8-27B-abliterated-GGUF Image-Text-to-Text • 27B • Updated 8 days ago • 2.06M • 948
OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution Paper • 2608.00677 • Published Aug 1 • 265