RetireOPD: Self-Retiring On-Policy Distillation for Agentic Reinforcement Learning Paper • 2609.20784 • Published 7 days ago • 56
HyQuant: Hybrid-Precision Quantization for LLM Attention Paper • 2608.27875 • Published 27 days ago • 30
RoboSPA: Can VLA Models Go Beyond Simple Scenes and Short-Horizon Tasks? Paper • 2609.05324 • Published 20 days ago • 28
Multi-Grid Post-Training for Long-Form Multi-Shot Video Generation Paper • 2609.06373 • Published 18 days ago • 17
JonathanColetti/Qwen3.8-27B-Uncensored-GGUF Text Generation • 27B • Updated 26 days ago • 2.33M • 1.25k