Disaggregated Quantization: Specializing LLM Prefill and Decode Paper • 2609.26333 • Published 8 days ago • 65
Online Draft Co-Training for Speculative Decoding in Large-Scale, Long-Context RL Post-Training Paper • 2609.07108 • Published 23 days ago • 36
Unlocking Lossless Speedups in LLMs via Discrete Diffusion Paper • 2609.04010 • Published 27 days ago • 114
agentionai/Qwen3.8-Flash-Next-ROCmFP4-FAST-imatrix-GGUF Text Generation • 177B • Updated 16 days ago • 79.9k • 84