amd/Instella-MoE-16B-A3B-SFT-w4a16-llmcompressor Text Generation • 15B • Updated 5 days ago • 119 • 1
amd/Instella-MoE-16B-A3B-SFT-w4a16-llmcompressor Text Generation • 15B • Updated 5 days ago • 119 • 1
PARD: Accelerating LLM Inference with Low-Cost PARallel Draft Model Adaptation Paper • 2504.18583 • Published Apr 23, 2025
DUET-VLM: Dual stage Unified Efficient Token reduction for VLM Training and Inference Paper • 2602.18846 • Published Feb 21 • 5
Agent Laboratory: Using LLM Agents as Research Assistants Paper • 2501.04227 • Published Jan 8, 2025 • 95
Pix2Gif: Motion-Guided Diffusion for GIF Generation Paper • 2403.04634 • Published Mar 7, 2024 • 15
A2Q: Accumulator-Aware Quantization with Guaranteed Overflow Avoidance Paper • 2308.13504 • Published Aug 25, 2023