tencent/Hunyuan-A13B-Instruct-FP8
Text Generation • 80B • Updated • 443 • 33
None defined yet.
Adaptive Reward Routing: Dynamic Multi-Reward Optimization for Joint Audio-Video Diffusion via Forward-Process RL
Draft-KV: Learning Useful Latent Communication Between Language Models