tencent/HY-MT1.5-1.8B-FP8
Translation • 2B • Updated • 43.2k • 16
None defined yet.
Adaptive Reward Routing: Dynamic Multi-Reward Optimization for Joint Audio-Video Diffusion via Forward-Process RL
Draft-KV: Learning Useful Latent Communication Between Language Models