MultiverseComputingCAI/Hypernova-60B-2605 Text Generation • 59B • Updated about 6 hours ago • 1.3k • 15
MultiverseComputingCAI/Hypernova-60B-2602 Text Generation • 59B • Updated about 7 hours ago • 193 • 15
Efficient Knowledge Distillation for LLMs: Offline Top-K Logits and a Fused Chunked KL Loss Paper • 2608.03796 • Published 4 days ago • 4
Efficient Knowledge Distillation for LLMs: Offline Top-K Logits and a Fused Chunked KL Loss Paper • 2608.03796 • Published 4 days ago • 4
MultiverseComputingCAI/Hypernova-60B-2602 Text Generation • 59B • Updated about 7 hours ago • 193 • 15