nvidia/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-BF16 Text Generation • 75B • Updated 23 days ago • 3.9k • 57
nvidia/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-NVFP4 Text Generation • 45B • Updated 23 days ago • 65.8k • 126
nvidia/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-FP8 Text Generation • 78B • Updated 23 days ago • 23.5k • 17
FFN Fusion: Rethinking Sequential Computation in Large Language Models Paper • 2503.18908 • Published Mar 24, 2025 • 20