-
adamkarvonen/checkpoints_latentqa_cls_past_lens_addition_Qwen3-8B
Text Generation • Updated • 694 • 1 -
adamkarvonen/checkpoints_cls_latentqa_past_lens_gemma-3-1b-it
Text Generation • Updated • 39 -
adamkarvonen/checkpoints_cls_latentqa_past_lens_Qwen3-1_7B
Text Generation • Updated • 136 -
adamkarvonen/checkpoints_cls_latentqa_past_lens_Llama-3_2-1B-Instruct
Text Generation • Updated • 25
Collections
Discover the best community collections!
Collections trending this week
-
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4
Text Generation • 18B • Updated • 813k • 447 -
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4-DSpark
Text Generation • 0.8B • Updated • 135k • 34 -
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4-DFlash
Text Generation • 0.7B • Updated • 1.6k • 19 -
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16
Text Generation • 32B • Updated • 572k • • 227
-
InternVideo-Next: Towards General Video Foundation Models without Video-Text Supervision
Paper • 2512.01342 • Published • 21 -
revliter/internvideo_next_base_p14_res224_f16
91M • Updated • 393 • 5 -
revliter/internvideo_next_large_p14_res224_f16
0.3B • Updated • 4.51k • 9 -
revliter/internvideo_next_large_p14_res224_f16_stage1
0.3B • Updated • 83 • 2
-
OpenDataArena/MMFineReason-Full-2.3M-Qwen3-VL-235B-Thinking
Viewer • Updated • 2.29M • 2.97k • 65 -
MMFineReason: Closing the Multimodal Reasoning Gap via Open Data-Centric Methods
Paper • 2601.21821 • Published • 62 -
OpenDataArena/MMFineReason-SFT-123K-Qwen3-VL-235B-Thinking
Viewer • Updated • 123k • 270 • 86 -
OpenDataArena/MMFineReason-4B
Visual Question Answering • 5B • Updated • 79 • 15
-
adamkarvonen/checkpoints_latentqa_cls_past_lens_addition_Qwen3-8B
Text Generation • Updated • 694 • 1 -
adamkarvonen/checkpoints_cls_latentqa_past_lens_gemma-3-1b-it
Text Generation • Updated • 39 -
adamkarvonen/checkpoints_cls_latentqa_past_lens_Qwen3-1_7B
Text Generation • Updated • 136 -
adamkarvonen/checkpoints_cls_latentqa_past_lens_Llama-3_2-1B-Instruct
Text Generation • Updated • 25
-
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4
Text Generation • 18B • Updated • 813k • 447 -
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4-DSpark
Text Generation • 0.8B • Updated • 135k • 34 -
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4-DFlash
Text Generation • 0.7B • Updated • 1.6k • 19 -
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16
Text Generation • 32B • Updated • 572k • • 227
-
InternVideo-Next: Towards General Video Foundation Models without Video-Text Supervision
Paper • 2512.01342 • Published • 21 -
revliter/internvideo_next_base_p14_res224_f16
91M • Updated • 393 • 5 -
revliter/internvideo_next_large_p14_res224_f16
0.3B • Updated • 4.51k • 9 -
revliter/internvideo_next_large_p14_res224_f16_stage1
0.3B • Updated • 83 • 2
-
OpenDataArena/MMFineReason-Full-2.3M-Qwen3-VL-235B-Thinking
Viewer • Updated • 2.29M • 2.97k • 65 -
MMFineReason: Closing the Multimodal Reasoning Gap via Open Data-Centric Methods
Paper • 2601.21821 • Published • 62 -
OpenDataArena/MMFineReason-SFT-123K-Qwen3-VL-235B-Thinking
Viewer • Updated • 123k • 270 • 86 -
OpenDataArena/MMFineReason-4B
Visual Question Answering • 5B • Updated • 79 • 15