Nanbeige4.2-3B / .eval_results /swe-bench_pro.yaml
leran1995's picture
Add community evaluation results for CLAW-EVAL, GPQA, HLE, HMMT_FEB_2026, SWE-BENCH_PRO, SWE-BENCH_VERIFIED, TERMINAL-BENCH-2.0 (#7)
451ed48
Raw
History Blame Contribute Delete
169 Bytes
- dataset:
id: ScaleAI/SWE-bench_Pro
task_id: SWE_Bench_Pro
source:
name: Model Card
url: https://huggingface.co/Nanbeige/Nanbeige4.2-3B
value: 46.9