Nanbeige4.2-3B / .eval_results /swe-bench_verified.yaml
leran1995's picture
Add community evaluation results for CLAW-EVAL, GPQA, HLE, HMMT_FEB_2026, SWE-BENCH_PRO, SWE-BENCH_VERIFIED, TERMINAL-BENCH-2.0 (#7)
451ed48
Raw
History Blame Contribute Delete
183 Bytes
- dataset:
id: SWE-bench/SWE-bench_Verified
task_id: swe_bench_%_resolved
source:
name: Model Card
url: https://huggingface.co/Nanbeige/Nanbeige4.2-3B
value: 63.6