Nanbeige4.2-3B / .eval_results /claw-eval.yaml
leran1995's picture
Add community evaluation results for CLAW-EVAL, GPQA, HLE, HMMT_FEB_2026, SWE-BENCH_PRO, SWE-BENCH_VERIFIED, TERMINAL-BENCH-2.0 (#7)
451ed48
Raw
History Blame Contribute Delete
161 Bytes
- dataset:
id: claw-eval/Claw-Eval
task_id: general
source:
name: Model Card
url: https://huggingface.co/Nanbeige/Nanbeige4.2-3B
value: 52.2