TensorBoard
Safetensors
English
llama
picollama / README.md
appvoid's picture
Update README.md
39c5ce8 verified
|
Raw History Blame Contribute Delete
1.2 kB
metadata
language:
  - en
license: apache-2.0
datasets:
  - HuggingFaceFW/fineweb-edu
  - CEAMFA/rewrite
  - openbmb/Ultra-FineWeb-L3

Experimental deep smol lm trained on 23BT using a tinyllama tokenizer

Benchmark Results

Final Summary

Benchmark Primary Metric Score Accuracy Normalized Accuracy Notes
BananaMind Base Bench 1.1 Overall Elo 875.00 33.43% — Weighted Accuracy: 32.52%
ArithMark 3.0 acc_norm 33.10% 32.90% 33.10% Official AxiomicLabs runner
ARC Easy acc_norm 37.21% 40.07% 37.21% lm-eval 0.4.12 · zero-shot
ARC Challenge acc_norm 22.87% 17.92% 22.87% lm-eval 0.4.12 · zero-shot
HellaSwag acc_norm 28.38% 27.60% 28.38% lm-eval 0.4.12 · zero-shot
PIQA acc_norm 60.23% 59.79% 60.23% lm-eval 0.4.12 · zero-shot

Intelligence Index

INT Index: 10.603

Highlights

  • Overall Elo: 875
  • BananaMind Weighted Accuracy: 32.52%
  • Best benchmark: PIQA — 60.23% normalized accuracy
  • ARC Easy: 37.21%
  • ArithMark 3.0: 33.10%
  • HellaSwag: 28.38%
  • ARC Challenge: 22.87%