Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
darioooooo0o
/
tiny-agent-112m
Like
0
Text Generation
Safetensors
8 datasets
English
tiny
agent
tool-use
reinforcement-learning
grpo
engram
from-scratch
intel-arc
License:
apache-2.0
Model card
Files
Files and versions
xet
Community
Copy to bucket
new
main
tiny-agent-112m
/
code
/
scripts
135 kB
Ctrl+K
Ctrl+K
1 contributor
History:
1 commit
darioooooo0o
tiny-agent-112m: base + RL weights, tokenizer, code, model card
4397e12
verified
2 days ago
__init__.py
Safe
0 Bytes
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
bench_size.py
3.81 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
ceiling_read.py
4.47 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
ceiling_search.py
4.81 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
compare_runs.py
821 Bytes
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
dashboard.html
24.6 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
dashboard.py
8.53 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
demo.py
3.19 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
download.py
2.86 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
eval_agent.py
4.46 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
gen_synth.py
10.8 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
grpo.py
14.8 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
pipeline.sh
2.7 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
probe_paraphrase.py
3.59 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
rescore.py
1.66 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
rl_after_decay.sh
2.06 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
rl_pipeline_r2.sh
2.15 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
rl_watchdog.sh
2.84 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
status.py
1.19 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
teacher.py
12.8 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
teacher_window.sh
3.88 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
teacher_window_resume.sh
1.89 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
tokenize_data.py
3.07 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
train.py
10.9 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago
train_tokenizer.py
3.44 kB
tiny-agent-112m: base + RL weights, tokenizer, code, model card
2 days ago