Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
Asilarkness
/
llm-150m
like
0
Text Generation
Safetensors
English
Russian
cubic_hier_v7_gemma4
custom-code
cubic-attention
muon
dpo
License:
apache-2.0
Model card
Files
Files and versions
xet
Community
Copy to bucket
new
main
llm-150m
945 MB
Ctrl+K
Ctrl+K
1 contributor
History:
2 commits
Asilarkness
Publish faithful CubicV7-Hier 157M with QKNorm, MTP, SFT, reasoning and DPO
c829dc9
verified
12 days ago
.gitattributes
Safe
1.52 kB
initial commit
17 days ago
README.md
1.87 kB
Publish faithful CubicV7-Hier 157M with QKNorm, MTP, SFT, reasoning and DPO
12 days ago
config.json
485 Bytes
Publish faithful CubicV7-Hier 157M with QKNorm, MTP, SFT, reasoning and DPO
12 days ago
final_training_checkpoint.pt
628 MB
xet
Publish faithful CubicV7-Hier 157M with QKNorm, MTP, SFT, reasoning and DPO
12 days ago
generation_config.json
183 Bytes
Publish faithful CubicV7-Hier 157M with QKNorm, MTP, SFT, reasoning and DPO
12 days ago
model.safetensors
314 MB
xet
Publish faithful CubicV7-Hier 157M with QKNorm, MTP, SFT, reasoning and DPO
12 days ago
tokenizer.json
2.5 MB
Publish faithful CubicV7-Hier 157M with QKNorm, MTP, SFT, reasoning and DPO
12 days ago
train_and_chat.py
125 kB
Publish faithful CubicV7-Hier 157M with QKNorm, MTP, SFT, reasoning and DPO
12 days ago
training_manifest.json
19 kB
Publish faithful CubicV7-Hier 157M with QKNorm, MTP, SFT, reasoning and DPO
12 days ago
training_samples.jsonl
2.68 kB
Publish faithful CubicV7-Hier 157M with QKNorm, MTP, SFT, reasoning and DPO
12 days ago