Viu-1.5B-MoE / model /scripts

Commit History

Vectorize MoE dispatch (argsort+bincount): eliminate 2,688 CUDA kernel launches per pass
43847d6
verified

ViuAI commited on

Add live elapsed time counter (fmt_duration) and step pace (s/step, step/h) to console logs
d695257
verified

ViuAI commited on

Optimize chunk_size to 2048 on 24GB+ GPUs (cuts head projections from 64 to 8 per micro-batch)
5b09a76
verified

ViuAI commited on

Fix MoE Muon lag: route 4032 sparse expert weights to PagedAdamW8bit (eliminates 68,000 matmuls per step, 15x faster)
2790f5f
verified

ViuAI commited on

RTX 3090 Max Speed: Zero-sync GPU loss accum, pinned-memory batch slicing, Muon in VRAM, 262k tok/step curriculum
e130703
verified

ViuAI commited on

RTX 3090 Max Speed: Zero-sync GPU loss accum, pinned-memory batch slicing, Muon in VRAM, 262k tok/step curriculum
129fae5
verified

ViuAI commited on

Fix CUDA OOM on T4: cast model to amp_dtype directly, batch_size=2, safe RMSNorm
c50d39e
verified

ViuAI commited on

Fix CUDA OOM on T4: cast model to amp_dtype directly, batch_size=2, safe RMSNorm
006553b
verified

ViuAI commited on

Fix CUDA OOM on T4: cast model to amp_dtype directly, batch_size=2, safe RMSNorm
2ec913e
verified

ViuAI commited on

Fix CUDA OOM on T4: cast model to amp_dtype directly, batch_size=2, safe RMSNorm
1c68440
verified

ViuAI commited on

Fix CUDA OOM on T4: cast model to amp_dtype directly, batch_size=2, safe RMSNorm
c99cb28
verified

ViuAI commited on

Fix CUDA OOM on T4: cast model to amp_dtype directly, batch_size=2, safe RMSNorm
41a0763
verified

ViuAI commited on

Sync model/scripts/train.py after full codebase audit, retry hardening, and token security fixes
7437570
verified

ViuAI commited on

Sync model/scripts/train.py after full codebase audit, retry hardening, and token security fixes
eba5797
verified

ViuAI commited on

Sync model/scripts/viu_moe.py after full codebase audit, retry hardening, and token security fixes
3099578
verified

ViuAI commited on

Sync model/scripts/viu_moe.py after full codebase audit, retry hardening, and token security fixes
59d275d
verified

ViuAI commited on

Sync model/scripts/viu_moe.py after full codebase audit, retry hardening, and token security fixes
a19de2c
verified

ViuAI commited on

Sync model/scripts/train.py after full codebase audit, retry hardening, and token security fixes
90f2273
verified

ViuAI commited on

Sync model/scripts/verify_arch.py after full codebase audit, retry hardening, and token security fixes
da7f1bf
verified

ViuAI commited on

Sync model/scripts/viu_moe.py after full codebase audit, retry hardening, and token security fixes
4304998
verified

ViuAI commited on

Sync model/scripts/train.py after full codebase audit, retry hardening, and token security fixes
a2ed1ce
verified

ViuAI commited on

Sync model/scripts/train.py with adult erotica stories priority integration
aca51f5
verified

ViuAI commited on

Sync model/scripts/train.py with adult erotica stories priority integration
fcb208a
verified

ViuAI commited on

feat: step-1 priority queue integration for real Indian history & cricket shards
cb578f2
verified

ViuAI commited on

feat: 100% zero-exclusion streaming architecture (2,081 shards) and updated docs
40d021b
verified

ViuAI commited on

feat: include toxicity & hate_speech tweets via native tweet adapter in pretraining
3e6a054
verified

ViuAI commited on

feat: unlock 8.55M vortex instruction rows and add corrupted text filter
982d3b9
verified

ViuAI commited on

feat: dynamic streaming buffer refill for continuous 105B pretraining & frozen val benchmark
eae577d
verified

ViuAI commited on

Sync train.py with language tag normalization & category round-robin interleaving
0fad3ba
verified

ViuAI commited on

Unlock all 1,874 Parquet files including all 33 legal shards (model/scripts/train.py)
529c15a
verified

ViuAI commited on

Unlock 1,841 valid Parquet files in streaming engine (model/scripts/train.py)
096c71d
verified

ViuAI commited on

Unlock 26M Samanantar parallel translation stream in train.py (model/scripts/train.py)
4f3733f
verified

ViuAI commited on

Sync full-scale uncapped pretraining dataset updates (model/scripts/train.py)
f036c14
verified

ViuAI commited on

Decouple muon_weight_decay: 0.01 from AdamW weight_decay in model/scripts/train.py
a118f93
verified

ViuAI commited on

Audit fix (grad_ckpt, 1392 comments, smoke experts, tokenizer mask) model/scripts/train.py
39c499b
verified

ViuAI commited on

Audit fix (grad_ckpt, 1392 comments, smoke experts, tokenizer mask) model/scripts/train.py
87a8531
verified

ViuAI commited on

Audit fix (grad_ckpt, 1392 comments, smoke experts, tokenizer mask) model/scripts/viu_moe.py
d61d6d1
verified

ViuAI commited on

Upgrade to Frontier Viu-Transformer (MLA + 1218 MoE + Softcapping) model/scripts/verify_arch.py
76a2013
verified

ViuAI commited on

Upgrade to Frontier Viu-Transformer (MLA + 1218 MoE + Softcapping) model/scripts/viu_moe.py
0b56d55
verified

ViuAI commited on

Upgrade to Frontier Viu-Transformer (MLA + 1218 MoE + Softcapping) model/scripts/verify_arch.py
4b89540
verified

ViuAI commited on

Upgrade to Frontier Viu-Transformer (MLA + 1218 MoE + Softcapping) model/scripts/train.py
eef9197
verified

ViuAI commited on

Upgrade to Frontier Viu-Transformer (MLA + 1218 MoE + Softcapping) model/scripts/viu_moe.py
edbcf66
verified

ViuAI commited on

Update Viu-Transformer 42L neural network implementation
b3671d5
verified

ViuAI commited on

Add model/scripts/verify_arch.py
38e67d2
verified

ViuAI commited on

Add model/scripts/train.py
bd5730e
verified

ViuAI commited on

Add model/scripts/viu_moe.py
b72cc90
verified

ViuAI commited on