samai-9b / artifacts /m15_scripts

Commit History

deploy2 v5: lora-scale arg removed (new llama.cpp)
2588ddd
verified

tchbcb commited on

deploy2 v4b: lora fmt + file-only check
9170a35
verified

tchbcb commited on

surgery3: recurrent_layers BOOL 33->32 (R10 logic, Colab)
8c95b99
verified

tchbcb commited on

deploy2 v3: LD += /usr/lib64-nvidia (libcuda.so.1)
ed3de4d
verified

tchbcb commited on

compile v2: tar threshold 30MB (sm_75 single-arch)
10953c9
verified

tchbcb commited on

deploy2 v2: convert check by file-only (tqdm stderr flood pit#69)
36cafc8
verified

tchbcb commited on

deploy2: lora-mount path (cgroup OOM evasion, RAM<3G)
a808312
verified

tchbcb commited on

deploy v6: AutoConfig import fix
50adde2
verified

tchbcb commited on

deploy v5: meta-skel infer device_map (no disk offload)
3bf965a
verified

tchbcb commited on

deploy v4: widen max_memory 14G+8G (no disk offload)
89f319a
verified

tchbcb commited on

deploy v3: offload_folder (correct kwarg)
d2c0fb6
verified

tchbcb commited on

deploy v2: offload_dir fix (12G RAM offload)
c70705a
verified

tchbcb commited on

surgery v2 (public mirror for colab)
e0cdbff
verified

tchbcb commited on

colab T4 ammo fetch (adapter/mmproj/base 18G -> auto fire deploy)
3ba280a
verified

tchbcb commited on

colab T4 m13_r10 deploy chain (merge auto-devmap/convert/surgery/dual-quant/push/serve)
0771951
verified

tchbcb commited on

colab T4 llama.cpp CUDA sm_75 build chain
5073c4a
verified

tchbcb commited on