AI & ML interests
None yet
Organizations
None yet
sai-lakkshmii/DeepSeek-R1-Distill-Qwen-7B-300steps-increased-context-length-monday
sai-lakkshmii/Qwen1.5-MoE-A2.7B-nemo-replicaa
Updated
sai-lakkshmii/resoning-new-deepseek-300-steps
8B • Updated • 3
sai-lakkshmii/CodeLlama-13b-hf
2B • Updated • 2
sai-lakkshmii/DeepSeek-R1-Distill-Qwen-7B-300steps-increased-context-length
Updated
sai-lakkshmii/merged_model_nemo_replica_DeepSeek-R1-Distill-Qwen-7B-300steps_checkpoint-300
8B • Updated • 6
sai-lakkshmii/DeepSeek-R1-Distill-Qwen-7B-300steps
sai-lakkshmii/merged_model_nemo_replica_merged_model_Qwen1.5-MoE_checkpoint-80
14B • Updated • 1
sai-lakkshmii/merged_model_nemo_replica_merged_model_DeepSeek-R1-Distill-Qwen-7B-500step
8B • Updated • 6
sai-lakkshmii/merged_model_nemo_replica_Qwen1.5-MoE-A2.7B
14B • Updated • 3
sai-lakkshmii/Qwen1.5-MoE-A2.7B-squad-lora-latestt
sai-lakkshmii/llama-3.2-3B-instruct-nemo-replica
sai-lakkshmii/custom-llama-3-2-3b-instruct-1000-steps
3B • Updated • 1
sai-lakkshmii/Qwen1.5-MoE-A2.7B-squad-lora-latest
sai-lakkshmii/llama-3.2-3B-nemo-replica
Updated
sai-lakkshmii/llama-1-8b-1000-squad-lora-latest
Updated
sai-lakkshmii/merged_model_nemo_replica_deepseek-ai-hf
8B • Updated • 4
sai-lakkshmii/DeepSeek-R1-Distill-Qwen-7B-squad-lora-latest
sai-lakkshmii/DeepSeek-R1-Distill-Qwen-7B-squad-nemo-replica
sai-lakkshmii/DeepSeek-R1-Distill-Qwen-7B-squad-lora
sai-lakkshmii/sft-final-No-grad-che-and-no-offloading-custom-code-lora-8-steps-sftsample
Updated
sai-lakkshmii/output-qwen-14b-math
8B • Updated • 5
sai-lakkshmii/output-math-8b
8B • Updated • 6
sai-lakkshmii/merged_model_sft_openthoughts_qwen_longcontextlength_finalstep_93
8B • Updated • 8
sai-lakkshmii/deepseek-finetune-glaive
Updated
sai-lakkshmii/merged_model_sft_openthoughts_qwen_longcontext_highstep
8B • Updated • 6
sai-lakkshmii/output-openthoughts-qwen
Updated