FreedomIntelligence/medical-o1-reasoning-SFT
Viewer • Updated • 90.1k • 13.9k • 1.16k
本 LoRA 适配器基于 DeepSeek-R1-Distill-Qwen-14B 进行微调,主要优化医学领域的问答和推理能力。
要使用本 LoRA 适配器,你需要加载原始 DeepSeek-R1-14B 模型,并应用 LoRA 权重:
from transformers import AutoModelForCausalLM, AutoTokenizer
from peft import PeftModel
base_model = "deepseek-ai/DeepSeek-R1-Distill-Qwen-14B"
lora_model = "your-huggingface-username/DeepSeek-R1-Distill-Qwen-14B-lora-med"
tokenizer = AutoTokenizer.from_pretrained(base_model)
model = AutoModelForCausalLM.from_pretrained(base_model, torch_dtype="auto", device_map="auto")
model = PeftModel.from_pretrained(model, lora_model)
input_text = "请问阿司匹林的主要适应症是什么?"
inputs = tokenizer(input_text, return_tensors="pt").to("cuda")
outputs = model.generate(**inputs, max_length=200)
print(tokenizer.decode(outputs[0], skip_special_tokens=True))
transformers + peft + unsloth本 LoRA 适配器基于 DeepSeek-R1-Distill-Qwen-14B,请遵守其官方许可证。
如果你有任何问题或建议,可以在讨论区留言,或者联系我!
Base model
deepseek-ai/DeepSeek-R1-Distill-Qwen-14B