devoppro commited on
Commit
db85aa5
·
verified ·
1 Parent(s): c61c6a0

Update app.py

Browse files
Files changed (1) hide show
  1. app.py +8 -1
app.py CHANGED
@@ -4,8 +4,15 @@ import torch
4
  from transformers import AutoModelForCausalLM, AutoTokenizer
5
 
6
  MODEL_ID = "devoppro/FastLLM"
 
 
 
 
 
 
 
 
7
 
8
- tokenizer = AutoTokenizer.from_pretrained(MODEL_ID, trust_remote_code=True)
9
  model = AutoModelForCausalLM.from_pretrained(
10
  MODEL_ID,
11
  torch_dtype=torch.float16,
 
4
  from transformers import AutoModelForCausalLM, AutoTokenizer
5
 
6
  MODEL_ID = "devoppro/FastLLM"
7
+ TOKENIZER_FALLBACK_ID = "Qwen/Qwen2.5-0.5B" # FastLLM reuses the Qwen2.5 BPE vocab
8
+
9
+ try:
10
+ tokenizer = AutoTokenizer.from_pretrained(MODEL_ID, trust_remote_code=True)
11
+ except Exception as e:
12
+ print(f"Could not load tokenizer from {MODEL_ID} ({e}); "
13
+ f"falling back to {TOKENIZER_FALLBACK_ID}")
14
+ tokenizer = AutoTokenizer.from_pretrained(TOKENIZER_FALLBACK_ID)
15
 
 
16
  model = AutoModelForCausalLM.from_pretrained(
17
  MODEL_ID,
18
  torch_dtype=torch.float16,