Taimwe commited on
Commit
c74bbd3
·
verified ·
1 Parent(s): 182872b

Eval v5: BitsAndBytesConfig for MoE 4-bit

Browse files
Files changed (1) hide show
  1. eval_securecoder.py +14 -3
eval_securecoder.py CHANGED
@@ -6,6 +6,7 @@
6
  # "torch",
7
  # "transformers",
8
  # "bitsandbytes",
 
9
  # ]
10
  # ///
11
  """Cheap evaluations for SecureCoder.
@@ -373,14 +374,24 @@ def main() -> int:
373
  log.error("HF_TOKEN not set"); return 1
374
  os.makedirs(args.out_dir, exist_ok=True)
375
  import torch
376
- from transformers import AutoModelForCausalLM, AutoTokenizer
377
 
378
  random.seed(args.seed)
379
  log.info("loading merged model %s in 4-bit ...", args.merged_repo)
380
  tokenizer = AutoTokenizer.from_pretrained(args.merged_repo, token=token)
 
 
 
 
 
 
381
  model = AutoModelForCausalLM.from_pretrained(
382
- args.merged_repo, token=token, dtype=torch.bfloat16, load_in_4bit=True,
383
- device_map="auto")
 
 
 
 
384
  log.info("model loaded")
385
 
386
  sections = [
 
6
  # "torch",
7
  # "transformers",
8
  # "bitsandbytes",
9
+ # "accelerate",
10
  # ]
11
  # ///
12
  """Cheap evaluations for SecureCoder.
 
374
  log.error("HF_TOKEN not set"); return 1
375
  os.makedirs(args.out_dir, exist_ok=True)
376
  import torch
377
+ from transformers import AutoModelForCausalLM, AutoTokenizer, BitsAndBytesConfig
378
 
379
  random.seed(args.seed)
380
  log.info("loading merged model %s in 4-bit ...", args.merged_repo)
381
  tokenizer = AutoTokenizer.from_pretrained(args.merged_repo, token=token)
382
+ bnb = BitsAndBytesConfig(
383
+ load_in_4bit=True,
384
+ bnb_4bit_quant_type="nf4",
385
+ bnb_4bit_compute_dtype=torch.bfloat16,
386
+ bnb_4bit_use_double_quant=True,
387
+ )
388
  model = AutoModelForCausalLM.from_pretrained(
389
+ args.merged_repo,
390
+ token=token,
391
+ quantization_config=bnb,
392
+ dtype=torch.bfloat16,
393
+ device_map="auto",
394
+ )
395
  log.info("model loaded")
396
 
397
  sections = [