| # AutoAWQ 0.2.5 two-device error break points |
| # b /home/justin/work/AutoAWQ/awq/models/base.py:170 |
| # b /home/justin/work/AutoAWQ/awq/quantize/quantizer.py:61 |
|
|
| # debug GPU memory measuring issue |
| # b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/eval/bench.py:242 |
|
|
| # b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/adapter/autoawq.py:39 |
| # b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/adapter/autoawq.py:46 |
| # b /home/justin/miniconda3/envs/quant-eval/lib/python3.11/site-packages/transformers/modeling_utils.py:955, param_device == 'cpu' |
| # b /home/justin/miniconda3/envs/quant-eval/lib/python3.11/site-packages/transformers/modeling_utils.py:973, param_device == 'cpu' |
| # b /home/justin/work/transformers/modeling_utils.py:989 |
| # b /home/justin/work/transformers/src/transformers/modeling_utils.py:4795 |
| # b /home/justin/work/transformers/src/transformers/modeling_utils.py:4213 |
| # b /home/justin/work/AutoAWQ/awq/models/base.py:338 |
| # b /home/justin/work/accelerate/src/accelerate/big_modeling.py:420 |
| # b /home/justin/work/accelerate/src/accelerate/hooks.py:579, module_name == 'model.layers.28.mlp.gate_proj' |
| # b /home/justin/work/accelerate/src/accelerate/hooks.py:579, module_name == 'model.layers.28' |
| # b /home/justin/work/accelerate/src/accelerate/hooks.py:288 |
| # b /home/justin/work/accelerate/src/accelerate/hooks.py:308 |
| # b /home/justin/work/accelerate/src/accelerate/hooks.py:327 |
| # b /home/justin/miniconda3/envs/quant-eval/lib/python3.11/site-packages/transformers/modeling_utils.py:4194 |
| # b /home/justin/miniconda3/envs/quant-eval/lib/python3.11/site-packages/transformers/quantizers/quantizer_bnb_4bit.py:190 |
| # b /home/justin/work/transformers/src/transformers/modeling_utils.py:4194 |
| # b /home/justin/work/hqq/hqq/utils/optimizer.py:21 |
|
|
| # b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/misc/qweight.py:216 |
| # b /home/justin/work/lm-quant-toolkit/src/cli.py:436 |
| # b /home/justin/work/hqq/hqq/utils/optimizer.py:19 |
| # b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/prep/sensitivity.py:206, i == 25 |
| # b /home/justin/work/hqq/hqq/models/base.py:262 |
| # b /home/justin/work/hqq/hqq/utils/optimizer.py:26 |
| # b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/prep/sensitivity.py:395 |
| # b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/prep/sensitivity.py:413 |
| # b /home/justin/work/hqq/hqq/utils/optimizer.py:26 |
| # b /home/justin/work/hqq/hqq/core/quantize.py:116 |
| # b /home/justin/work/hqq/hqq/core/quantize.py:175 |
| # b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/prep/sensitivity.py:24 |
| # b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/eval/bench.py:256 |
| # b /home/justin/work/lm-quant-toolkit/src/lm_quant_toolkit/eval/bench.py:270 |
| # b /home/justin/work/hqq/hqq/utils/optimizer.py:157 |
| b /home/justin/work/CLIP_benchmark/clip_benchmark/models/open_clip_hqq.py:13 |
| b /home/justin/work/hqq/hqq/models/open_clip/base.py:63 |
|
|