runtime error
Exit code: 1. Reason: = 0 llm_load_print_meta: n_expert_used = 0 llm_load_print_meta: causal attn = 1 llm_load_print_meta: pooling type = 0 llm_load_print_meta: rope type = 0 llm_load_print_meta: rope scaling = linear llm_load_print_meta: freq_base_train = 10000.0 llm_load_print_meta: freq_scale_train = 1 llm_load_print_meta: n_ctx_orig_yarn = 2048 llm_load_print_meta: rope_finetuned = unknown llm_load_print_meta: ssm_d_conv = 0 llm_load_print_meta: ssm_d_inner = 0 llm_load_print_meta: ssm_d_state = 0 llm_load_print_meta: ssm_dt_rank = 0 llm_load_print_meta: ssm_dt_b_c_rms = 0 llm_load_print_meta: model type = ?B llm_load_print_meta: model ftype = Q4_K - Medium llm_load_print_meta: model params = 134.52 M llm_load_print_meta: model size = 98.87 MiB (6.17 BPW) llm_load_print_meta: general.name = Potodoo_Clean llm_load_print_meta: BOS token = 1 '<|im_start|>' llm_load_print_meta: EOS token = 2 '<|im_end|>' llm_load_print_meta: UNK token = 0 '<|endoftext|>' llm_load_print_meta: PAD token = 16 '<empty_output>' llm_load_print_meta: LF token = 143 'Ä' llm_load_print_meta: EOT token = 0 '<|endoftext|>' llm_load_print_meta: max token length = 162 llm_load_tensors: ggml ctx size = 0.13 MiB llama_model_load: error loading model: check_tensor_dims: tensor 'blk.0.attn_k.weight' has wrong shape; expected 576, 288, got 576, 192, 1, 1 llama_load_model_from_file: failed to load model FATAL: Failed to load model: Failed to load model from file: potodoo_v1.gguf Traceback (most recent call last): File "/home/user/app/app.py", line 37, in <module> llm = Llama( ^^^^^^ File "/usr/local/lib/python3.12/site-packages/llama_cpp/llama.py", line 371, in __init__ _LlamaModel( File "/usr/local/lib/python3.12/site-packages/llama_cpp/_internals.py", line 55, in __init__ raise ValueError(f"Failed to load model from file: {path_model}") ValueError: Failed to load model from file: potodoo_v1.gguf
Container logs:
Fetching error logs...