From 382a8aef2a412f6ba212d81ac83f874ff9d4f74d Mon Sep 17 00:00:00 2001 From: Daniel Han Date: Fri, 14 Mar 2025 01:25:35 -0700 Subject: [PATCH] Update llama.py --- unsloth/models/llama.py | 6 +++--- 1 file changed, 3 insertions(+), 3 deletions(-) diff --git a/unsloth/models/llama.py b/unsloth/models/llama.py index 9746bcb885..3340b89eae 100644 --- a/unsloth/models/llama.py +++ b/unsloth/models/llama.py @@ -1890,9 +1890,9 @@ class FastLlamaModel: gc.collect() torch.cuda.empty_cache()""" multiplier = \ - "4.5 if getattr(model.config, 'quantization_config', \\{'load_in_4bit' : False\\})['load_in_4bit'] else "\ - "8.0 if getattr(model.config, 'quantization_config', \\{'load_in_8bit' : False\\})['load_in_8bit'] else 1.0" - debug_info = debug_info.replace("multiplier__", "(" + multiplier + ")") + "(4.5 if getattr(model.config, 'quantization_config', \\{'load_in_4bit' : False\\})['load_in_4bit'] else "\ + "(8.0 if getattr(model.config, 'quantization_config', \\{'load_in_8bit' : False\\})['load_in_8bit'] else 1.0)" + debug_info = debug_info.replace("multiplier__", multiplier) debug_info = debug_info.replace("P__", "get_model_param_count") debug_info = debug_info.split('\n')