From e481db0c4210d13ef7eaa0818c9cb6a3009523a8 Mon Sep 17 00:00:00 2001 From: Daniel Han Date: Tue, 4 Mar 2025 19:08:59 -0800 Subject: [PATCH] Update llama.py --- unsloth/models/llama.py | 6 ++++-- 1 file changed, 4 insertions(+), 2 deletions(-) diff --git a/unsloth/models/llama.py b/unsloth/models/llama.py index 0adb4384bd..297c2984c3 100644 --- a/unsloth/models/llama.py +++ b/unsloth/models/llama.py @@ -1972,7 +1972,8 @@ class FastLlamaModel: # Patch generate if model.generate.__name__ != "unsloth_fast_generate": model._old_generate = model.generate - model.generate = types.MethodType(unsloth_fast_generate, model) + model.generate = unsloth_fast_generate + model.generate.__doc__ = model._old_generate.__doc__ return model, tokenizer pass @@ -2409,7 +2410,8 @@ class FastLlamaModel: # Patch generate if model.generate.__name__ != "unsloth_fast_generate": model._old_generate = model.generate - model.generate = types.MethodType(unsloth_fast_generate, model) + model.generate = unsloth_fast_generate + model.generate.__doc__ = model._old_generate.__doc__ return model pass