From 2217e8d86cc40e5185cfe18890c577d43e886f17 Mon Sep 17 00:00:00 2001 From: Daniel Han Date: Tue, 23 Jul 2024 12:28:12 -0700 Subject: [PATCH] Update llama.py --- unsloth/models/llama.py | 2 +- 1 file changed, 1 insertion(+), 1 deletion(-) diff --git a/unsloth/models/llama.py b/unsloth/models/llama.py index 719aee5374..ba4362b3cd 100644 --- a/unsloth/models/llama.py +++ b/unsloth/models/llama.py @@ -1179,7 +1179,7 @@ def _wrap_fast_inference(generate, device_type, dtype, model): # Check pad_token model_eos_token_id = getattr(model.config, "eos_token_id", None) - if hasattr(model_eos_token_id, "__iter__"): + if model_eos_token_id is not None and hasattr(model_eos_token_id, "__iter__"): model_eos_token_id = model_eos_token_id[0] kwargs["pad_token_id"] = kwargs.pop("pad_token_id", model_eos_token_id)