diff --git a/unsloth/models/_utils.py b/unsloth/models/_utils.py index 8650e21438..fa6be8cde6 100644 --- a/unsloth/models/_utils.py +++ b/unsloth/models/_utils.py @@ -432,7 +432,12 @@ try: except: pass from transformers import __version__ as transformers_version -from transformers import PretrainedConfig + +try: + from transformers import PreTrainedConfig +except: + from transformers import PretrainedConfig + model_architectures = ["llama", "mistral", "gemma", "gemma2", "qwen2", "granite", "qwen3", "qwen3_moe", "falcon_h1"] for model_name in model_architectures: diff --git a/unsloth/models/vision.py b/unsloth/models/vision.py index a7c12e9644..a5296052cf 100644 --- a/unsloth/models/vision.py +++ b/unsloth/models/vision.py @@ -92,7 +92,13 @@ PRE_COMPILE_INFERENCE = [ "gpt_oss", ] -from transformers import GenerationConfig, CompileConfig, HybridCache, AutoConfig, PretrainedConfig +from transformers import GenerationConfig, CompileConfig, HybridCache, AutoConfig +try: + from transformers import PreTrainedConfig + PretrainedConfig = PreTrainedConfig +except: + from transformers import PretrainedConfig + HAS_TORCH_DTYPE = "torch_dtype" in PretrainedConfig.__doc__ from transformers import GenerationConfig, CompileConfig, HybridCache