From 8a618c60ed6c24dc78067e5c541c02c291b07f5c Mon Sep 17 00:00:00 2001 From: Daniel Han-Chen Date: Sat, 24 Feb 2024 14:29:15 +1100 Subject: [PATCH] pos --- unsloth/models/gemma.py | 2 +- unsloth/models/llama.py | 4 ++-- 2 files changed, 3 insertions(+), 3 deletions(-) diff --git a/unsloth/models/gemma.py b/unsloth/models/gemma.py index 3821b45478..eb2256f8b8 100644 --- a/unsloth/models/gemma.py +++ b/unsloth/models/gemma.py @@ -271,7 +271,7 @@ class FastGemmaModel(FastLlamaModel): # https://github.com/huggingface/transformers/pull/27931 # https://github.com/huggingface/transformers/blob/v4.37.2/src/transformers/models/llama/modeling_llama.py import transformers.models.gemma.modeling_gemma - # transformers.models.gemma.modeling_gemma.GemmaRotaryEmbedding = LlamaRotaryEmbedding + transformers.models.gemma.modeling_gemma.GemmaRotaryEmbedding = LlamaRotaryEmbedding return pass diff --git a/unsloth/models/llama.py b/unsloth/models/llama.py index d58eb1111a..02681bd4cc 100644 --- a/unsloth/models/llama.py +++ b/unsloth/models/llama.py @@ -879,8 +879,8 @@ class FastLlamaModel: # https://github.com/huggingface/transformers/pull/27931 # https://github.com/huggingface/transformers/blob/v4.37.2/src/transformers/models/llama/modeling_llama.py import transformers.models.llama.modeling_llama - # transformers.models.llama.modeling_llama.LlamaRotaryEmbedding = LlamaRotaryEmbedding - # transformers.models.llama.modeling_llama.LlamaLinearScalingRotaryEmbedding = LlamaLinearScalingRotaryEmbedding + transformers.models.llama.modeling_llama.LlamaRotaryEmbedding = LlamaRotaryEmbedding + transformers.models.llama.modeling_llama.LlamaLinearScalingRotaryEmbedding = LlamaLinearScalingRotaryEmbedding return pass