Update gemma.py

This commit is contained in:
Daniel Han-Chen 2024-02-24 17:13:40 +11:00
commit 23e6ebf14d

View file

@ -67,7 +67,8 @@ def GemmaDecoderLayer_fast_forward(
# padding_mask: Optional[torch.LongTensor] = None,
*args, **kwargs,
) -> Tuple[torch.FloatTensor, Optional[Tuple[torch.FloatTensor, torch.FloatTensor]]]:
if past_key_value is not None:
print(past_key_value)
if False:#past_key_value is not None:
do_prefill = not hasattr(self.self_attn, "paged_attention")
# Self Attention