Update gemma.py

This commit is contained in:
Daniel Han-Chen 2024-02-24 17:18:09 +11:00
commit 041aa7d909

View file

@ -67,7 +67,6 @@ def GemmaDecoderLayer_fast_forward(
# padding_mask: Optional[torch.LongTensor] = None,
*args, **kwargs,
) -> Tuple[torch.FloatTensor, Optional[Tuple[torch.FloatTensor, torch.FloatTensor]]]:
print(past_key_value)
if False:#past_key_value is not None:
do_prefill = not hasattr(self.self_attn, "paged_attention")