Update flex_attention.py

This commit is contained in:
Daniel Han 2024-11-06 14:51:52 -08:00
commit b3f1a866f4

View file

@ -15,6 +15,7 @@
import torch
from functools import lru_cache
from transformers.models.llama.modeling_llama import logger
import os
torch_compile_options = {
"epilogue_fusion" : True,