Update flex_attention.py

This commit is contained in:
Daniel Han 2024-11-06 14:51:52 -08:00
commit 6b5c599394

View file

@ -15,6 +15,7 @@
import torch
from functools import lru_cache
from transformers.models.llama.modeling_llama import logger
import os
torch_compile_options = {
"epilogue_fusion" : True,