diff --git a/scripts/benchmarks/qwen3_flex_inference.py b/scripts/benchmarks/qwen3_flex_inference.py index e178c9f404..6b9bc7737b 100644 --- a/scripts/benchmarks/qwen3_flex_inference.py +++ b/scripts/benchmarks/qwen3_flex_inference.py @@ -58,7 +58,9 @@ from flex_paged_attention import PagedKVCache, PageTable # noqa: E402 _FLEX_COMPILE_MODE = os.environ.get("FLEX_COMPILE_MODE", None) if _FLEX_COMPILE_MODE: flex_attention_compiled = torch.compile( - flex_attention, fullgraph = True, mode = _FLEX_COMPILE_MODE, + flex_attention, + fullgraph = True, + mode = _FLEX_COMPILE_MODE, ) else: flex_attention_compiled = torch.compile(flex_attention, fullgraph = True)