Skip to content

sdpa flash attention x86 optimization, llm models enable gqa, dispatch for avx2 bfloat2float #2221

sdpa flash attention x86 optimization, llm models enable gqa, dispatch for avx2 bfloat2float

sdpa flash attention x86 optimization, llm models enable gqa, dispatch for avx2 bfloat2float #2221

gcc-loongarch64

succeeded Aug 21, 2026 in 28m 51s