Skip to content

sdpa flash attention x86 optimization, llm models enable gqa, dispatch for avx2 bfloat2float #2221

sdpa flash attention x86 optimization, llm models enable gqa, dispatch for avx2 bfloat2float

sdpa flash attention x86 optimization, llm models enable gqa, dispatch for avx2 bfloat2float #2221

Triggered via pull request August 21, 2026 07:32
@nihuinihui
synchronize #6923
nihui:sdpa-fa2
Status Success
Total duration 29m 5s
Artifacts

linux-loongarch64.yml

on: pull_request
Fit to window
Zoom out
Zoom in