Skip to content

sdpa flash attention x86 optimization, llm models enable gqa, dispatch for avx2 bfloat2float #9332

sdpa flash attention x86 optimization, llm models enable gqa, dispatch for avx2 bfloat2float

sdpa flash attention x86 optimization, llm models enable gqa, dispatch for avx2 bfloat2float #9332

Triggered via pull request August 21, 2026 07:28
@nihuinihui
synchronize #6923
nihui:sdpa-fa2
Status Cancelled
Total duration 4m 17s
Artifacts

linux-x64-gpu-gcc.yml

on: pull_request
linux-gcc-gpu
3m 49s
linux-gcc-gpu
linux-gcc-gpu-system-glslang
3m 47s
linux-gcc-gpu-system-glslang
linux-gcc-gpu-t4
3m 47s
linux-gcc-gpu-t4
Fit to window
Zoom out
Zoom in

Annotations

7 errors
linux-gcc-gpu-system-glslang
Canceling since a higher priority waiting request for linux-x64-gpu-gcc-refs/pull/6923/merge exists
linux-gcc-gpu-system-glslang
The operation was canceled.
linux-gcc-gpu
Canceling since a higher priority waiting request for linux-x64-gpu-gcc-refs/pull/6923/merge exists
linux-gcc-gpu
The operation was canceled.
linux-gcc-gpu-t4
Canceling since a higher priority waiting request for linux-x64-gpu-gcc-refs/pull/6923/merge exists
linux-gcc-gpu-t4
The operation was canceled.
linux-x64-gpu-gcc
Canceling since a higher priority waiting request for linux-x64-gpu-gcc-refs/pull/6923/merge exists