This website requires JavaScript.
Explore
Help
Register
Sign In
upstream-archive
/
llama.cpp
Watch
1
Star
0
Fork
0
You've already forked llama.cpp
mirror of
https://github.com/ggml-org/llama.cpp.git
synced
2026-07-27 05:00:59 -05:00
Code
Issues
Packages
Projects
Releases
Wiki
Activity
Files
b8235
llama.cpp
/
docs
/
ops
History
Neo Zhang
213c4a0b81
[SYCL] supprt Flash Attention for fp32/fp16/Q4/Q5/Q8 (
#20190
)
...
* support flash-attention for fp32/fp16/Q4/Q5/Q8 * rm warining * update for JIT
2026-03-08 12:00:07 +08:00
..
BLAS.csv
…
CANN.csv
…
CPU.csv
…
CUDA.csv
…
Metal.csv
…
OpenCL.csv
…
SYCL.csv
[SYCL] supprt Flash Attention for fp32/fp16/Q4/Q5/Q8 (
#20190
)
2026-03-08 12:00:07 +08:00
Vulkan.csv
…
WebGPU.csv
…
zDNN.csv
…
ZenDNN.csv
…