This website requires JavaScript.
Explore
Help
Register
Sign In
upstream-archive
/
llama.cpp
Watch
1
Star
0
Fork
0
You've already forked llama.cpp
mirror of
https://github.com/ggml-org/llama.cpp.git
synced
2026-07-30 06:30:49 -05:00
Code
Issues
Packages
Projects
Releases
Wiki
Activity
Files
b9574
llama.cpp
/
ggml
/
src
/
ggml-webgpu
History
Reese Levine
3ac3c20c96
ggml-webgpu: Add clang-format job (
#24308
)
...
* Add clang-format job * try local formatting
2026-06-08 20:54:24 -07:00
..
wgsl-shaders
ggml-webgpu: Improve prefill speeds for k-quants + refactor matmul for Q4/Q5/Q8 and k-quants (
#24225
)
2026-06-08 15:19:56 -07:00
CMakeLists.txt
ggml-webgpu: FlashAttention refactor + standardize quantization support (
#23834
)
2026-06-04 08:05:04 +03:00
ggml-webgpu-shader-lib.hpp
ggml-webgpu: Add clang-format job (
#24308
)
2026-06-08 20:54:24 -07:00
ggml-webgpu.cpp
ggml-webgpu: Add clang-format job (
#24308
)
2026-06-08 20:54:24 -07:00
pre_wgsl.hpp
ggml-webgpu: FlashAttention refactor + standardize quantization support (
#23834
)
2026-06-04 08:05:04 +03:00