Files
llama.cpp/scripts
thelittlefiremanandCarl Philipp Klemm 748d4225b9 ggml-cuda: HIP: optimize packed byte subtraction (__vsubss4 -> __vsub4) (#29478)
* ggml-cuda: HIP: optimize non-saturating packed byte subtraction (`__vsubss4`)

* CI: ignore 1 spilled vgpr in fattn_vec

---------

Co-authored-by: Carl Philipp Klemm <carl@uvos.xyz>
2026-09-29 19:59:19 +02:00
..
2026-09-07 21:10:06 +02:00
2026-03-08 12:30:21 +01:00
2025-08-18 22:06:44 +03:00
2026-09-24 22:44:05 +03:00
2025-08-18 22:06:44 +03:00
2026-09-07 21:10:06 +02:00
2026-09-12 16:09:46 +02:00