whisper.cpp/ggml
0 030656f26f cuda : add warp-per-row wkv7 kernel for single-token decode (llama/26111) 2026-08-14 22:16:06 +03:00
..
cmake cmake : add config version support (ggml/1582) 2026-08-14 22:16:06 +03:00
include llama: add default load-mode auto, which avoids mmap on iGPUs (llama/26081) 2026-08-14 22:16:06 +03:00
src cuda : add warp-per-row wkv7 kernel for single-token decode (llama/26111) 2026-08-14 22:16:06 +03:00
.gitignore
CMakeLists.txt cmake : add config version support (ggml/1582) 2026-08-14 22:16:06 +03:00