whisper.cpp/ggml
jinzihao 62031fed0b ggml-cpu/ops: vectorize flash-attention V-cache F16 to F32 conversion (llama/26947)
Co-authored-by: jinzihao <jinzihao.jzh@alibaba-inc.com>
2026-08-14 22:16:06 +03:00
..
cmake cmake : add config version support (ggml/1582) 2026-08-14 22:16:06 +03:00
include llama: add default load-mode auto, which avoids mmap on iGPUs (llama/26081) 2026-08-14 22:16:06 +03:00
src ggml-cpu/ops: vectorize flash-attention V-cache F16 to F32 conversion (llama/26947) 2026-08-14 22:16:06 +03:00
.gitignore whisper : reorganize source code + improve CMake (#2256) 2024-06-26 19:34:09 +03:00
CMakeLists.txt cmake : add config version support (ggml/1582) 2026-08-14 22:16:06 +03:00