whisper.cpp/ggml
Pasha Khosravi 6366ca026a
CUDA: add Q2_0 support (llama/25707)
2026-07-30 16:31:52 +03:00
..
cmake ggml : Parallelize quant LUT init (llama/23595) 2026-05-25 12:26:07 +03:00
include RPC: add tensor_memset (llama/25912) 2026-07-30 16:31:51 +03:00
src CUDA: add Q2_0 support (llama/25707) 2026-07-30 16:31:52 +03:00
.gitignore whisper : reorganize source code + improve CMake (#2256) 2024-06-26 19:34:09 +03:00
CMakeLists.txt HIP: remove rocWMMA FlashAttention (llama/26046) 2026-07-30 16:31:48 +03:00