ggml : add MUL_MAT to the list of ops that may need additional memory (for WebGPU) (llama/28071)

Co-authored-by: Stanisław Szymczyk <sszymczy@gmail.com>
This commit is contained in:
fairydreaming
2026-09-04 13:39:36 +03:00
committed by Georgi Gerganov
co-authored by Stanisław Szymczyk
parent db00b0196b
commit 96dddd87f2
+1
View File
@@ -2115,6 +2115,7 @@ ggml_backend_t ggml_backend_sched_get_tensor_backend(ggml_backend_sched_t sched,
bool ggml_backend_op_alloc_size_may_expand(enum ggml_op op) {
switch (op) {
case GGML_OP_FLASH_ATTN_EXT:
case GGML_OP_MUL_MAT:
case GGML_OP_MUL_MAT_ID:
case GGML_OP_CUMSUM:
case GGML_OP_ARGSORT: