Commit a8c9a4e7c for llama.cpp
commit a8c9a4e7ccba890d6a2644a235492f836a7371c3
Author: lhez <lih@qti.qualcomm.com>
Date: Fri Oct 2 01:18:51 2026 -0700
opencl: use sigmoid f16 for bf16 (#29787)
diff --git a/ggml/src/ggml-opencl/ggml-opencl.cpp b/ggml/src/ggml-opencl/ggml-opencl.cpp
index 715a19404..4f1f937bb 100644
--- a/ggml/src/ggml-opencl/ggml-opencl.cpp
+++ b/ggml/src/ggml-opencl/ggml-opencl.cpp
@@ -14802,6 +14802,9 @@ static void ggml_cl_sigmoid(ggml_backend_t backend, const ggml_tensor * src0, co
kernel = backend_ctx->kernel_sigmoid_f32;
} else if (src0->type == GGML_TYPE_F16 && dst->type == GGML_TYPE_F16) {
kernel = backend_ctx->kernel_sigmoid_f16;
+ } else if (src0->type == GGML_TYPE_BF16 && dst->type == GGML_TYPE_BF16) {
+ // bf16 converted to f16
+ kernel = backend_ctx->kernel_sigmoid_f16;
} else {
GGML_ASSERT(false && "Unsupported data types for sigmoid (input and output must be both f32 or f16)");
}