llama.cpp/ggml/src/ggml-cuda/set.cuh at 307772fcda771c0bff42e312d090addf445c1509 - llama.cpp - Gitea - Peisong Xiao

CS348Project/llama.cpp

mirror of https://github.com/ggml-org/llama.cpp.git synced 2025-11-16 11:27:03 +00:00

Files

YaelGitAccount 851553ea6b cuda: add SET operation support (#16804 )

* feat(cuda): add GGML_OP_SET support

Implement CUDA kernel for SET operation with f32 support.

All tests passing (14598/14598).

* cuda(set): add I32 support; keep F32

* refactor(cuda): use ggml_cuda_cpy to unify SET operator logic and remove code duplication

* Update ggml/src/ggml-cuda/ggml-cuda.cu

Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@scala.com>

* Update ggml/src/ggml-cuda/set.cu

Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@scala.com>

---------

Co-authored-by: Sigbjørn Skjæret <sigbjorn.skjaeret@scala.com>

2025-10-28 20:10:28 +01:00

8 lines

145 B

Plaintext

Raw Blame History

 #pragma once
 #include "common.cuh"
 #define CUDA_SET_BLOCK_SIZE 256
 void ggml_cuda_op_set(ggml_backend_cuda_context & ctx, ggml_tensor * dst);