llama.cpp/common/common.cpp at 43bdd3ce188cd247bda7c1bd1ad01fa64e566690

mirror of https://github.com/ggml-org/llama.cpp.git synced 2025-10-31 08:51:55 +00:00

Files

fairydreaming 7c3f55c100 Add support for encoder-only T5 models (#8900 )

* gguf-py : add T5ENCODER model architecture

* common : call llama_decode() during warmup only if the model has decoder

* convert-hf : add T5EncoderModel

* llama : add llama_model_has_decoder() API function

* llama : split build_t5() into build_t5_encoder() and build_t5_decoder()

* llama : add support for LLM_ARCH_T5ENCODER

* llama-embedding : add support for LLAMA_POOLING_TYPE_NONE

* llama-embedding : add support for encoder-only models

---------

Co-authored-by: Stanisław Szymczyk <sszymczy@gmail.com>

2024-08-10 11:43:26 +02:00

136 KiB

Raw Blame History

View Raw

136 KiB Raw Blame History

136 KiB

Raw Blame History