abetlen / abetlen/llama-cpp-python

unknown model architecture: 'gemma-embedding'

Aberta
#2,065 5 comentários 9 reações 0 responsáveis Ver no GitHub
Linguagem predominante
Python
Estrelas
10.6k
Forks
1.4k
Métricas de merge de PRs
Métricas de PR pendentes

Descrição

I am running llama-cpp-python Version: 0.3.16

Trying to load the recently released model [embeddinggemma-300M](https://huggingface.co/unsloth/embeddinggemma-300m-GGUF) I get the following error message:

`llama_model_load: error loading model: error loading model architecture: unknown model architecture: 'gemma-embedding'`

Support for this model architecture has been added to llama.cpp in this build: [https://github.com/ggml-org/llama.cpp/releases/tag/b6384](https://github.com/ggml-org/llama.cpp/releases/tag/b6384)

Could you please align llama-cpp-python to reflect this addition ?

Guia de contribuição

Abrir o guia de contribuição

Avaliação

Esta issue ainda não foi avaliada.

Receba novas issues na sua caixa de entrada

Um resumo curto de issues do GitHub para quem está começando.