abetlen / abetlen/llama-cpp-python

unknown model architecture: 'gemma-embedding'

Abierto
#2,065 5 comentarios 9 reacciones 0 asignados Ver en GitHub
Lenguaje dominante
Python
Estrellas
10.6k
Forks
1.4k
Métricas de merge de PR
Métricas de PR pendientes

Descripción

I am running llama-cpp-python Version: 0.3.16

Trying to load the recently released model [embeddinggemma-300M](https://huggingface.co/unsloth/embeddinggemma-300m-GGUF) I get the following error message:

`llama_model_load: error loading model: error loading model architecture: unknown model architecture: 'gemma-embedding'`

Support for this model architecture has been added to llama.cpp in this build: [https://github.com/ggml-org/llama.cpp/releases/tag/b6384](https://github.com/ggml-org/llama.cpp/releases/tag/b6384)

Could you please align llama-cpp-python to reflect this addition ?

Guía de contribución

Abrir la guía de contribución

Evaluación

Este issue todavía no se ha evaluado.

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.