abetlen / abetlen/llama-cpp-python
llama-server not using GPU
Offen
- Vorherrschende Sprache
- Python
- Sterne
- 10.6k
- Forks
- 1.4k
- PR-Merge-Kennzahlen
- PR-Kennzahlen ausstehend
Beschreibung
After I install `llama-cpp-python-server` with cuda support and run
`python3 -m llama_cpp.server --model starcoderbase-3b/starcoderbase-3b.Q4_K_M.gguf --n_gpu_layers 10
`
The GPU is not getting used its running on the CPU
Beitragsleitfaden
Bewertung
Dieses Issue wurde noch nicht bewertet.