abetlen / abetlen/llama-cpp-python

igpu

オープン
#1,709 コメント 6 件 リアクション 0 件 担当者 0 名 GitHub で見る
question
主要言語
Python
スター
10.6k
フォーク
1.4k
PR マージ指標
PR 指標を取得中

説明

from llama_cpp import Llama

llm = Llama(
model_path="C:\\Users\\ArabTech\\Desktop\\4\\phi-3.5-mini-instruct-q4_k_m.gguf",
n_gpu_layers=-1,
verbose=True,
)
output = llm(
"Q: Who is Napoleon Bonaparte A: ",
max_tokens=1024,
stop=["\n"] # Add a stop sequence to end generation at a newline
)
print(output)

n_gpu_layers=-1
n_gpu_layers=32

not work on igpu intel

how ofload model on igpu intel?

コントリビューションガイド

コントリビューションガイドを開く

評価

この issue はまだ評価されていません。

新しい issue をメールで受け取る

初心者向けの GitHub issue を短くまとめたダイジェスト。