[Docs] presence_penalty设置无效
Open
- Dominant language
- Python
- Stars
- 8.1k
- Forks
- 748
- Avg merge
- 6d 2h
- Merged PRs (30d)
- 54
Description
### 📚 The doc issue
模型:qwen72b
版本:v0.1.0
看源码本身似乎并没有打开presence_penalty,修改src/turbomind/models/llama/llamaBatch.cc中的代码:

参考vllm中presence_penalty的设置范围[-2.0, 2.0]进行设置,发现几乎没有起到作用。将计算的logits值打印出来看了下,发现logits的值非常大,普遍在(-2000, 2000)之间,presence_penalty的设置相对来说太小了。
想请教一下lmdeploy的采样流程,有做softmax吗?
### Suggest a potential alternative/fix
_No response_
Contributor guide
Assessment
This issue has not been assessed yet.