abetlen / abetlen/llama-cpp-python
Add batched inference
Đang mở
enhancement
high-priority
- Ngôn ngữ chính
- Python
- Star
- 10.6k
- Fork
- 1.4k
- Chỉ số merge pull request
- Chỉ số pull request đang chờ
Mô tả
- [x] Use `llama_decode` instead of deprecated `llama_eval` in `Llama` class
- [ ] Implement batched inference support for `generate` and `create_completion` methods in `Llama` class
- [ ] Add support for streaming / infinite completion
Hướng dẫn đóng góp
Đánh giá
Issue này chưa được đánh giá.