AccelerateHS / AccelerateHS/accelerate
New-pipeline: improvements to code generation on PTX
Aberta
- Linguagem predominante
- Haskell
- Estrelas
- 1k
- Forks
- 135
- Métricas de merge de PRs
- Nenhum PR com merge em 30d
Descrição
After implementing one-dimensional folds on PTX (#567) on the new-pipeline, we should make several other improvements to the generated code:
- [ ] Multi-dimensional folds (row per threadblock)
- [ ] 1-dimensional scan (chained scan is implemented, should be extended to chained scan *with decoupled look-back*)
- [ ] Multi-dimensional scans (row per threadblock)
- [ ] Permute: lock-free for simple operations
Guia de contribuição
Nenhum guia de contribuição indexado para este repositório
Avaliação
Esta issue ainda não foi avaliada.