AccelerateHS / AccelerateHS/accelerate

New-pipeline: improvements to code generation on PTX

Aberta
#568 0 comentários 0 reações 0 responsáveis Ver no GitHub
Linguagem predominante
Haskell
Estrelas
1k
Forks
135
Métricas de merge de PRs
Nenhum PR com merge em 30d

Descrição

After implementing one-dimensional folds on PTX (#567) on the new-pipeline, we should make several other improvements to the generated code:
- [ ] Multi-dimensional folds (row per threadblock)
- [ ] 1-dimensional scan (chained scan is implemented, should be extended to chained scan *with decoupled look-back*)
- [ ] Multi-dimensional scans (row per threadblock)
- [ ] Permute: lock-free for simple operations

Guia de contribuição

Nenhum guia de contribuição indexado para este repositório

Avaliação

Esta issue ainda não foi avaliada.

Receba novas issues na sua caixa de entrada

Um resumo curto de issues do GitHub para quem está começando.