ByteDance-Seed / ByteDance-Seed/Triton-distributed
复现mega_triton_kernel报错
Open
enhancement
NVIDIA
- Dominant language
- Python
- Stars
- 1.5k
- Forks
- 172
- PR merge metrics
- No merged PRs in 30d
Description
- 使用的四卡L20,按照mega_triton_kernel.md的步骤复现报错,报错信息如下;请问这里需要更新的NV卡?就L20而言,这里实现是必须的吗?是否能够规避?
- 报错信息如下:
```
ValueError: The input tensor needs to be a symmetric buffer and AR is only supported in Hopper and later GPU architectures
```
Contributor guide
Assessment
This issue has not been assessed yet.