ByteDance-Seed / ByteDance-Seed/Triton-distributed

复现mega_triton_kernel报错

Open
#110 2 comments 0 reactions 2 assignees Claimed by @XG-zheng View on GitHub
enhancement NVIDIA
Dominant language
Python
Stars
1.5k
Forks
172
PR merge metrics
No merged PRs in 30d

Description

- 使用的四卡L20,按照mega_triton_kernel.md的步骤复现报错,报错信息如下;请问这里需要更新的NV卡?就L20而言,这里实现是必须的吗?是否能够规避?
- 报错信息如下:
```
ValueError: The input tensor needs to be a symmetric buffer and AR is only supported in Hopper and later GPU architectures
```

Contributor guide

Open the contributing guide

Assessment

This issue has not been assessed yet.

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.