RVC-Project / RVC-Project/Retrieval-based-Voice-Conversion-WebUI

Assertion `srcIndex < srcSelectDimSize` failed

Open
#2,527 0 comments 0 reactions 0 assignees View on GitHub

Nobody has claimed this yet.

Dominant language
Python
Stars
38.4k
Forks
5.3k
PR merge metrics
No merged PRs in 30d

Description

Getting the following error when starting a .wav conversion:

2025-03-29 01:27:56 | INFO | configs.config | Found GPU NVIDIA T500
2025-03-29 01:27:56 | INFO | configs.config | Half-precision floating-point: True, device: cuda:0
2025-03-29 01:27:58 | INFO | __main__ | Use Language: ja_JP
Running on local URL:  http://0.0.0.0:7865
IMPORTANT: You are using gradio version 3.50.2, however version 4.44.1 is available, please upgrade.
--------
2025-03-29 01:28:08 | INFO | infer.modules.vc.modules | Get sid: saulgoodman_500e_12500s.pth
2025-03-29 01:28:08 | INFO | infer.modules.vc.modules | Loading: assets/weights/saulgoodman_500e_12500s.pth
2025-03-29 01:28:09 | INFO | infer.modules.vc.modules | Select index:
2025-03-29 01:28:13 | INFO | fairseq.tasks.hubert_pretraining | current directory is D:\__other\RoudokEN\RVC
2025-03-29 01:28:13 | INFO | fairseq.tasks.hubert_pretraining | HubertPretrainingTask Config {'_name': 'hubert_pretraining', 'data': 'metadata', 'fine_tuning': False, 'labels': ['km'], 'label_dir': 'label', 'label_rate': 50.0, 'sample_rate': 16000, 'normalize': False, 'enable_padding': False, 'max_keep_size': None, 'max_sample_size': 250000, 'min_sample_size': 32000, 'single_target': False, 'random_crop': True, 'pad_audio': False}
2025-03-29 01:28:13 | INFO | fairseq.models.hubert.hubert | HubertModel Config: {'_name': 'hubert', 'label_rate': 50.0, 'extractor_mode': default, 'encoder_layers': 12, 'encoder_embed_dim': 768, 'encoder_ffn_embed_dim': 3072, 'encoder_attention_heads': 12, 'activation_fn': gelu, 'layer_type': transformer, 'dropout': 0.1, 'attention_dropout': 0.1, 'activation_dropout': 0.0, 'encoder_layerdrop': 0.05, 'dropout_input': 0.1, 'dropout_features': 0.1, 'final_dim': 256, 'untie_final_proj': True, 'layer_norm_first': False, 'conv_feature_layers': '[(512,10,5)] + [(512,3,2)] * 4 + [(512,2,2)] * 2', 'conv_bias': False, 'logit_temp': 0.1, 'target_glu': False, 'feature_grad_mult': 0.1, 'mask_length': 10, 'mask_prob': 0.8, 'mask_selection': static, 'mask_other': 0.0, 'no_mask_overlap': False, 'mask_min_space': 1, 'mask_channel_length': 10, 'mask_channel_prob': 0.0, 'mask_channel_selection': static, 'mask_channel_other': 0.0, 'no_mask_channel_overlap': False, 'mask_channel_min_space': 1, 'conv_pos': 128, 'conv_pos_groups': 16, 'latent_temp': [2.0, 0.5, 0.999995], 'skip_masked': False, 'skip_nomask': False, 'checkpoint_activations': False, 'required_seq_len_multiple': 2, 'depthwise_conv_kernel_size': 31, 'attn_type': '', 'pos_enc_type': 'abs', 'fp16': False}
2025-03-29 01:28:18 | INFO | infer.modules.vc.pipeline | Loading rmvpe model,assets/rmvpe/rmvpe.pt
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [32,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [33,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [34,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [35,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [36,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [37,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [38,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [39,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [40,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [41,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [42,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [43,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [44,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [45,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [46,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [47,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [48,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [49,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [50,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [51,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [52,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [53,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [54,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [55,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [56,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [57,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [58,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [59,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [60,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [61,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [62,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
C:\actions-runner\_work\pytorch\pytorch\builder\windows\pytorch\aten\src\ATen\native\cuda\Indexing.cu:1292: block: [13,0,0], thread: [63,0,0] Assertion `srcIndex < srcSelectDimSize` failed.
2025-03-29 01:28:25 | WARNING | infer.modules.vc.modules | Traceback (most recent call last):
  File "D:\__other\RoudokEN\RVC\infer\modules\vc\modules.py", line 188, in vc_single
    audio_opt = self.pipeline.pipeline(
  File "D:\__other\RoudokEN\RVC\infer\modules\vc\pipeline.py", line 375, in pipeline
    self.vc(
  File "D:\__other\RoudokEN\RVC\infer\modules\vc\pipeline.py", line 271, in vc
    audio1 = (net_g.infer(*arg)[0][0, 0]).data.cpu().float().numpy()
  File "D:\__other\RoudokEN\RVC\infer\lib\infer_pack\models.py", line 772, in infer
    m_p, logs_p, x_mask = self.enc_p(phone, pitch, phone_lengths)
  File "C:\Users\ojj\anaconda3\envs\hh\lib\site-packages\torch\nn\modules\module.py", line 1518, in _wrapped_call_impl
    return self._call_impl(*args, **kwargs)
  File "C:\Users\ojj\anaconda3\envs\hh\lib\site-packages\torch\nn\modules\module.py", line 1527, in _call_impl
    return forward_call(*args, **kwargs)
  File "D:\__other\RoudokEN\RVC\infer\lib\infer_pack\models.py", line 64, in forward
    x = self.emb_phone(phone) + self.emb_pitch(pitch)
  File "C:\Users\ojj\anaconda3\envs\hh\lib\site-packages\torch\nn\modules\module.py", line 1518, in _wrapped_call_impl
    return self._call_impl(*args, **kwargs)
  File "C:\Users\ojj\anaconda3\envs\hh\lib\site-packages\torch\nn\modules\module.py", line 1527, in _call_impl
    return forward_call(*args, **kwargs)
  File "C:\Users\ojj\anaconda3\envs\hh\lib\site-packages\torch\nn\modules\sparse.py", line 162, in forward
    return F.embedding(
  File "C:\Users\ojj\anaconda3\envs\hh\lib\site-packages\torch\nn\functional.py", line 2233, in embedding
    return torch.embedding(weight, input, padding_idx, scale_grad_by_freq, sparse)
RuntimeError: CUDA error: device-side assert triggered
Compile with `TORCH_USE_CUDA_DSA` to enable device-side assertions.


Traceback (most recent call last):
  File "C:\Users\ojj\anaconda3\envs\hh\lib\site-packages\gradio\queueing.py", line 407, in call_prediction
    output = await route_utils.call_process_api(
  File "C:\Users\ojj\anaconda3\envs\hh\lib\site-packages\gradio\route_utils.py", line 226, in call_process_api
    output = await app.get_blocks().process_api(
  File "C:\Users\ojj\anaconda3\envs\hh\lib\site-packages\gradio\blocks.py", line 1559, in process_api
    data = self.postprocess_data(fn_index, result["prediction"], state)
  File "C:\Users\ojj\anaconda3\envs\hh\lib\site-packages\gradio\blocks.py", line 1447, in postprocess_data
    prediction_value = block.postprocess(prediction_value)
  File "C:\Users\ojj\anaconda3\envs\hh\lib\site-packages\gradio\components\audio.py", line 341, in postprocess
    file_path = self.audio_to_temp_file(
  File "C:\Users\ojj\anaconda3\envs\hh\lib\site-packages\gradio\components\base.py", line 336, in audio_to_temp_file
    temp_dir = Path(self.DEFAULT_TEMP_DIR) / self.hash_bytes(data.tobytes())
AttributeError: 'NoneType' object has no attribute 'tobytes'

For reference, here is my package list:

absl-py                   2.2.1
aiofiles                  23.2.1
aiohappyeyeballs          2.6.1
aiohttp                   3.11.14
aiosignal                 1.3.2
altair                    5.5.0
annotated-types           0.7.0
antlr4-python3-runtime    4.8
anyio                     4.9.0
aria2                     0.0.1b0
async-timeout             5.0.1
attrs                     25.3.0
audioread                 3.0.1
av                        11.0.0
bitarray                  3.2.0
certifi                   2025.1.31
cffi                      1.17.1
charset-normalizer        3.4.1
click                     8.1.8
colorama                  0.4.6
coloredlogs               15.0.1
contourpy                 1.3.0
cycler                    0.12.1
Cython                    3.0.12
decorator                 5.2.1
einops                    0.8.1
exceptiongroup            1.2.2
fairseq                   0.12.2
faiss-cpu                 1.7.3
fastapi                   0.115.12
ffmpeg-python             0.2.0
ffmpy                     0.3.1
filelock                  3.18.0
flatbuffers               25.2.10
fonttools                 4.56.0
frozenlist                1.5.0
fsspec                    2025.3.0
future                    1.0.0
gradio                    3.50.2
gradio_client             0.6.1
grpcio                    1.71.0
h11                       0.14.0
httpcore                  1.0.7
httpx                     0.28.1
huggingface-hub           0.29.3
humanfriendly             10.0
hydra-core                1.0.7
hyper-connections         0.1.15
idna                      3.10
importlib_metadata        8.6.1
importlib_resources       6.5.2
Jinja2                    3.1.6
joblib                    1.4.2
json5                     0.10.0
jsonschema                4.23.0
jsonschema-specifications 2024.10.1
kiwisolver                1.4.7
librosa                   0.9.1
linkify-it-py             2.0.3
llvmlite                  0.39.0
local-attention           1.11.1
lxml                      5.3.1
Markdown                  3.7
markdown-it-py            2.2.0
MarkupSafe                2.1.5
matplotlib                3.9.4
matplotlib-inline         0.1.7
mdit-py-plugins           0.3.3
mdurl                     0.1.2
mpmath                    1.3.0
multidict                 6.2.0
narwhals                  1.32.0
networkx                  3.2.1
numba                     0.56.4
numpy                     1.23.5
omegaconf                 2.0.6
onnxruntime-gpu           1.19.2
orjson                    3.10.16
packaging                 24.2
pandas                    2.2.3
pillow                    10.4.0
pip                       24.0
platformdirs              4.3.7
pooch                     1.8.2
portalocker               3.1.1
praat-parselmouth         0.4.5
propcache                 0.3.1
protobuf                  6.30.2
pyasn1                    0.6.1
pyasn1_modules            0.4.2
pycparser                 2.22
pydantic                  2.11.1
pydantic_core             2.33.0
pydub                     0.25.1
Pygments                  2.19.1
pyparsing                 3.2.3
pyreadline3               3.5.4
python-dateutil           2.9.0.post0
python-dotenv             1.1.0
python-multipart          0.0.20
pytz                      2025.2
pywin32                   310
pyworld                   0.3.2
PyYAML                    6.0.2
referencing               0.36.2
regex                     2024.11.6
requests                  2.32.3
resampy                   0.4.3
rich                      13.9.4
rpds-py                   0.24.0
ruff                      0.11.2
sacrebleu                 2.5.1
scikit-learn              1.6.1
scipy                     1.13.1
semantic-version          2.10.0
setuptools                75.8.0
shellingham               1.5.4
six                       1.17.0
sniffio                   1.3.1
soundfile                 0.13.1
starlette                 0.46.1
sympy                     1.13.1
tabulate                  0.9.0
tensorboard               2.19.0
tensorboard-data-server   0.7.2
tensorboardX              2.6.2.2
threadpoolctl             3.6.0
tomlkit                   0.12.0
torch                     2.1.0+cu118
torchaudio                2.1.0+cu118
torchcrepe                0.0.20
torchfcpe                 0.0.4
torchvision               0.16.0+cu118
tornado                   6.4.2
tqdm                      4.67.1
traitlets                 5.14.3
typer                     0.15.2
typing_extensions         4.13.0
typing-inspection         0.4.0
tzdata                    2025.2
uc-micro-py               1.0.3
urllib3                   2.3.0
uvicorn                   0.34.0
websockets                11.0.3
Werkzeug                  3.1.3
wheel                     0.45.1
yarl                      1.18.3
zipp                      3.21.0`

Contributor guide

No contributing guide indexed for this repository

First steps

  1. Read the whole issue, then the project's contributing guide.
  2. Comment on the issue to say you are picking it up — it saves two people doing the same work.
  3. Fork the repository and make your change on a branch.
  4. Open a pull request that references the issue number.

Research direction

Reproduce the .wav conversion with the reported environment, then follow the traceback from infer/modules/vc/modules.py through infer/modules/vc/pipeline.py and infer/lib/infer_pack/models.py. Compare the inputs reaching the embedding call and determine why the conversion fails; done means the same conversion completes and returns audio without the CUDA assertion.

Written by the indexing model from the issue text.

Assessment

Tech stack
python, pytorch
Domain
backend, machine-learning
Issue type
Bug
Difficulty
5/5
Estimated time
Over a week
Activity status
Stale
Clarity
Needs clarification
Newbie friendliness
20/100

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.