alphacep / alphacep/vosk-api

Unable to use my speaker recognition model (model-spk)

未關閉
#1,354 1 則留言 0 個 reaction 已指派 0 人 在 GitHub 檢視
主要語言
Jupyter Notebook
星號
15.1k
分支
1.8k
PR 合併指標
30 天內沒有已合併 PR

描述

Hi, this library is awesome, especially because it can be used offline. I'm a newbie in speaker recognition. I build my speaker recognition model using VoxCeleb v2 recipe in Kaldi and unable to use it on test_speaker.py to replace model-spk. I used default model for the speech recognition model (vosk-model-small-en-us-0.15).

Kaldi 5.5
Vosk 0.3.45

One of my model:
[model-spk.zip](https://github.com/alphacep/vosk-api/files/11452939/model-spk.zip)

LOG (VoskAPI:ReadDataFiles():model.cc:213) Decoding params beam=10 max-active=3000 lattice-beam=2
LOG (VoskAPI:ReadDataFiles():model.cc:216) Silence phones 1:2:3:4:5:6:7:8:9:10
LOG (VoskAPI:RemoveOrphanNodes():nnet-nnet.cc:948) Removed 0 orphan nodes.
LOG (VoskAPI:RemoveOrphanComponents():nnet-nnet.cc:847) Removing 0 orphan components.
LOG (VoskAPI:ReadDataFiles():model.cc:248) Loading i-vector extractor from C:\Users\IdeaPad\.cache\vosk\vosk-model-small-en-us-0.15/ivector/final.ie
LOG (VoskAPI:ComputeDerivedVars():ivector-extractor.cc:183) Computing derived variables for iVector extractor
LOG (VoskAPI:ComputeDerivedVars():ivector-extractor.cc:204) Done.
LOG (VoskAPI:ReadDataFiles():model.cc:282) Loading HCL and G from C:\Users\IdeaPad\.cache\vosk\vosk-model-small-en-us-0.15/graph/HCLr.fst C:\Users\IdeaPad\.cache\vosk\vosk-model-small-en-us-0.15/graph/Gr.fst
LOG (VoskAPI:ReadDataFiles():model.cc:308) Loading winfo C:\Users\IdeaPad\.cache\vosk\vosk-model-small-en-us-0.15/graph/phones/word_boundary.int
LOG (VoskAPI:RemoveOrphanNodes():nnet-nnet.cc:948) Removed 0 orphan nodes.
LOG (VoskAPI:RemoveOrphanComponents():nnet-nnet.cc:847) Removing 0 orphan components.
ASSERTION_FAILED (VoskAPI:AddVec():kaldi-vector.cc:77) Assertion failed: (dim_ == v.dim_)

Please guide me. Thanks.

貢獻指南

這個儲存庫沒有索引到貢獻指南

評估

這個 Issue 還沒有評估資料。

把新 issue 寄到你的電子郵件信箱

精選適合新手參與的 GitHub issue 摘要。