alphacep / alphacep/vosk-api

Utterance contains multiple speakers

Offen
#488 2 Kommentare 0 Reaktionen 0 zugewiesene Personen Auf GitHub ansehen
Vorherrschende Sprache
Jupyter Notebook
Sterne
15.1k
Forks
1.8k
PR-Merge-Kennzahlen
Keine gemergten PRs in 30 T.

Beschreibung

I'm noticing that I'm getting a lot of utterances that contain multiple speakers. This will give me speaker vectors that are calculated from multiple voices. This leads to a lot of bad matches. Any ideas on how I can get better results? Any way to tweak for better utterances between speakers? Any way for the speaker model to detect multiple speakers?

I'm using `python vosk-0.3.18` with `vosk-model-en-us-daanzu-20200905-lgraph` and `vosk-model-spk-0.4`

Thanks!

Beitragsleitfaden

Für dieses Repository ist kein Beitragsleitfaden indexiert

Bewertung

Dieses Issue wurde noch nicht bewertet.

Neue Issues direkt in Ihr Postfach

Eine kurze Übersicht über anfängerfreundliche GitHub-Issues.