Speech/non-speech segmentation models: ASR end-pointing, diarization pre-processing, streaming turn detection. Server-side and on-device/browser.
-
onnx-community/silero-vad
Voice Activity Detection • Updated • 47 -
FireRedTeam/FireRedVAD
Voice Activity Detection • Updated • 4.72k • 65 -
pyannote/segmentation-3.0
Voice Activity Detection • Updated • 5.86M • 1.72k -
pyannote/voice-activity-detection
Automatic Speech Recognition • Updated • 2.87M • 241