segmentation pyannote
- 类型
- model
- 任务
- voice-activity-detection
- 框架
- pyannote-audio
- 下载量
- 4,125,286
- 点赞
- 692
- 访问
- gated
- 文件
- 0
标签
- 语音活动检测
- 语音
- 音频数据处理
- 深度学习
- 说话人分离
- PyTorch
- 自动语音识别
- 语音识别
摘要
pyannote/segmentation 是 pyannote 音频处理框架的核心预训练模型,用于语音活动检测(VAD),能够从原始音频中准确识别出说话人发声的语音片段与非语音区间。该模型基于深度学习架构,可帮助下游任务(如说话人分离、语音识别)聚焦有效语音段,适用于音视频处理、会议转写、语音日志等场景。