segmentation pyannote

类型
model
任务
voice-activity-detection
框架
pyannote-audio
下载量
4,125,286
点赞
692
访问
gated
文件
0

标签

  • 语音活动检测
  • 语音
  • 音频数据处理
  • 深度学习
  • 说话人分离
  • PyTorch
  • 自动语音识别
  • 语音识别

摘要

pyannote/segmentation 是 pyannote 音频处理框架的核心预训练模型,用于语音活动检测(VAD),能够从原始音频中准确识别出说话人发声的语音片段与非语音区间。该模型基于深度学习架构,可帮助下游任务(如说话人分离、语音识别)聚焦有效语音段,适用于音视频处理、会议转写、语音日志等场景。

查看完整页面 · 查看原文