ClearerVoice-Studio:开源AI语音处理工具包 - 语音增强/分离/评分

作者:

ClearerVoice-Studio界面

工具介绍

ClearerVoice-Studio 是一款由阿里达摩院开源的 AI 语音处理工具包,专为研究人员、开发人员和最终用户设计,提供语音增强、语音分离、目标说话人提取等多项功能。

其核心特点包括:

  • 🔬 尖端预训练模型:集成业界领先的语音处理模型
  • 🛠️ 易用接口:简洁的 API 设计,快速上手
  • 📊 全面算法覆盖:支持多种语音处理任务
  • 🤝 社区协作:欢迎贡献新模型和任务

主要功能

🎤 语音处理

  • 语音去噪:有效去除各类环境噪音
  • 语音分离:从混合音频中分离不同声源
  • 目标说话人提取:支持音频、视频和脑电图条件三种模式

🧠 模型训练

  • 提供语音增强和分离的微调脚本
  • 支持多种任务扩展
  • 方便研究人员和开发者自定义训练

📈 语音评分

内置 SpeechScore 工具包,支持多项语音质量评估指标:

  • SNR(信噪比)
  • PESQ(感知语音质量评估)
  • DNSMOS(深度非侵入式语音质量评估)
  • 等多种业界标准指标

工具地址

类型 地址
ClearVoice 演示 HuggingFace 体验
SpeechScore 演示 HuggingFace 体验
GitHub 源码 modelscope/ClearerVoice-Studio

评论

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注