
工具介绍
ClearerVoice-Studio 是一款由阿里达摩院开源的 AI 语音处理工具包,专为研究人员、开发人员和最终用户设计,提供语音增强、语音分离、目标说话人提取等多项功能。
其核心特点包括:
- 🔬 尖端预训练模型:集成业界领先的语音处理模型
- 🛠️ 易用接口:简洁的 API 设计,快速上手
- 📊 全面算法覆盖:支持多种语音处理任务
- 🤝 社区协作:欢迎贡献新模型和任务
主要功能
🎤 语音处理
- 语音去噪:有效去除各类环境噪音
- 语音分离:从混合音频中分离不同声源
- 目标说话人提取:支持音频、视频和脑电图条件三种模式
🧠 模型训练
- 提供语音增强和分离的微调脚本
- 支持多种任务扩展
- 方便研究人员和开发者自定义训练
📈 语音评分
内置 SpeechScore 工具包,支持多项语音质量评估指标:
- SNR(信噪比)
- PESQ(感知语音质量评估)
- DNSMOS(深度非侵入式语音质量评估)
- 等多种业界标准指标
工具地址
| 类型 | 地址 |
|---|---|
| ClearVoice 演示 | HuggingFace 体验 |
| SpeechScore 演示 | HuggingFace 体验 |
| GitHub 源码 | modelscope/ClearerVoice-Studio |

发表回复