OpenAI 开源的通用语音识别模型,支持多语言转写与翻译。
CosyVoice 精选
通义实验室的多语言语音合成大模型,支持零样本音色克隆。
- 分类
- 🎙️ 语音与音频
- 仓库
- FunAudioLLM/CosyVoice
- Stars
- ★ 23,920
- Forks
- 2,727
- 语言
- Python
- 许可证
- Apache-2.0
- 最近更新
- 2026-05-25
- 访问次数
- 0
TTS通义
同类项目
仅需几秒到一分钟语音即可克隆音色并合成的 TTS 工具。
VoiceStudio is the open-source, fully-local ElevenLabs alternative — voice cloning, voice design, video dubbing, dictation, transcription & audiobook creation in 646 languages.
Whisper 的 C/C++ 移植,可在 CPU、手机和浏览器里运行。
Port of OpenAI's Whisper model in C/C++
深度学习文本转语音工具包,模型丰富。