- ✓
适用于大多数工作负载的均衡性价比
- ✓
按音频分钟计费
Audar-TTS-V1
开放权重阿拉伯语优先表现力文本转语音
Audar-TTS-V1 是什么?
Audar-TTS-V1 是一款面向阿拉伯语的开源权重表现力文本转语音模型。它支持通过内置标签控制[laughs]笑声、[whispers]耳语等语音效果,可生成标准阿拉伯语、方言以及阿英语码混合场景下的自然语音,无需音位器或字素音位转换工具,自带多种自然合成音色。Flash 和 Turbo 版本可免费下载、微调并自行托管,适用于智能语音助手、媒体、教育与无障碍领域。
产品详细介绍
开放权重阿拉伯语优先表现力文本转语音
Audar-TTS-V1 是一款面向阿拉伯语的开源权重表现力文本转语音模型。它支持通过内置标签控制[laughs]笑声、[whispers]耳语等语音效果,可生成标准阿拉伯语、方言以及阿英语码混合场景下的自然语音,无需音位器或字素音位转换工具,自带多种自然合成音色。Flash 和 Turbo 版本可免费下载、微调并自行托管,适用于智能语音助手、媒体、教育与无障碍领域。
定价方案
需要付费- ✓
最高精度,适用于企业生产环境
- ✓
按音频分钟计费
- ✓
带时间戳的多说话人识别与说话人分离
- ✓
按音频分钟计费
创始人评论
Product Hunt 的朋友们好 👋 我还是 Audar 的 Sia。
在我开始介绍之前——直接去试听就好。滚动到样例区域,点击播放,听听这个阿拉伯语声音如何在句中笑出来,转成低语,还能无缝切换阿拉伯语和英语。
文字无法形容这款产品的出色;你的耳朵能体验到。
这就是 Audar-TTS-V1 — 以阿拉伯语为核心的表现力语音合成。它自带一系列自然的合成音色,你可以直接在文本中使用内联标签控制输出语气:[低语]、[兴奋]、[笑声]。不需要音素转换器,不需要发音词典 — 输入原始文本,输出富有表现力的阿拉伯语,支持现代标准阿拉伯语、海湾阿拉伯语以及语码切换。
Flash 和 Turbo 模型已在 Hugging Face 开放权重 — 你可以下载、微调并自行托管。
所以我的一个请求是:粘贴你觉得最难处理的文本——方言、复杂专有名词、阿英混合文本——然后告诉我它听上去是不是足够真实。我一整天都在这里。🙏
创始团队
官网信息
Audar-TTS-V1 推出了阿拉伯语优先的表现力文本转语音模型,开放了 Flash 和 Turbo 权重,支持零样本语音调节、内嵌表达式标签、多语言支持,并采用共享提示协议。