- ✓
暂未采集到具体套餐,价格以官网为准
Text to Speech Local
完全在浏览器中运行的免费文字转语音工具
Text to Speech Local 是什么?
Text to Speech Local 是一款完全在浏览器中运行的免费文字转语音工具,基于轻量级的 MOSS-TTS-Nano 多语言模型,通过 WebAssembly 在本地完成推理,文本和音频全程不离开你的设备,隐私安全有保障。它无需注册、没有配额也不带水印,可选用内置音色或上传短音频克隆专属声音,支持调节语速和音量,并直接导出 MP3 或 WAV 文件,普通 CPU 即可流畅运行。
产品详细介绍
完全在浏览器中运行的免费文字转语音工具
Text to Speech Local 是一款完全在浏览器中运行的免费文字转语音工具,基于轻量级的 MOSS-TTS-Nano 多语言模型,通过 WebAssembly 在本地完成推理,文本和音频全程不离开你的设备,隐私安全有保障。它无需注册、没有配额也不带水印,可选用内置音色或上传短音频克隆专属声音,支持调节语速和音量,并直接导出 MP3 或 WAV 文件,普通 CPU 即可流畅运行。
定价方案
需要付费创始人评论
嗨 Product Hunt!👋
我做这个是因为我尝试过的每一个"免费在线 TTS"都有一个同样的问题:你的文字会被上传到别人的服务器,撞上每日配额限制,或者被迫注册账号。
而这一个把整个语音模型跑在你的浏览器里。它就是 MOSS-TTS-Nano,一款来自 OpenMOSS 的 0.1B 多语言语音模型,已编译为 ONNX,并运行在 ONNX Runtime Web 的 WebAssembly 后端上。你的文字和生成的音频永远不会离开你的设备——完全没有调用任何服务端 API。
它能做什么:输入一句话,选择一个内置语音(或者上传一段短音频来克隆一个),点 Speak,然后下载 MP3 或 WAV。自带速度和音量控制。无需注册,没有水印。
目前还不够完善的地方:首次加载会从 Hugging Face 拉取约 760 MB 的模型权重(之后会缓存),而且速度滑块是对波形进行重采样,所以更快的音频听起来也会略微音调升高——磁带式的那种感觉。对短参考音频的语音克隆效果也是时好时坏。
我很想听听你的反馈:你测试了哪些语言,以及在你的设备上 CPU 推理速度是否感觉够用。你接下来想添加什么——SSML、更长的文档,还是批量模式?