- ✓
按使用量计费
- ✓
积分永不过期
- ✓
访问所有语音 AI 模型
DramaBox by Resemble AI
人工智能将场景描述转化为声音表演
DramaBox by Resemble AI 是什么?
DramaBox 是 Resemble AI 推出的开源文字转语音模型,能根据你对场景的文本描述直接生成富有表现力的人声演绎,就像导演指导演员一样。只需输入类似"脱口秀主持人故作惊讶地倒吸一口气,然后爆发出笑声"这样的描述,就能得到奥斯卡级别的语音表演,所有输出还会用 Resemble Watermarker 添加可验证的水印,目前仅支持英语,可在 Resemble 账户或 Hugging Face 获取。
产品详细介绍
人工智能将场景描述转化为声音表演
DramaBox 是 Resemble AI 推出的开源文字转语音模型,能根据你对场景的文本描述直接生成富有表现力的人声演绎,就像导演指导演员一样。只需输入类似"脱口秀主持人故作惊讶地倒吸一口气,然后爆发出笑声"这样的描述,就能得到奥斯卡级别的语音表演,所有输出还会用 Resemble Watermarker 添加可验证的水印,目前仅支持英语,可在 Resemble 账户或 Hugging Face 获取。
定价方案
有免费方案- ✓
批量折扣高达 80%
- ✓
更高的并发限制
- ✓
企业服务水平协议(SLA)与 SOC 2
创始人评论
嗨,Product Hunt 👋 我是 Tedi,Resemble AI 的首席技术官。
今天我们发布了 DramaBox,这是一个带水印的开源文字转语音(TTS)模型,你可以像指导演员一样指导它生成语音。
输入内容:
- 自然语言编写的场景描述
- 加引号的对话(例如:“哈哈哈!我简直不敢相信!”)
- 可选内容:供模型克隆的参考语音,或让模型自动选择适配场景的语音
- 示例:“脱口秀主持人震惊地倒吸一口气,‘不!你居然真敢这么说!’ 他爆发出 uncontrollable 无法控制的笑声,‘哈哈哈!哦我的天,哦我的天!’ 他喘着气说,‘我不行了,我现在真的喘不过气了!’”
输出内容:
- 富有表现力的语音演绎,包含由场景描述驱动的笑声、喘息、语速变化和重音处理
- 48kHz 立体声,广播级质量输出
- 现成可用的单音频文件
- 生成时嵌入的 PerTh 水印,用于溯源
所有这一切都无需风格标签、情感标签或后期处理!DramaBox 现已开源,可在 GitHub、Hugging Face 或你的 Resemble 账号中获取。
关于我们默认开启水印的说明:生成式 AI 被恶意使用的情况越来越多,因此带有内置安全机制的语音 AI 能让所有基于 DramaBox 开发的用户获得验证优势。如果你正在构建智能体,也欢迎体验我们的检测 API。
我很好奇大家会用它做出什么有意思的东西,请在这里分享你的反馈或任何有趣的异常用例。
Tedi
创始团队
官网信息
Resemble AI 是唯一一个可针对生成式 AI 提供完整安全防护的平台,支持音频、图像或视频内容的生成、验证与检测,可部署于本地或云端。