官网查看
定制方案
- ✓
暂未采集到具体套餐,价格以官网为准
迄今为止我们最精确的语音转文本模型
Gemini 3.5 Transcribe 是 Google 最新推出的语音转文本模型,专注于精确、智能的实时语音转录。它能够快速识别语音内容并即时输出高质量文字,可广泛应用于会议记录、采访整理、字幕生成等场景。
迄今为止我们最精确的语音转文本模型
Gemini 3.5 Transcribe 是 Google 最新推出的语音转文本模型,专注于精确、智能的实时语音转录。它能够快速识别语音内容并即时输出高质量文字,可广泛应用于会议记录、采访整理、字幕生成等场景。
暂未采集到具体套餐,价格以官网为准
很高兴与大家分享这个消息!🚀 Gemini 3.5 Transcribe 是自然语音交互领域的一大飞跃。
无需逐字输入,它按照你实际说话的方式来工作:
• 支持自我纠正
• 去除填充词并整理为干净的文本
• 理解自然意图和说话风格
• 在嘈杂环境中也能准确工作
• 支持最多 3 位说话人,并附带时间戳
• 支持 85+ 种语言、口音和方言
在 Gemini for macOS 上,你可以使用语音来生成图片、搜索、总结、分析文件等。
它还为 Android 上的 Rambler 提供支持,将口头表达的想法转化为精炼文本,并支持语音编辑、纠正和风格调整。
🚀 现已在 Gemini for macOS 和 Android 上的 Rambler 中推出。开发者可以在 Google AI Studio 和 Google Antigravity 中使用它进行开发。