返回行业动态

Google 推出 Gemini 3.5 Transcribe 语音转文字专用模型

2026/08/28 20:32
查看原文

OmniTools 8月29日消息,Google 正式推出专用于语音转文字的 Gemini 3.5 Transcribe 模型,主打快速、准确且低成本的自动语音识别(ASR)转录能力。

该模型原生支持说话人分离与词级毫秒级时间戳,兼容 85 种以上语言的自动识别及语码转换。用户可通过 custom_vocabulary 参数传入最多 1000 个领域术语,以降低专有名词识别错误率。

Gemini 3.5 Transcribe 提供 Smart Transcription 和 Verbatim 两种转录模式,分别适用于摘要提炼与逐字还原场景。

相关背景

想继续了解,可以看这些

从这条动态出发,继续查看相关分析、产品详情和同主题更新。

最新工具

刚收录的 AI 工具,适合顺手发现可用产品。

查看全部