Google 在 2026 年 I/O 大会上发布 Gemini 3.5 Transcribe 语音转文字模型,支持情绪检测、说话人识别、时间戳标记及翻译功能。
该模型拥有 96K Token 上下文窗口,可处理长音频文件,适用于会议记录、法律取证等场景。Google 明确建议,实时转录需使用 Cloud Speech-to-Text API,而非这款模型。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

Google 在 2026 年 I/O 大会上发布 Gemini 3.5 Transcribe 语音转文字模型,支持情绪检测、说话人识别、时间戳标记及翻译功能。
该模型拥有 96K Token 上下文窗口,可处理长音频文件,适用于会议记录、法律取证等场景。Google 明确建议,实时转录需使用 Cloud Speech-to-Text API,而非这款模型。
免责声明:
本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。
加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。