Google本周已在 iOS App Store 上架免费 AI 听写应用 AI Edge Eloquent。这款产品主打离线语音识别,采用 Google 自家的 Gemma 端侧 ASR 模型,音频处理在设备本地完成,不需要联网,且先于 Android 版本推出。
本地转写为核心,录音后��动整理文本
应用的使用方式较为直接。用户打开 App 后对着麦克风说话,界面会实时显示文字和声波波形;停止录音后,系统会自动过滤“嗯”“啊”等口语赘词,修正断句,并将整理后的文本直接复制到剪贴板。
隐私是这款应用的核心卖点之一。在纯离线模式下,音频数据不会离开用户的 iPhone,也不会被发送到任何服务器。Google 同时提供“云端模式”选项:语音识别依旧在设备端完成,上传到 Gemini 云端模型的只有识别后的文字,而非原始音频,用于做更高质量的文本清理。
按照页面信息,这项服务 完全免费,没有订阅费用,也没有使用量上限。
Google罕见让iOS先行,Android版本仍在后续推出
这次上线还有一个引发关注的点:Google 的产品通常会优先登陆 Android,尤其是涉及端侧 AI 的功能,往往会结合 Pixel 设备与 Gemini Nano 模型先发布。但 AI Edge Eloquent 这次反而先上架 iOS,App Store 描述中还直接写明 Android 版本即将推出。
素材提到,外界对这类安排有两种解读。一种看法认为,Google 可能选择在 iOS 这个非主场环境中测试用户对端侧 AI 听写的接受度和使用习惯;另一种看法则是,iOS 版 Gemma ASR 模型的优化进度可能先达到可用标准,因此 Google 先行上架。
Gemma从模型走向消费级应用场景
从产品定位来看,AI Edge Eloquent 不只是一个普通听写工具。Gemma 是 Google 的开源轻量级 AI 模型系列,目标是在移动设备等资源受限环境中高效运行;AI Edge 则是 Google 用于让开发者在设备端执行机器学习模型的框架。
这款应用把 Gemma 的端侧推理能力直接带入日常语音转写场景,也展示了离线处理与云端文本清理结合的混合架构。对开发者来说,它也提供了一个较具体的参考样板:消费级产品如何在隐私和输出质量之间做取舍,以及端侧 AI 怎样落地到真实使用流程中。

