Gradium 上线 Voice Design,可用文本描述生成合成语音
巴黎语音 AI 公司 Gradium 推出 Voice Design,用户输入一段文本描述后,可在几秒内生成全新的合成语音,无需参考音频。该功能已上线其 API 和 Studio,免费层在内的所有套餐均可使用,支持英语、法语、西班牙语、葡萄牙语和德语。Gradium 披露的盲测结果显示,其在口音提示对比测试中的胜率为 72.6%,领先于 ElevenLabs、Inworld 等竞争对手。

巴黎语音 AI 公司 Gradium 推出 Voice Design,用户输入一段文本描述后,可在几秒内生成全新的合成语音,无需参考音频。该功能已上线其 API 和 Studio,免费层在内的所有套餐均可使用,支持英语、法语、西班牙语、葡萄牙语和德语。Gradium 披露的盲测结果显示,其在口音提示对比测试中的胜率为 72.6%,领先于 ElevenLabs、Inworld 等竞争对手。

Gradium AI 发布新版文本转语音模型,并设为 API 与 Studio 默认模型。新模型在涵盖五种语言的 500 句硬案例测试中人工通过率达 81.0%,超过 Cartesia Sonic 3.6 和 ElevenLabs v3 Conversational。首音频生成中位数 216 毫秒,比替代模型快 170 毫秒。模型于 2026 年 8 月 31 日上线,现有用户无需迁移,评估数据集已在 Hugging Face 开源。

Spotify开源CLI工具save-to-spotify,用户可将TTS生成的音频一键上传为个人播客,与歌单和节目并列收听,支持多种音频格式。

Nous Research推出的Hermes Agent内置学习闭环,支持一键从OpenClaw迁移,GitHub星数突破6.99万,被称为2026年最具野心的开源Agent发布。

CryptoRank 数据显示,2026 年平均单笔融资额最高的加密赛道集中在预测市场、交易所、区块链和合规。本周一级市场共披露 9 起区块链投融资,规模超 2.61 亿美元,资金继续流向交易、合规与数字资产基础设施。SBI Holdings 同时参与 Gauntlet 的 1.25 亿美元融资和 EDX Markets 的 7600 万美元 C 轮,成为本周最活跃的传统金融机构之一。

xAI通过API上线安全语音克隆功能,用户仅需1分钟录音即可创建可用于生产环境的语音模型,支持多语言输出、REST与WebSocket流式传输,并采用双阶段验证机制。

xAI正式发布Grok STT与TTS两款独立音频API,主打多语种支持、低延迟与具竞争力的价格,并称其转写错误率优于多家主流商业模型,或加速AI语音基础设施竞争。

StepAudio 2.5 TTS正式发布,支持以自然语言对语音情绪、停顿和气息进行精细控制,并提供零样本声音克隆。谷歌同日推出类似方案,显示TTS行业正从“标签选择”转向“自然语言指令”。
