DCAI
DC AI 热点

精选

当前热点完整榜单 →
1高通发力AI软件生态:收购Modular打造统一软件栈,推进Mojo语言多端支持81 热度 ⌁2Black Forest Labs 推出开源具身智能模型 FLUX 3 Action75 热度 ⌁3谷歌云 API Gateway 支持 MCP:将 REST API 原生转化为 AI Agent 工具74 热度 ⌁4Sakana AI聘请AI先驱Jürgen Schmidhuber担任首席科学顾问74 热度 ⌁5谷歌、OpenAI与Anthropic拟联合组建AI安全标准自律组织SAFA73 热度 ⌁
9月24日2026-09-24
The Decoder✦ 精选AI 评分 78/10001:39

谷歌推出Gemini 3.8 Flash TTS模型:支持通过文本描述生成全新AI声音

谷歌发布了两款全新文本转语音模型:Gemini 3.8 Flash TTS 与 Flash-Lite TTS,支持超过100种语言。其中 Flash TTS 能够根据文本提示词直接从零设计全新声音,两款模型均允许用户为特定台词添加舞台动作指示,并支持通过单一脚本生成逼真的双人对话。此外,模型还配备了声音克隆功能,仅需30秒的音频样本即可快速建立声音特征档案。

阅读原文 ↗推荐理由:谷歌新模型实现了通过文本提示词自定义音色及脚本化双人对话控制,显著提升了语音合成的可控性与创作自由度。# 谷歌# Gemini# TTS# 语音生成# 声音克隆
Simon Willison✦ 精选AI 评分 75/10001:12

开发者推出 Gemini 3.8 文本转语音 Playground 工具

Google 近日推出了两款全新文本转语音模型 gemini-3.8-flash-tts 与 gemini-3.8-flash-lite-tts。该系列模型内置超过 2000 种声音,并支持仅凭 30 秒音频样本生成定制声音。有开发者借助 GPT-6 Astra 搭建了自带 API Key 的测试界面,该 API 支持跨域请求,并具备便捷定义多角色对话的功能,每个角色均可独立设置不同的声音及风格指令。

阅读原文 ↗推荐理由:展示了 Google 新一代语音模型支持 30 秒声音克隆及多角色对话合成的应用潜力。# Google# Gemini# TTS# 语音合成# 声音克隆