AIDC
DC AI 热点

全部 AI 动态

9月24日2026-09-24
Simon Willison✦ 精选AI 评分 75/10001:12

开发者推出 Gemini 3.8 文本转语音 Playground 工具

Google 近日推出了两款全新文本转语音模型 gemini-3.8-flash-tts 与 gemini-3.8-flash-lite-tts。该系列模型内置超过 2000 种声音,并支持仅凭 30 秒音频样本生成定制声音。有开发者借助 GPT-6 Astra 搭建了自带 API Key 的测试界面,该 API 支持跨域请求,并具备便捷定义多角色对话的功能,每个角色均可独立设置不同的声音及风格指令。

阅读原文 ↗推荐理由:展示了 Google 新一代语音模型支持 30 秒声音克隆及多角色对话合成的应用潜力。# Google# Gemini# 语音# 声音克隆
9月16日2026-09-16
Simon Willison✦ 精选AI 评分 75/10006:47

Google推出Gemini 3.8 Live语音模型,支持实时双向语音交互

Google发布了Gemini 3.8 Live与Gemini 3.8 Live Extended Thinking两款新型语音到语音(speech-to-speech)大模型,对标OpenAI的GPT-Live系列。开发者通过其WebSocket API构建了轻量级Web端体验工具,用户可在浏览器中选择模型、预设声音及系统提示词,体验支持随时打断的低延迟实时双向语音对话。

阅读原文 ↗推荐理由:Google推出新一代实时语音大模型Gemini 3.8 Live,展示了低延迟语音双向交互与打断能力。# 大模型# 语音# 多模态# Google# 推理