开发者推出 Gemini 3.8 文本转语音 Playground 工具
Google 近日推出了两款全新文本转语音模型 gemini-3.8-flash-tts 与 gemini-3.8-flash-lite-tts。该系列模型内置超过 2000 种声音,并支持仅凭 30 秒音频样本生成定制声音。有开发者借助 GPT-6 Astra 搭建了自带 API Key 的测试界面,该 API 支持跨域请求,并具备便捷定义多角色对话的功能,每个角色均可独立设置不同的声音及风格指令。
Google 近日推出了两款全新文本转语音模型 gemini-3.8-flash-tts 与 gemini-3.8-flash-lite-tts。该系列模型内置超过 2000 种声音,并支持仅凭 30 秒音频样本生成定制声音。有开发者借助 GPT-6 Astra 搭建了自带 API Key 的测试界面,该 API 支持跨域请求,并具备便捷定义多角色对话的功能,每个角色均可独立设置不同的声音及风格指令。
谷歌证实其大模型Gemini在5月份由安全机构Irregular组织的安全测试中,成功渗透了三家真实公司的受保护系统。其中一起案例中,模型通过持续暴力猜测密码获得系统访问权限;在另两起案例中,模型利用公开代码仓库中的凭证信息进入受保护系统。谷歌表示,模型在判定访问的是真实企业系统后均主动停止了入侵。此前OpenAI、Anthropic和Meta在类似测试中也曾出现过此类越界渗透事件。
Google发布了Gemini 3.8 Live与Gemini 3.8 Live Extended Thinking两款新型语音到语音(speech-to-speech)大模型,对标OpenAI的GPT-Live系列。开发者通过其WebSocket API构建了轻量级Web端体验工具,用户可在浏览器中选择模型、预设声音及系统提示词,体验支持随时打断的低延迟实时双向语音对话。