Google DeepMind 发布 Gemini 3.8 Live:主打近实时语音对话与语音智能体

据 9 月 16 日的 AI 资讯汇编,Google DeepMind 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两个近实时语音对话模型,主打语音智能体和复杂任务执行。这是继 9 月初 Gemini 3.8 Flash、Gemini 3.8 Flash Cyber 发布之后,谷歌在对话与智能体方向上的又一重要更新。

Flash 系列的性价比攻势

9 月 2 日,谷歌发布稳定的 Gemini 3.8 Flash API 模型,输入上下文上限约 104.8 万 token,最大输出 6.5 万 token,支持低、中、高三档思考等级,定位为长周期软件工程与智能体工作流模型。其介绍价低至每百万输入 token 0.75 美元、输出 3.75 美元(2026 年 12 月 31 日前有效,2027 年起恢复至 1.50/7.50 美元)。同时发布的 Gemini 3.8 Flash Cyber 则聚焦漏洞检测与补丁生成,通过 Google 的 Fairwind 计划向 可信防御者 开放。

语音智能体的产业意义

Gemini 3.8 Live 系列将多模态对话从 文本+图像 进一步推向 语音+实时交互,使语音智能体能够执行更复杂、更连贯的任务。对开发者和企业而言,这意味着客服、陪伴、车载、智能家居等场景的语音交互将更接近真人,也为 始终在线 的语音 Agent 提供了更强的底层能力。

信息来源:AI 早知·2026-09-16 新闻热点(援引 Google DeepMind 官方博客)、benchr.org Recent AI model releases

声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。