💬 观点Google DeepMind
Introducing Gemini 3.8 Live and 3.8 Live Extended — Gemini 3.8 Live 与扩展思考版发布,实时多模态与长推理双线升级
Gemini 3.8 Live 与扩展思考版发布,实时多模态与长推理双线升级
2026-09-15原文
本文为要点摘要,完整细节以原文为准。
🧭 一图看懂
由原文自动提炼 · 以原文为准点击任一分支,查看这一点的一句话解读
Gemini 3.8 Live 双模型发布
Live 主打低成本实时对话,Extended Thinking 主打高复杂度多步推理
- Live:规模化与成本效率,实时视觉接地
- Extended Thinking:边推理边说话,不打断对话
⚙️ 流程拆解
STEP 1用户语音发起请求
STEP 2模型近实时解析语音与视觉
STEP 3后台并行执行工具与 API
STEP 4口头提示与进度播报
STEP 5返回结果并保持对话
🔗 涉及的概念与玩家
- Gemini 3.8 Live模型
- Gemini 3.8 Live Extended Thinking模型
- Google公司
- Gemini Live API产品
- Google Workspace产品
- SynthID方法
- LangChain产品
- LiveKit产品
- Google—发布→Gemini 3.8 Live
- Google—发布→Gemini 3.8 Live Extended Thinking
- Gemini 3.8 Live—接入→Gemini Live API
- Gemini 3.8 Live Extended Thinking—集成→Google Workspace
- Gemini 3.8 Live—使用→SynthID
- LangChain—基于→Gemini Live API
- 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking 两个版本,前者面向实时交互,后者面向需要更长推理链的任务。对 agent 开发者意味着可按延迟与推理深度分层选型。
- 扩展思考版强调在给出答案前进行更长的内部推理,适合复杂规划与多步工具调用场景。工具链设计上需为更长的响应时间预留超时与流式回传策略。
- 两个版本同属 Live 系列,指向实时多模态输入输出的持续投入。对构建语音、视觉实时 agent 的团队,接口层可复用同一套调用范式。
原文:Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking · 作者 Google DeepMind
🕸 顺着图谱继续读
- Fluid, natural voice translation with Gemini 3.5 Live — 谷歌推出 Gemini 3.5 Live Translate,实现接近实时的自然2026-06-09 · 共同涉及 Google、Gemini Live API、SynthID
- Gemini Live audio — Simon Willison 用 AI 现场写了个零依赖网页 UI,试玩 Goo2026-09-15 · 共同涉及 Google、Gemini 3.8 Live、Gemini 3.8 Live Extended Thinking
- Making it easier to understand how content was created — 谷歌 DeepMind 推出新工具,帮助用户追踪网络内容的创建与编辑历史,提升信2026-05-17 · 共同涉及 Google、SynthID
- Delegate architecture · OpenClaw — 让AI代理以独立身份代表组织行动,而非冒充人类。2026-07-06 · 共同涉及 Google Workspace