2026-09-16 08:43 1004 次浏览

谷歌推出Gemini 3.8 Live与Extended Thinking实时对话模型

谷歌发布Gemini 3.8 Live与Extended Thinking两款实时对话模型,前者主打低延迟交互,后者强化长链推理能力,进一步加码实时AI赛道。

谷歌发布新一代实时对话模型

谷歌近期推出Gemini 3.8 Live与Extended Thinking两款实时对话模型,前者面向低延迟的实时交互场景,后者侧重复杂推理与长链条思考。两款模型均围绕“实时”这一核心能力展开,标志着谷歌在生成式AI对话领域继续加码。

从命名方式看,Gemini 3.8 Live的“Live”指向实时性,强调模型在对话过程中的响应速度与连续交互体验;Extended Thinking则对应“扩展思考”,意图在需要多步推理、长上下文理解的任务中提供更充分的思考过程。两者形成互补,分别覆盖即时对话与深度推理两类需求。

产品定位与能力侧重

实时对话模型近年来成为各大厂商竞逐的重点方向。传统对话模型往往在响应速度与推理深度之间难以兼顾:追求低延迟可能牺牲推理质量,强化推理则容易带来更高的响应时间。Gemini 3.8 Live与Extended Thinking的拆分,反映出谷歌试图通过差异化产品线来应对这一矛盾。

  • Gemini 3.8 Live:面向实时语音、实时助手等场景,强调低延迟与自然交互。
  • Extended Thinking:面向复杂问题求解、多步骤推理等任务,强调思考深度与结果质量。

这种双线布局与当前行业趋势一致。随着AI助手从文本问答扩展到语音、视频与多模态交互,实时性逐渐成为用户体验的关键指标。与此同时,面向专业场景的深度推理能力,也决定模型能否在编程、分析、规划等任务中提供可靠输出。

行业影响与竞争格局

谷歌此次发布的两款模型,进一步丰富了Gemini系列的产品矩阵。在实时对话领域,谷歌面临来自OpenAI、Anthropic、Meta以及微软等厂商的竞争。各家均在推进低延迟对话与推理增强能力,力图在AI助手、企业服务与开发者工具等市场占据有利位置。

对于开发者和站长而言,实时对话模型的迭代意味着可构建的应用形态更加多样,例如实时客服、语音交互界面、在线协作助手等。Extended Thinking类能力则有助于提升自动化流程中的决策质量,减少人工干预。不过,具体接入方式、定价策略与可用区域等信息,仍有待谷歌后续公布。

从更宏观的角度看,实时对话与扩展思考的结合,正在推动AI从“回答问题”向“持续协作”演进。模型不仅要快速响应,还要在必要时进行深入思考,这对底层推理架构与工程优化提出了更高要求。谷歌Gemini 3.8 Live与Extended Thinking的推出,可视为这一演进方向上的最新动作,其实际表现与生态反馈值得持续关注。