AI Pulse
🔥 热点深度解读

你听说了吗?谷歌推出了对话更流畅的最强对话AI

早上你对着手机问AI,帮我整理昨天的邮件,再设置一个下周的提醒,以前AI要么打断你说话让你等,要么处理完一堆任务突然弹出结果,整个对话节奏支离破碎。

现在谷歌DeepMind推出了两款新的Gemini模型:Gemini 3.8 Live和Gemini 3.8 Live Extended Thinking,这是谷歌目前性能最优的对话式AI模型。它最核心的改变,是可以在后台默默处理你的任务,不会打断你正在进行的对话流程。

和以前的模型比,这次的新品升级了推理能力,还能做到接近实时的视觉理解,甚至支持实时视频理解。面对复杂的多步骤任务,它会一边处理一边给你实时进度说明,还会自然确认你给的信息,完全不用停下来等它干完活再说话。

其中Gemini 3.8 Live Extended Thinking还已经接入了谷歌自家的Gemini Live、Gmail和Keep三款产品,以后你在整理邮件、记笔记的时候,就能直接用到这个能力。

@GoogleDeepMind 认为:这两款模型能在不打断用户对话节奏的前提下,一边聊天一边思考、处理后台任务。

@patloeber 认为:Live API带来的这两款新模型在智能和并行推理上都有重大升级,能让实时语音协作变得更顺畅、更直观。

对于普通用户来说,以后和AI语音聊天、处理日常任务的时候,终于不用再忍受“说话-等处理-再说话”的卡顿节奏,对话体验会更接近和真人聊天的感觉。根据2025年Stack Overflow开发者调查,已经有47%的开发者在使用Gemini,使用率排在ChatGPT、GitHub Copilot之后,Claude之前,开发者的接纳度已经不低。

谷歌这次也给出了介绍性定价:每百万输入令牌0.75美元,每百万输出令牌3.75美元,对于想用这个模型搭建产品的开发者来说,价格也透明了。

当AI终于能跟上我们说话的节奏,接下来会不会改变我们每天和手机交互的方式?

📎 参考来源

查看原始推文

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新