Google发布三款Gemini新模型,AI应用更便宜更快更安全
Google发布了三款新的Gemini模型:3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber。三款定位不同,但方向一致——让AI应用更便宜、更快、更安全。
3.6 Flash:输出少,成本低
3.6 Flash比3.5 Flash省了17%的输出token。在某些任务上,比如DeepSWE基准,省得更多,最多能省65%。token就是AI按量计费的计量单位,输出越少,成本越低。它的定价是每百万输入token 1.50美元,每百万输出token 7.50美元。开发者运营成本降下来,最终可能会反映在产品的价格或免费服务上。
当然,基准测试里的节省在真实场景中能不能对上,材料没说。基准环境通常很理想,实际用起来可能有出入。
性能上,3.6 Flash提升不小。DeepSWE从37%升到49%。MLE Bench从49.7%升到63.9%。OSWorld-Verified从78.4%升到83.0%。GDPval-AA v2从1349升到1421。这些数字对应的是编程、知识工作、计算机使用这类任务。你用的编程助手、文档分析工具会变得更准,多步骤任务的失误率也在下降。
3.5 Flash-Lite:速度快,价格低
3.5 Flash-Lite主打速度。输出速度达到每秒350 token,定价更便宜——每百万输入token 0.30美元,每百万输出token 2.50美元。低成本和高速让它特别适合高吞吐量的活儿,比如大规模数据处理和实时搜索。
别看它小,性能一点都不差。Terminal-Bench 2.1从31%升到54%。GDM-MRCR v2从60.1%升到72.2%。GDPval-AA v2从642升到1140。跟上一代3 Flash比,SWE-Bench Pro上54.2%对49.6%,OSWorld-Verified上74.0%对65.1%。更小更快的模型,在多个任务上已经超过了上一代。
3.5 Flash Cyber:为网络安全定制
3.5 Flash Cyber是在3.5 Flash基础上微调的,专门用来发现和修复网络安全漏洞。它会通过CodeMender以有限访问试点项目的形式,提供给政府和受信任的合作伙伴。网络安全领域确实需要专用模型,但眼下只对特定机构开放。普通企业什么时候能用上?材料没有给出时间表。
另外,3.6 Flash还加强了在化学、生物、放射、核以及网络攻击方面的Frontier Safety防护。安全这块,Google两头都在做。
即日可用,覆盖多种场景
新模型今天就能用。开发者可以通过Gemini API、Google AI Studio、Android Studio来调用。企业可以在Gemini Enterprise Agent Platform里使用。普通用户通过Gemini app和Google Search也能用上。3.6 Flash还集成在Google Antigravity和Gemini Enterprise app里。3.5 Flash-Lite也正在Google Search中逐步上线。从开发到搜索,从企业到个人,覆盖面很全。
后面还有:3.5 Pro和Gemini 4
3.5 Pro正在跟合作伙伴测试,等准备好了就会广泛提供。Google已经开始训练Gemini 4,公司说是迄今为止最野心勃勃的一次预训练。具体什么时候出,没有说。
趋势很清楚:新模型已经在多个维度超过了前代,更强大的版本还在后头。这不是一次单点爆发,而是让三款模型分散在成本、速度和安全的坐标上,各自解决不同的问题。用户不会直接注意到模型切换,但会感觉到搜索更准、编程助手更少出错、企业工具成本更低。更大的变化——Gemini 4——才刚刚开始。