漏洞不必等工程师,Gemini 4 Argon自己找自己补
Google 发布了 Gemini 4 Argon,自称迄今最强。编码、研究、写作都能接,但真正让它特殊的是网络安全。这个模型专门为防御性网络工作训练,能自主发现、验证并修补关键软件漏洞。
漏洞修复这件事,节奏会不一样。以前靠安全工程师挨个排查,现在 Argon 可以直接找问题、打补丁。软件更新会变快,漏洞暴露给黑客的时间窗口也会变短。
Argon 不向所有人开放,只通过 Google 的 Fairwind Program 进入特定网络合作伙伴手里。
编码和工程同样是强项。Google 说,内部员工已经在日常工作中用 Argon 调试代码、迁移代码库。也就是说,它已经在 Google 的生产环境里跑起来了。
Argon 还能解析视频和图表。Google 没细说打算用它做什么。
Google 称,Argon 专门为复杂、长周期的深度推理而构建。它正在从根本上改变 Google 的工作和构建方式。
基准测试方面,Google 引用 Vals 的数据。它称自己的分数高于 OpenAI 的 GPT-6 Astra,也高于 Anthropic 的 Fable 和 Opus。Vals 是一家越来越受关注的 AI 基准测试创业公司,它的指数目前把 Argon 排在首位。
这些分数要分开看。基准测试衡量的是特定任务,不代表真实世界的全面优劣。目前没有独立验证能证明 Argon 在实际工作中一定压过竞品。
发布时间也赶上了热闹的节点。顶级 AI 实验室都在抢着推出更强模型,哪怕同一批公司也警告过 AI 可能失控。OpenAI 刚发 Astra,说自家最佳;Anthropic 今年早些时候发 Fable,措辞也差不多。
Google 一度被认为在 AI 竞赛里落后,Gemini 帮它翻了身。8 月,它宣布 Gemini 应用月活过 10 亿;OpenAI 的 ChatGPT 月活也过了 10 亿。两个应用同时跨过这个门槛,AI 助手已经不止是技术爱好者的玩具。
Argon 眼下仍在少数安全合作伙伴手里,Google 自己的员工却在日常大量使用。内部先跑起来,说明下一个战场已经从聊天转向实际工程和安全防御。