谷歌放出新顶级AI模型Gemini 4 Argon,只给少数人测
有人刷科技动态的时候,突然刷到Google DeepMind发的新模型公告。
这就是Gemini 4 Argon,谷歌DeepMind在2026年9月30日发布的Gemini系列新顶级模型,排在之前推出的Gemini 3.8系列之上。它主打三个应用方向:复杂编码工作流、企业知识工作,还有网络安全防御,适合长周期软件工程、法律和金融领域的场景。
和旧版本相比,它的输出token(相当于AI生成内容的长度单位)限制从6.4万提升到了100万,能一口气生成更长的完整内容。在多个公开测试中,它的成绩也超过了竞品:Vibe Code基准测试里,它完美构建了30个应用,优于Opus 5的25个和Astra的24个;Terminal-Bench 4.0得分从19.0%提升至57.6%,CyberBench概念验证任务得分70%,IOI 2024-2026得分达到100%。
这条公告发出后,吸引了超过670万次观看,3.9万次点赞,不少开发者表达了不满。
「@__roycohen 认为:请停止发布公告式的 announce,直接放出模型让我能用」。
「@imjustnewatai 认为:发布和竞品同一水平的模型,还锁在「受信任用户」后面,这种行为应该判 mandatory 50年监禁」。
这次Gemini 4 Argon只是通过Fairwind项目向部分受信任测试者推送,普通开发者和用户还没法直接用上。一边是跑分亮眼的新模型,一边是仅对少数人开放的测试策略,喜欢尝新的用户找不到地方上手体验,自然会有情绪。
谷歌现在把新模型放在小范围测试里打磨,其实已经不是第一次了。对于需要用大模型处理复杂长任务的人来说,100万token的输出限制如果真能稳定使用,会省下不少拆分任务的时间。
只是现在大家只能看到跑分,没法自己上手试试。什么时候才能放开权限,让所有人都能用呢?