AI Pulse

新版AI助手能自写代码看图纸,价格减半但安全受限

Anthropic 发布了 Claude Opus 5。它被描述为“接近 Claude Fable 5 的前沿智能,价格只有一半”。在 Artificial Analysis 排行榜上,它甚至超过了 Fable 5,目前排名第一。

定价上与 Opus 4.8 持平,同时保留“快速模式”——启用后价格翻倍。快速模式具体能带来多大性能提升,Anthropic 没有明确说明。

在 Frontier-Bench 的一次测试中,Opus 5 接到一个任务:根据一张机器零件的图纸,写出代码把它重建为 FreeCAD 3D 模型。但任务故意不给模型直接查看图纸的途径。Opus 5 自己编写了一套计算机视觉管线,从像素中提取几何信息,然后完整重建了零件。用户可以把更复杂的视觉任务交给它,不用手动处理图像。

能力增强的同时,Anthropic 刻意在安全上做了限制。与 Opus 4.8 一样,Anthropic 有意不训练 Opus 5 执行网络攻击任务——它不学“如何利用漏洞”。尽管没有专门训练,由于通用能力提升,Opus 5 在发现漏洞方面依然显著进步,接近安全专用模型 Mythos 5 的水平。但在漏洞利用上,它仍远落后于 Mythos 5。也就是说,它能找到安全问题,但不会主动发动攻击。

Claude Opus 5 还有一个专门的提示指南,指导用户如何发挥它的能力。Thariq Shihipar 也发布了针对 Claude 5 代模型的上下文工程新规则,帮助用户更好地编排提示。

阅读原文
📚 相关主题 大模型产品发布

📬 订阅 AI Pulse

每天三次更新,不错过重要信号

▲ 回到顶部