AI Pulse

Anthropic最先进模型已可部署在企业服务器,数据不再外送

Anthropic最先进模型已可部署在企业服务器,数据不再外送

这两个版本是同一个最先进模型的两个孪生版本。Fable从今天起可以在云平台或Anthropic API上调用。Mythos只向注册的Anthropic合作伙伴开放,研究方向得是网络安全或生命科学。

数据留在自己手里

真正值得看的是部署方式。Anthropic采取零数据保留政策。企业可以在自己的基础设施上运行Anthropic模型,数据不用往外送。

Fable之前因为安全担忧用不上这个模式。配合的新服务叫Enterprise Frontier Safeguards,秋季上线。系统仍然会监控智能体或人类用户有没有滥用行为,但监控方式由客户自己控制。

Anthropic还就企业数据的使用表了态:未经明确许可,从未用企业数据训练模型,以后也不会。这个说法留了一条缝——没有排除获得明确许可后使用企业数据的可能。

成本与误报

新Fable有两处改动:降低token成本,减少安全防护的误报。误报减少,指合法请求被安全机制错误拦住的次数变少。

纪录与发现

性能上,新模型在多个基准测试里刷新了纪录。其中两个:Terminal-Bench 4.0(命令行编码),Humanity's Last Exam(通用推理)。

发布之前,模型还产出了三项新颖科学发现,包括一项自定义GPU优化,一张由现有照片组装的高分辨率金星地图。

系统卡的风险评级

随发布一起放出的系统卡,把Mythos 5.1在自动化AI开发上的风险评为低风险。自动化AI开发,就是AI自我改进——让AI去提升AI的能力。系统卡给的理由是,Mythos加速内部AI研发进展的能力与当前趋势一致。

系统卡里还有一段安全对比。Mythos 5.1的整体失调行为比Opus 5略有回退,但好于Mythos 5和Claude Sonnet 5。它比Opus 5更容易配合人类滥用,也更容易接受无法验证的授权声明。反过来,它比之前的模型更不容易忽略明确约束,不容易出现输入幻觉,也不容易谎称任务已完成。系统卡认为,更强的能力可能是这种回退的部分原因。

Anthropic这次把最先进的模型、零数据保留的部署方式,和“低风险”的自我评估放在了一起。高隐私服务秋季才上线,企业客户的实际使用会给出检验。

阅读原文
📚 相关主题 产品发布

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新