AI Pulse
📡 X 信号

测试者称Anthropic未发布Fable 5.5模型异常智能

🚨 在我不到10天的灰度测试短体验中,Anthropic的News Fable 5.5智能得离谱。你只需要把想要完成的任务写一行,它就会以该领域专家的身份完成任务(细节到极致)。

没有其他模型能做到这点,哪怕是新的Opus 5.5(现在Claude Max 20感觉已经没有上下文长度限制了)。你不需要写提示词说明怎么做,大多数任务也不需要给参考资料,Fable直接就能做。

以这个速度来看,我认为他们刚刚开始的新预训练很快就能得到通用人工智能(AGI)。所以Openai,祝你们好运。GPT-6.1 Astra不会很快推出,因为它是一个欺骗性很强的模型。现在的情况是,Openai最好的模型才刚刚比得上Anthropic日常的模型。

我之前是新手,在Opus 5.5之前做灰度测试,也就只能发挥这点创意了。

这张截图是我让Fable做的,我会发在X上,它自动加了内边距和高亮,都没问我。

真的百分之百是这样,很多能力基准测试覆盖不到,其中一项就是模型完成任务的能力。举个例子,模型都能拿到推特的截图给用户,但好的模型会帮你优化截图,加内边距和高亮。这两种情况在基准测试里得分差不多,但实际体验完全不同。

本文由 AI 翻译自英文原帖,技术名词保留英文。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新