用户分享三款非主流大模型体验,多数可替代Opus
我今天强迫自己试用了几个非主流模型。和大家分享我的体验,供感兴趣的人参考。
1. muse spark 1.3
这个模型的出色表现真的让我大吃一惊。如果你不声不响把 opus 4.8 换成它不告诉我,我估计要花很长时间才能发现区别,而且大概率还是从沟通风格上察觉,而不是从能力上。
以它的定价来说,投资回报率相当惊人。既然有了这个模型,我根本提不起动力去试 deepseek v4 flash。
不过我不喜欢他们一直挂在嘴边的那句话:「便宜到无法计量的智能」。就算我所有工作都用这个模型,以它现在这么优秀的定价,我每个月还是要花几千美元——这可不是「太便宜到无法计量」。再把成本降 100 倍,我们再来谈「太便宜」吧。
2. glm 5.3 flash
我本来以为它会比 muse spark 1.3 更好,但实际上我刚把它换成我的大副,它就犯了好几个错误。
可能这只是我的个例,但它现在已经失去了我的信任,让它帮我处理工作我有点不安。我打算只让它做一些更直接的实现工作,而不是让它当我的主力模型。
3. gemini 3.8 flash
可能因为我之前没怎么用过 gemini,但这个模型的沟通能力实在太棒了。简直让人耳目一新。我不用费什么脑子就能听懂它说的每一句话。
但它比上面两个模型贵得多。我想如果我要多用它,就得买 google ai 订阅,但它没法在第三方工具链里用,这点让我犹豫了。
就我测试过的大多数任务来说,它的能力足够替代 opus。
试用完这些模型之后我的整体感受是:现在大家都有自己的 opus 了,而且都比真正的 opus 更便宜。
fable 和 astra 大概是现在这些实验室仅有的护城河了——整个游戏和 6 个月前比,已经发生了根本性的改变。
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖