AI Pulse
📡 X 信号

测试者分享OpenAI新模型Astra的早期测试体验

我很早就测试了Astra。关于OpenAI的全新模型,我希望每个商务人士都知道这些事:

1)电脑使用和浏览器使用真的太出色了。我确信,几乎所有在电脑上完成的稳定工作流程都至少可以部分由AI完成(没错,我知道这段描述有很多保留,但我肯定有我没探索到的极端情况)。它真的非常非常好。想象一下,如果你是个盯梢的老板,连续7天记录你的屏幕……你会让AI做哪些你一直在做的工作?你能挑战自己一整天不用鼠标吗?

2)它仍然没能通过我复杂的文字游戏挑战。目前还没有模型通过这项测试。

3)它没有惹我生气。这一点我怎么强调都不为过。最近几个星期,我对Claude越来越恼火,因为它有时会给出绕来绕去、极度技术化的回答(以至于我专门加了一个新的/wtf指令来处理这个问题,而且在我所有AI工作的占比里,Codex的使用率飙升——我越来越少用Claude Code桌面应用了)。我过去常说Claude写作更好,现在我不这么说了。

4)Codex是更好的日常主力工具。

5)我不像使用Fable系列模型那样担心token问题(值得一提的是,我用Opus也不怎么担心token)。

6)其他人在3D和动画方面做了很多测试。我没测,但他们似乎对结果非常满意。我看了他们的结果,没有那么震惊,但没关系。我不需要从零开始生成世界,我需要根据参考点生成准确的世界。我知道AI可以从零生成,但大多数工作并不是从零开始的。

7)如果是“巨型架构构建”这类需求,我可能还是会选Fable 5.1。

另外说句无关的,感谢OpenAI工程师满足了我的请求,让Codex在你需要批准请求时用语音提醒你。我们很感谢研发团队能倾听用户意见🤘

我会继续使劲用它,然后给出商业层面的总结。工程师们可以去关注@clairevo和@danshipper看他们更多的看法。

本文由 AI 翻译自英文原帖,技术名词保留英文。

查看 X 原帖

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新