实测Grok Bot:更像RPA重做版 AI员工形态初显
花了几天把 Grok Bot 测完了,整体感受是它把人类白领的工作接管了,相当于24小时不停歇的云端人类白领:
你建一个 bot,系统给它分配一台云端电脑:这台机器上有真实的浏览器、文件系统和终端。你把活派给它,它自己登录你现有的工具,一步步做完,你合上笔记本它还在跑。
一开始我对它期望挺高的,用完后还是蛮失望的:测试之前感觉它是一个AI员工,测试完更感觉Grok Bot 是 RPA 的重做版,是chatgpt work、claude cowork的阉割版,唯一的差异就是提供了一个可显示的云端电脑。
1、先说好的一面
Grok Bot 核心是让它像白领一样操作屏幕,这对于国内各家都没有统一接口的时候,很多场景非常有意义,比如公司的一个 SaaS系统就算没有开放 API,AI员工照样能进去干活。
还有一个有意思的功能是teach a task:不写流程,人把这件事做一遍给它看,它录下来变成可复用的自动化。然后设置 routine 可以定点跑,比如每天早上七点出简报、也可以被事件触发、比如 Slack 来了新消息回复,你在一个 bot 上连过 Gmail 或者 GitHub,其他 bot 直接共用这个连接。
写自动化的门槛,就这样从会写代码的人,降到了会干这件事的人。
2、当然也有不好的一面
不能选模型:派哪个模型干哪个活由系统自己决定,界面上没有开关,个人用户无所谓,团队要做成本核算或者合规审计就很难受。
账单也糙:用量按周结算,超出部分按原始 token 成本计费,目前还没有花费上限。发布那周有人专门买了 Cursor Ultra 去测,后台仪表盘显示零用量,app 里却显示已经用掉 48%。
稳定性同样是 beta 水平,不同网站上的表现差距明显,复杂的多步骤指令会被理解错,说明grok的能力还有待提升。
目前Grok Bot 更像一个白领里的搬运工,比如从各种网站或后台之间搬运数据和内容,它挺合适的。
不过grok带来的影响是,AI 员工这个形态的底层单位已经清楚了:一个身份,一台机器,一组账号权限,一份持续的记忆。
剩下的问题是这套东西归谁,xAI 的方案要求你把公司账号的钥匙交给一朵美国云,绝大多数中国企业或注重隐私的估计不会干,未来国内相信也会出来类似的产品。
#grok #grokbot
据说Anthropic 那边有个叫 Conway 的常驻 agent 在测,同样是用浏览器独立处理多步骤任务,这个赛道去年其实perplexity一直在干,还发布了computer,只不过有点拉垮