AI写代码快了,现在QA也交给AI自动做了
一个开发团队刚用AI编码工具写完功能,合并代码之前,还要找人手动测试复现bug,拖慢了交付进度。
现在这样的情况正在发生变化:生成式AI写代码的速度,已经超过了团队人工验证和安全交付软件的能力。针对这个缺口,创业公司Gitar从隐身模式推出,拿到了900万美元融资,推出了名为Ship的自动质量测试工具,也就是AI自主质量工程师。
Ship可以测试已经部署的合并请求(开发者提交的代码修改集合),从开发者常用工具Slack(团队沟通工具)和Linear(问题追踪工具)里复现现有bug,再把相关上下文交给Claude或者Codex大模型来修复问题。它还可以和GitHub、GitLab、Jira、CircleCI等几乎所有主流开发者工具集成,追踪验证结果、识别重复问题,帮团队优化整个开发工作流。
@deepcabinwala 认为:现在大家都有了AI编码工具,但一直没人做AI测试工程师,直到今天Ship出现。
@brenzhills 认为:如果你遇到过合并请求通过所有检查但还是把应用搞崩的情况,你就会知道复现bug有多麻烦,现在这个工具可以解决这个问题。
@robrtcode 认为:AI编码工具让写代码变得超快,但还是得有人回答「这个东西真的能用吗?」这个烦人的问题,现在Ship可以直接在部署后的应用上运行测试,找到出问题的流程。
不止Gitar在做这件事,另一家公司Keycard已经在2026年发布了面向自主编码智能体的运行时治理工具,还收购了相关公司扩展能力。生成式AI时代已经有人提出了新型bug处理工作流:由大语言模型智能体处理bug复现和定位,给出代码补丁建议,开发者只需要担任监督角色。
对于普通开发者来说,替代人工测试的AI工具已经出现,整个开发流程从写代码到测试修复,几乎都能靠AI自主完成,只需要最后有人拍板确认。对于公司团队来说,原来需要三个人分工:写代码、测试、修复,现在大部分工作可以由AI串起来完成。
下一次开发软件的时候,整个流程里还需要几个人盯着?