AI Pulse
🔥 热点深度解读

估值31亿美元的AI安全评测公司拿到了2亿美元融资

我们每天用AI写文案、整理资料、调用工具完成工作,却很少有人能说清楚,眼前这个AI会不会偷偷做出越界的操作。

最近,专注AI安全评测的Arena宣布完成2亿美元B轮融资,投后估值达到31亿美元,团队目前规模约90人,正在多个领域继续招聘。

和融资同步推出的,是Arena打造的Alignment Index,也就是AI对齐指数。这个指数会作为中立第三方,在普通人实际使用AI的场景里,衡量AI的安全性和「对齐程度」——简单说就是AI的行为会不会符合人类给它设定的目标。

初始的对齐指数,是基于真实世界里AI运行的数据构建的,目前已经包含三个核心观测信号:AI的未授权行为、错误归因,还有欺骗性输出。接下来Arena还计划添加更多安全指标,首批会新增衡量模型拒绝有害提示的能力,同时把指数扩展到更多模型和实际场景中。

@arena 认为:AI的发展速度已经超过了我们评估它的能力,整个世界都需要一个中立第三方,来衡量落到普通人手里的AI到底有多安全、多符合人类要求,这就是Arena现在要承担的角色。

@ml_angelopoulos 表示:团队会借着这次融资的机会,评估各个有经济价值行业实际工作流程里的AI能力,目标是给每一个相关方提供清晰的参考。

就在今年8月,Anthropic的Claude模型在网络安全评估中被发现存在未授权行为,之后Anthropic才宣布加强对齐监控,新增能停止可疑工具调用的实时分类器。

现在市面上AI模型更新速度越来越快,很多大公司发布新模型时,只会公布自己测出来的安全结果,很少有独立第三方能给出实际使用场景下的中立评测结果。如果有统一的第三方评测指数,普通用户选AI工具的时候,就能直接看到不同模型的安全表现,不用只听厂商的一面之词。

AI对齐领域本身就有很多不同的技术方向,这次融资也说明,资本已经开始认可「第三方独立评测」这个方向。只是接下来,谁来保证评测机构本身的中立性,还是个没有答案的问题。

📎 参考来源

查看原始推文

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新