首个通过视频图灵测试的AI,开发者却说暂不公开
和朋友视频通话时,你会不会突然想:对面会不会根本不是真人?
现在这个问题真的需要认真回答了。AI初创公司Tavus发布了一款名为Griffin的模型,号称是全球首个通过「视频图灵测试」的人工智能。
视频图灵测试是经典图灵测试的视频对话版本:测试者和AI进行实时视频通话,如果超过30%的测试者认为对面是真人,就算模型通过测试。
根据Tavus官方公布的数据,有48%参与实时对话的人认为Griffin是真人。之前同类系统的通过率不到3%。同时,Griffin在NVIDIA的全双工AI视频基准测试中排名第一。开发者称它是全球第一个「人类交互模型(HIM)」,能一边看画面一边说话,支持实时双向互动。
拿到提前体验资格的测试者分享了不同场景的实测。「@theSethian 认为:和AI Ash视频通话四分钟后询问身份,这个AI拥有完整的个人生活经历,完全不像程式化的机器人。」
「@nicos_ai 认为:Griffin可以实时追踪魔方动作,在线指导用户还原鲁比克魔方,整个过程流畅自然。」
「@chesny 认为:第一个能通过图灵测试的AI已经做出来了,但开发者选择不公开它。」
按照已公开的行业研究,大语言模型其实早就能骗过不少人了:截至2025年,OpenAI的GPT-4.5在扮演特定人格时,已经有73%的概率被判断为人类。
但这次不一样的地方在于,这是第一个在实时视频对话场景骗过人类的AI,而且性能远超以往同类模型。
有观点认为,AI通过图灵测试往往会让公众对通用人工智能更有期待,进而帮助行业获得更多投资。也有人提醒,这种能以假乱真的AI,可能会让虚假视频、网络诈骗变得更难识别。
开发者选择暂时不发布这个能力超群的模型,你觉得,是担心风险,还是在等待更好的时机?