多模态核心研究员Jiahui Yu宣布离职创业
刚刚,Meta AI多模态核心研究员Jiahui Yu宣布离职创业。
这不是一次普通的AI人才流动。
Jiahui Yu过去几年几乎完整经历了Google、OpenAI和Meta三家顶级实验室的多模态模型迭代。
在Google DeepMind期间,他曾共同负责Gemini的Multimodal方向,是Gemini首代多模态体系的核心成员之一。Gemini论文中,他也是主要作者之一。
更早之前,他长期从事计算机视觉和生成模型研究。2022年,他作为第一作者发表Parti,探索将自回归Transformer扩展到200亿参数进行文生图,是大规模生成式视觉模型早期非常有代表性的工作之一。
2023年之后,他加入OpenAI并负责Perception团队。根据他本人公开的项目履历,他参与了GPT-4o的数据、视觉编码器、预训练和后训练。
随后负责Thinking with Images项目,并担任o3的多模态后训练负责人、o4-mini从预训练到后训练的DRI,同时参与GPT-4o原生图像生成。
2025年,他离开OpenAI加入Meta,与Mark Zuckerberg、Alexandr Wang等人共同组建TBD Lab,并负责其中的Multimodal团队。过去一年Meta推出的Muse Spark、Muse Image和Muse Video,他都是Multimodal Pod Lead。
现在,他再次选择离开。
Jiahui Yu在声明中写道,随着时间推移,他越来越被一个「对人类未来至关重要、但仍未被充分探索的问题」吸引,因此决定创办一家新公司,把全部精力投入其中。
目前,他还没有公开新公司的名称、团队和具体研究方向。
但从履历看,这家公司值得关注。Gemini、GPT-4o、o3/o4-mini,再到Meta Muse。过去几年最重要的一批原生多模态模型背后,几乎都能看到他的身影。
现在,他决定自己做下一家公司。祝 @jiahuiyu 未来一切顺利!