华人AI科学家余家辉告别Meta开启创业之路

财π新闻 2026年8月14日,华人AI科学家余家辉正式对外宣布,将离开Meta开启创业历程。从2025年6月底正式加入Meta算起,他在这家科技巨头的任职时长仅为一年零一个多月。截至目前,余家辉尚未对外披露新公司的名称、核心合伙人构成以及具体的研究方向,仅明确表示,接下来会将全部精力投入到一个对人类未来非常重要,但至今尚未被充分探索的问题上,待相关工作逐步推进成型后,才会对外分享更多细节。

余家辉的完整求学路径有着极为清晰的顶尖学术背景支撑,他的本科、硕士直至博士阶段均就读于中国科学技术大学少年班与伊利诺伊大学厄巴纳-香槟分校,求学期间师从计算机视觉领域知名学者黄煦涛。在正式进入产业界开展前沿AI研发工作之前,余家辉就已经在多个顶尖科研机构完成了多段实习经历,先后在微软亚洲研究院、Adobe、Snap、百度美国研究院、英伟达和Jump Trading等不同类型的技术团队开展研究,接触过图像修复、超分辨率、移动端视觉和高性能计算等多个细分技术方向,为后续的多模态大模型研发打下了扎实的底层技术基础。2017年在Adobe实习期间,他参与研发的DeepFill图像修复技术,能够根据图像中的已有信息补全被遮挡的区域,也可以精准移除画面中的指定物体,成为他早期学术研究阶段极具代表性的成果之一。

正式步入职业发展阶段后,余家辉先后进入多家全球顶尖的AI研发机构开展核心技术攻关,此前他曾长期就职于谷歌DeepMind和OpenAI两大头部AI企业,深度参与并领导了Gemini多模态方向以及GPT-4o等多款行业标杆模型的研发工作。2019年取得博士学位后,余家辉加入谷歌,最初继续深耕计算机视觉相关研究,参与图像超分辨率、生成模型和视觉表征等项目的开发,之后逐步转向规模更大的多模态系统研发,在谷歌任职期间,他参与了CoCa和Parti等重要模型的研发,其中CoCa模型将图文对比学习与图像描述生成技术相结合,可同时支撑视觉和语言的理解与生成任务,Parti则是一款文生图模型,能够根据用户输入的文字提示生成对应图像,这些前期积累的研究经验,为他后续参与原生多模态大模型的全流程开发打下了坚实基础。2022年末,余家辉进入谷歌DeepMind,担任Gemini多模态视觉方向的联合负责人,深度参与这款谷歌旗舰多模态模型的全链路研发工作。2023年10月,余家辉离开谷歌DeepMind加入OpenAI,担任感知研究团队负责人,在OpenAI任职的约1年9个月时间里,他主要负责图像思考和视觉推理相关研究,参与了OpenAI o1、o3、o4-mini、GPT-4o图像生成和GPT-4o等多款核心模型的研发,这些项目覆盖视觉理解、模型推理和图像生成等多个关键技术方向,2024年正式发布的GPT-4o能够统一处理文本、图像和音频三类信息,大幅拓展了多模态大模型的应用边界。

2025年6月,Meta创始人扎克伯格以传闻高达1亿美元的整体薪酬包,将余家辉招揽至刚刚组建完成的Meta超级智能实验室,同期和余家辉一同从OpenAI加入Meta超级智能团队的,还有赵晟佳、毕树超、任泓宇等多名核心研究人员。彼时Meta正全力推进全新的超级智能研发体系搭建工作,扎克伯格亲自下场参与核心人才招募,从OpenAI、谷歌DeepMind、苹果等多家科技企业密集引进顶尖研究人员,Meta还为此向Scale AI投资143亿美元,为新实验室的研发工作提供充足的资源支撑。Meta超级智能实验室由亚历山大王直接领导,旗下的TBD Lab是整个体系中最核心的下一代前沿模型研发团队之一,余家辉作为创始成员,与扎克伯格等人共同完成了TBD Lab的初期搭建工作,全面负责实验室的多模态研发方向。

在Meta任职的一年时间里,余家辉带领团队从零开始搭建全新的多模态技术栈,接连推出了Muse Spark、Voice Mode、Muse Image、Muse Video以及离职前不久刚刚发布的Muse Spark 1.2等多款重磅成果,直接推动Meta的前沿模型研发体系从原有的Llama系列全面转向全新的Muse系列。2026年4月,TBD Lab交出了MSL成立后的第一份重要研发成果Muse Spark,这是一款原生多模态基础模型,能够同时处理文字、图像和语音三类信息,还可以调用工具完成部分复杂任务,这款模型的正式发布,标志着Meta前沿模型路线完成了从Llama到Muse系列的切换。在Muse Spark正式亮相之后,余家辉带领的多模态团队继续快速推进技术落地,先后推出覆盖语音交互场景的Voice Mode、专注图像生成的Muse Image以及面向视频生成领域的Muse Video,完成了多模态核心能力的初步布局,最新发布的Muse Spark 1.2版本,进一步强化了模型在编程、长程Agent任务和多模态综合处理方面的能力,整个多模态产品版图在短短一年时间内就实现了快速铺开。在余家辉官宣离职的相关内容下方,多名曾和他共事的Meta团队成员纷纷留言送上祝福,其中包括Meta研究数据项目经理Kate Shapovalenko、Meta研究科学家孙之清、Meta研究员Igor Petrovski等多名核心研发人员,不少人都提到,余家辉也是当初将他们招揽进入TBD Lab的关键人物,团队成员曾在旧金山的一家餐厅里和余家辉深入交流,最终被他的技术理念打动选择加入团队,共同开展多模态能力和计算机操作相关的前沿研究。

余家辉的此次离职,再次引发了外界对于Meta核心AI研究人员人才流失问题的广泛关注。研究论文平台alphaXiv的公开统计数据显示,在余家辉正式宣布离职之前,已经有超过200名在行业内具备较高知名度的研究人员先后离开Meta,目前符合曾在Meta任职且已离职条件的研究者总人数多达929人。此前Meta曾在AI人才市场上投入大量资源招揽顶尖研发人员,2026年的资本支出预计达到1250亿美元至1450亿美元,是算力市场上投入规模最大的买家之一,在人才招募环节给出的待遇条件也极具竞争力,Meta超级智能实验室公布的11位关键人才名单中,有7位是华人研究者,足见其对核心人才的重视程度。但从2026年年初开始,陆续有多名核心AI研究人员选择离开Meta,今年2月,知名华人AI研究员、前苹果AI基础模型团队负责人庞若鸣确认转投OpenAI麾下,同月24日,Meta AI研究科学家张鹏川也官宣离职加入OpenAI,从事世界模型和机器人相关方向的研发工作。2026年5月,Meta启动了一次覆盖全公司的超大规模整合重组,累计裁掉8000名员工,同时将7000名员工强制转岗到AI相关岗位,不少原本从事软件开发工作的工程师被重新分配到数据标注等岗位,这场以提升运营效率为名义的内部调整,虽然在短期内压低了公司的运营成本,但也在内部积累了明显的不安全感,不少员工的工作状态受到直接影响,持续高压的工作环境下,核心研发人员的流动速度进一步加快。

回顾余家辉的整个职业发展路径,短短几年时间里,他先后进入谷歌DeepMind、OpenAI和Meta三家全球头部AI企业,全程深度参与了三家公司旗舰多模态基础模型的核心研发工作,他的研究范围也从早期的图像修复和视觉表征等细分方向,逐步扩展至视觉推理、图像生成、语音交互和智能体能力等前沿领域,几乎覆盖了多模态大模型研发的所有核心环节。如今他选择离开大型科技企业的成熟研发体系,以创始人的身份开启全新的创业历程,外界目前尚未得知他所提及的那个尚未被充分探索的关键问题具体指向哪个技术方向,新公司的技术路线、团队组建进度以及后续的成果发布计划,都有待后续他本人对外披露更多相关信息。

(编辑:胡忠华)

快讯