90后、00后“整顿”AI圈? 盘点这届大模型中的年轻力量!

Published2025年1月17日

大模型创新风潮席卷全球,在锣鼓喧天的热烈讨论中,业内人士一次次将矛头对准在一个话题:

究竟是哪些人引领了空前的大模型发展浪潮?这些人的背景如何?都说“90后”“00后”整顿职场,年轻人是否已经将火力对齐了大模型圈?

基于AMiner开放平台,结合当下全球几家知名大模型研发团队:ChatGPT、Authropic、DeepSeek、DeepMind和智谱AI梳理发现:

在当下大模型圈的人才库中,为大模型研发注入活力的,很多都是思维活跃、个性鲜明的年轻人,其中华人年轻研究员的身影非常活跃。

这些年轻研究员,有的已经是大模型研发团队的主力军,有的是初入社会的青涩面孔。

他们几乎都有着斯坦福大学、哈佛大学、普林斯顿大学、新加坡国立大学的名校背景

清华大学、北京大学也为主流大模型团队输送了大量人才。

90后敢于挑大梁,00后入列,属于这一代年轻人的机会,才刚刚开始。

年轻华人研究员开始挑大梁

截至目前,几大知名大模型汇聚了大量的“90后”“00后”年轻华人精英。

以OpenAI研发团队为例,最近,哈佛华人研究员Jeffrey Wang才正式官宣加入OpenAI,将作为基础团队研究员,负责模型预训练和推理。

Jeffrey Wang年纪轻轻,但已经拥有了令人瞩目的研究成果。早在2021年,还处于高中阶段的他就入围了号称为美国“少年诺贝尔奖”的再生元科学天才奖,同年顺利入学哈佛大学。

传奇的是,在哈佛期间,还是本科生的Jeffrey Wang就已经开始一边教课一边研究机器学习了。从2024年1月开始,他为计算机科学和统计学系的61名学生讲课,兼任工程与应用科学学院研究员。

在这期间,他作为共同一作的两篇论文还分别在NeurIPS SoLar(2023)和ICML(2024)研讨会上亮相,展现出非凡的科研才能。

来源:https://www.aminer.cn/profile/6326d377a95e4d1d054f6dfc?fr=JW

除了Jeffrey Wang,大模型圈还有许多青年华人面孔。例如ChatGpt o3-mini团队支柱之一的Kevin Lu。2021年,他从加州大学伯克利分校毕业,就读期间曾受伯克利人工智能研究所(BAIR)联合主任Pieter Abbeel和谷歌DeepMind研究科学家Igor Mordatch的指导,主要从事强化学习和序列建模方面的工作。

类似地,还有DeepMind的新成员、华人博士薛复昭。他于2024年12月宣布加入DeepMind,毕业即成为DeepMind高级研究科学家,致力于Gemini预训练和多模态研究,研究方向是机器学习、自然语言处理和高性能计算。

薛复昭同样也是研究成果丰富的青年佼佼者。他博士毕业于新加坡国立大学,师从尤洋教授。2021年,薛复昭以GPA5.0的成绩从南洋理工大学硕士毕业,师从庄永聪教授和孙爱欣教授。

来源:https://www.aminer.cn/profile/5619fcb945cedb3397e1625b?fr=XFZ

清北毕业生现身AI世界舞台

值得一提的是,来自清北的毕业生在大模型圈非常活跃。

OpenAI团队中,就有不少年轻且极具才华的清北技术人才。例如与Kevin Lu同为ChatGpt o3-mini团队支柱的清华校友赵盛佳和北大校友任泓宇。

赵盛佳本科毕业于清华大学,博士毕业于斯坦福大学计算机科学系,目前担任OpenAI研究科学家,方向是ChatGPT的训练和对齐。截至目前共发表论文47篇,引用量达到7872次,H指数达到23。

来源:https://www.aminer.cn/profile/542bf9d3dabfae1bbfd1ccae?fr=ZSJ

任泓宇于2014至2018年就读于北京大学,和赵盛佳一样,他也在斯坦福大学攻读过计算机科学的博士,现同为OpenAI的研究科学家,负责语言模型训练。同时,任泓宇也是GPT-4o的核心开发者、GPT-Next的项目组成员。

OpenAI研究员中还有一个熟悉的面孔,那就是研究员Li Jing。Li Jing本科毕业于北大物理学,2019年博士毕业于麻省理工学院。虽然入职OpenAI时间不长,但他已参与过多个重磅研究,对Dall-E 3、Sora、GPT-4o都做出过贡献。

担任OpenAI研究工程师的,还有2020年本科毕业于清华大学计算机科学与技术系的翁家翌。翁家翌本科师从朱军教授,参与了强化学习算法库 Tianshou(天授)的开发,2022年,他从卡内基梅隆大学硕士毕业后正式加入OpenAI。

此外,还有2024年8月才官宣加入OpenAI的清华“姚班学霸”姚顺雨。姚顺雨博士毕业于普林斯顿大学,研究方向是在语言智能体与世界之间建立互动,例如网上购物(WebShop),浏览维基百科进行推理(ReAct)。

有趣的是,和姚顺雨同名为“YaoShunYu”的清华校友姚顺宇,在2024年10月也投身大模型行业,加入Anthropic的Claude团队。在加入之前,姚顺宇就已经名声大噪,本科在清华就读期间获得了清华物理系传奇特奖,并且在凝聚态物理领域做出了突破性贡献,首次在国际上提出关于非厄米系统的拓扑能带理论。

来源:https://www.aminer.cn/profile/646b041f86f26feb3e32e3c6?fr=YSY

除了上述几位,还有许多清北毕业生投身于国产大模型。比如近期名声大噪的DeepSeek,清北应届生扛起了其核心团队的“半边天”。

例如主导开发DeepSeek-Coder-V1的朱琪豪,2024年博士毕业于北京大学计算机学院软件研究所;参与DeepSeekv1到v3开发工作的代达劢,2024年博士毕业于北京大学计算机学院计算语言所;还有硕士毕业于北京大学、参与从DeepSeek LLM v1开始的一系列重要工作的王炳宣;另外还有担任DeepSeek训练/推理基础架构工程师、清华大学毕业生的赵成钢等。

同清华大学有渊源的智谱AI也吸引了众多清华人才,比如现为智谱AICodeGeeX技术负责人的郑勤锴,是清华大学计算机系的博士毕业生,他关于图神经网络的研究论文浏览量高达四万智谱AI首席研究员丁铭,2023年博士毕业于清华大学;还有现为智谱AI高级算法专家的邹旭,是清华大学2024届博士生。

来源:https://www.aminer.cn/profile/6177269d60a96543aa816fbd?fr=ZQK

拥有相关实习或科研经历

不难发现的另一个点是,这些年轻人许多都有过相关行业的实习经历和丰富的科研成果。

他们或是在微软、Google、阿里、英伟达、Meta等公司工作、实习或从事博士后工作过,或是在科研机构长期担任科研助理。

经验的积累,让他们懂得了融会贯通和产学研相互转化。

较为典型的是DeepMind团队的薛复昭。在新加坡国立大学博士在读期间,他曾在Google Brain和谷歌天才科学家Yi Tay和Mostafa Dehghani一起实习,也在NVIDIA GEAR有过一段实习经历。

来源:https://www.aminer.cn/profile/5619fcb945cedb3397e1625b?fr=XFZ

另一个突出例子是OpenAI的任泓宇。任泓宇有过长达三年的多段实习经历,相继在微软担任研究助理、在NVIDA和Google担任研究实习生和学生研究员,之后又在苹果担任了半年的研究实习生。

来源:https://www.aminer.cn/profile/53f43617dabfaedf4357d489?fr=RHY

还有和任泓宇同公司的姚顺雨,在Google和微软都有过实习经历。研究员Li Jing也曾在Meta做过2年的博后研究员。

放眼国产大模型,也有同样的情况。以 Deepseek 团队为例,赵成钢的经历颇具代表性。作为衡水中学信息学竞赛班的佼佼者与 CCF NOI 2016银牌得主,赵成刚在清华求学期间便崭露头角,成为学生超算团队核心成员,并且三次助力团队斩获世界大学生超算竞赛冠军。此外,他也有过在英伟达实习的经历。

无独有偶,参与DeepSeekMath、DeepSeek-Prover、DeepSeek-Coder-v2、DeepSeek-R1等项目研发的核心研究人员邵智宏曾在微软研究院工作过;领导DeepSeek后训练团队的北航博士毕业生吴俣,在微软MSRA更是实习了长达五年,参与过小冰和必应百科项目。

而智谱AI的首席研究员丁铭,也曾在阿里巴巴达摩学院实习。可见大模型领域对人才的垂直与对口经历较为看重。

总结

以OpenAI、DeepMind、DeepSeek、Anthropic、智谱AI研发团队为例,不难发现,大模型行业呈现出人才年轻化的趋势,“90后”“00后”在大模型领域初具竞争力,清北学子更是在其中表现活跃。

越来越多的年轻人现身AI舞台,说明资历和经验不是唯一的标准,年轻研究员对新技术的好奇心、创造力,可以为大模型领域带来新思路和新动力,为大模型研发注入新的活力。