跳转至

北大智能学院 钟亦武 助理教授

报告生成时间:2026年9月15日
个人主页:Yiwu Zhong Homepage(另见 北京大学智能学院教师页Google Scholar
所属团队:北京大学智能学院专职教师;学院"自然语言处理"学科方向骨干成员(据北大智能科学与技术研究所学科方向页,负责人邓志鸿);个人课题组 2026 年秋启动招生,公开资料未披露实验室名称


一、学者基本信息

字段 内容
姓名 钟亦武(Yiwu Zhong)
职称 助理教授、研究员、博士生导师(北京大学智能学院官网教师页)
人才计划 国家级青年人才项目(海外)获得者;北京大学博雅青年学者(均据智能学院官网教师页)
电子邮件 yiwu-zhong@outlook.com(据学院官网教师页;暂未见北大官方域邮箱的公开记录)
所属单位 北京大学智能学院(2026 年正式入职;学院官网 2025 年 4 月已建其教师页,同月公开招生帖明示"将于 2026 年入职")
学科归属 智能学院"自然语言处理"学科方向骨干成员(负责人邓志鸿,成员含郑子隆、贾子夏);同时列名学院 2027 年招生指南"计算机视觉"方向博士生导师(据本库 pku_sai_xuchao_network.mdpku_sai_zenggang_network.md 等交叉引用),呈现"申报 NLP 方向、研究横跨视觉—语言"的双重身份
研究方向 视觉-语言学习(Vision-Language Learning)、多模态大模型、智能体、三维空间推理、具身机器人(据学院官网教师页)
学术产出 在 CVPR、ICCV、ECCV、EMNLP、AAAI 等视觉与 NLP 顶级会议发表论文 10 余篇;谷歌学术引用量超 2500 次(2025 年 4 月招生帖),Semantic Scholar 收录 9 篇、引用约 2960 次(2026 年 9 月查询)
代表成果 RegionCLIP(CVPR 2022,一作)、GLIP: Grounded Language-Image Pre-training(CVPR 2022,合作)、从自然语言监督学习场景图(ICCV 2021,一作)、过程感知视频表征(CVPR 2023,一作)

消歧说明:"钟亦武 / Yiwu Zhong"存在多名同名研究者,本报告严格锁定以下证据链确认同一人:北京大学智能学院官网教师页所链接的 Google Scholar 主页(user=irrbH_IAAAAJ)与个人 Notion 主页(原威斯康星大学麦迪逊分校个人页 pages.cs.wisc.edu/~yiwuzhong 重定向至该 Notion 主页)互相印证,且与 2025 年公开招生帖中的学历、获奖信息完全一致。Semantic Scholar 上另有 6 个同名作者档案,均与北大教师无关,本报告不采用其任何数据。

二、教育背景与职业履历

钟亦武博士毕业于美国威斯康星大学麦迪逊分校(UW-Madison)计算机科学专业,博士导师为 Yin Li 教授,博士论文题为《Learning Visual Knowledge from Natural Language Supervision》(从自然语言监督中学习视觉知识),2023 年 8 月获博士学位(据其个人主页自述"Get my Ph.D. degree from UW-Madison. It's lucky to be advised by Prof. Yin Li!")。本科院校与专业在其北大官方教师页、个人主页及目前检索到的公开资料中均未披露,本报告不作推测。

毕业后赴香港中文大学任博士后研究员,合作导师为 Liwei Wang 教授(据其个人主页)。值得注意的是,Liwei Wang 正是他 2019 年腾讯 AI Lab 西雅图实习期间的导师与 2020 年 ECCV 论文的合作者——这段"实习—合作—博士后"的持续关系贯穿其学术生涯。2025 年 4 月,他公开发布 2026 级博士生招生信息,宣布将于 2026 年入职北京大学智能学院担任助理教授;其学院官网教师页时间戳为 2025 年 4 月,页面已标注其为专职教师、国家级海外青年人才项目获得者、北京大学博雅青年学者。

其研究脉络清晰:以"视觉世界与人类语言之间的桥梁"为主线,从早期基于自然语言监督的视觉结构化表征学习(场景图生成、图像描述),到开放词汇/开放世界物体检测(RegionCLIP、GLIP 系),再到近年转向视频理解与多模态大模型(过程感知视频表征、视频大模型适配 PAVE),当前聚焦多模态推理与具身智能(据其招生帖与个人主页)。这一"视觉—语言"双栖背景,也解释了学院为何将其纳入 NLP 学科方向骨干,而招生指南又将其列入计算机视觉方向博导名单。

职业履历要点(时间线):

时间 事件
本科阶段 院校与专业公开资料未披露
2018 腾讯 AI Lab(深圳)研究实习(合作者 Jia Xu、Meng Fang,据个人主页)
2019 腾讯 AI Lab(西雅图)研究实习(合作者 Liwei Wang、Dong Yu,据个人主页)
2020 一作论文入选 ECCV 2020(与腾讯西雅图团队及 UW-Madison Yin Li 合作)
2021 微软研究院(总部)研究实习(合作者杨建伟 Jianwei Yang、高剑锋 Jianfeng Gao,据个人主页);ICCV 2021 录入 2 篇
2021.12–2022.03 RegionCLIP(一作)与 GLIP(合作)两篇论文入选 CVPR 2022,其中 1 篇入选最佳论文候选(top 0.4%,据个人主页)
2022 Meta AI(加州门洛帕克)研究实习(合作者 Xueting Yan、Licheng Yu,据个人主页)
2023.03 获 CVPR 2023 Doctoral Consortium(博士联盟)奖(top 13%,据个人主页);一作论文入选 CVPR 2023
2023.08 获 UW-Madison 计算机科学博士学位(导师 Yin Li)
2023–2026 香港中文大学博士后研究员(合作导师 Liwei Wang);2024 年 2 篇 CVPR、2 篇 EMNLP,2025 年 1 篇 CVPR、2 篇 ICCV
2025.06 获 CVPR 2025 杰出审稿人(top 5.6%,据个人主页)
2026 入职北京大学智能学院,任助理教授(tenure-track)、研究员、博士生导师;入选国家级海外青年人才项目、北京大学博雅青年学者
2026.09 首批博士生(2026 年 9 月入学,直博/申请-考核)到组

三、学生培养情况

1. 招生资格与规模

钟亦武为博士生导师(据智能学院官网教师页),并列入学院 2027 年招生指南"计算机视觉"方向博士生导师名单(据本库多份智能学院报告交叉引用)。其 2025 年 4 月发布的招生帖明确"现招收 2026 年 9 月入学的博士研究生(直博学生或申请-考核制学生)",并长期招收实习生、硕士研究生(考研)以及国际及港澳台学生。对申请者的期待为:对科研有热情、自驱力强、数理基础与编程能力扎实,有论文发表经历者优先。

2. 在读学生与已培养学生

截至本报告生成日(2026 年 9 月),其课题组刚于 2026 年秋季接收首批博士生,首批学生名单及研究方向尚未见公开披露;其此前在 UW-Madison 与香港中文大学期间均非独立 PI,公开资料未见其独立指导的已毕业硕士、博士记录。需说明的是,其 CVPR 2025 论文 PAVE(视频大模型的补丁与适配)第一作者朱明卓(Zhuoming Liu)等人出自 UW-Madison 团队,属其与博士导师 Yin Li 的延续性合作,而非其北大在编学生(据论文署名与作者单位推断,本报告不作学生归属认定)。

3. 培养定位(据公开资料归纳)

从招生方向("多模态推理/具身智能方向博士")与个人主页研究焦点(Vision-Language Learning、Multi-Modal LLMs、Embodied AI)看,其课题组培养定位为:以视觉-语言表征学习为方法基座,向多模态大模型的空间理解、三维推理与具身智能体应用延伸;并延续其本人"学术会议主会 + 工业实习"并重的成长路径(其招生帖与个人主页均欢迎实习生联系,显示课题组将保持开放的学生实习生态)。

四、学术合作网络

4.1 学院/实验室内部合作(北大智能学院)

  • NLP 学科方向组:据北大智能科学与技术研究所学科方向页,"自然语言处理"方向由邓志鸿负责,骨干成员为郑子隆、贾子夏、钟亦武。钟亦武是该方向组中最年轻的成员,也是其中唯一的"视觉—语言"跨界学者,其多模态背景与邓志鸿(知识图谱与 NLP)、郑子隆(多模态与通用人工智能方向)、贾子夏等成员的任务分工形成互补(详见本库 pku_sai_dengzhihong_network.md 的口径)。
  • 计算机视觉方向博导群体:据本库多份报告引用的学院 2027 年招生指南,其与陈宝权、林宙辰、王立威、王奕森、许超、英向华、曾钢、赵卉菁、朱松纯、裴玉茹、封举富等列名同一博导方向,是学院 CV 方向最新加入的青年力量。
  • 朱毅鑫(人工智能研究院/智能科学系助理教授):2026 年预印本论文 M3Eval(面向认知的多模态记忆评测)由二人及 UW-Madison 团队共同完成(据 Semantic Scholar 论文作者数据),是其在北大内部已见的首个院内合作实例,连接了认知推理与多模态评测两个方向。
  • 平台背景:智能学院 2022 年获批跨媒体通用人工智能全国重点实验室、2023 年获批国家人工智能产教融合创新平台(据招生帖中学院介绍),其多模态大模型与具身智能方向与实验室"构建通用智能体"的总体目标直接对齐。

4.2 国内(含港澳)合作

  • 香港中文大学:2023–2026 年任该校博士后研究员(合作导师 Liwei Wang 教授),期间在 2024 年港中文多模态研讨会(Multi-Modal Symposium 2024)作报告"Learning Open-World Visual Knowledge from Natural Language"(据个人主页)。港中文是他在北大之前最后一段学术履历,也是其进入华人多模态研究共同体的直接通道。
  • 腾讯 AI Lab(西雅图/深圳):与其关系最深的国内产业研究机构——2018 年深圳实习、2019 年西雅图实习,2020 年与西雅图团队(Liwei Wang、Dong Yu、Jianshu Chen)联合发表 ECCV 2020 一作论文,随后 Liwei Wang 转任港中文教授并成为其博士后合作导师(据个人主页与论文署名)。

4.3 国际合作

  • 威斯康星大学麦迪逊分校(UW-Madison):学术母港。博士导师 Yin Li 教授是其合作网络的第一节点:二人合作贯穿 ICCV 2021(场景图生成,一作)、ICCV 2021(弱监督场景图)、ECCV 2020、CVPR 2023(一作)、CVPR 2025(PAVE)直至 2026 年的 M3Eval,入职北大后仍与导师团队保持联合产出(据 Semantic Scholar 论文数据)。
  • 微软研究院(美国雷德蒙德总部):2021 年实习于杨建伟(Jianwei Yang)、高剑锋(Jianfeng Gao)团队,产出其学术生涯中影响最大的两项成果——RegionCLIP(一作,CVPR 2022)与 GLIP(合作,CVPR 2022),合作者还包括 Pengchuan Zhang、Chunyuan Li、Lu Yuan、Lijuan Wang、Noel Codella、Xiyang Dai 等(据论文署名)。
  • Meta AI(硅谷总部):2022 年实习(合作者 Xueting Yan、Licheng Yu),获 Meta 优秀实习生荣誉;Licheng Yu 亦为其 CVPR 2023 一作论文的合作者(据个人主页)。
  • 加州大学圣地亚哥分校(UCSD):与 Jingbo Shang、Julian McAuley 团队合作发表 ICCV 2023 论文"Learning Concise and Descriptive Attributes for Visual Recognition"(据论文署名)。
  • 罗切斯特大学:Chenliang Xu 教授是其 ICCV 2021 两篇场景图方向论文的共同作者(据论文署名)。
  • 加州大学洛杉矶分校(UCLA)/ 华盛顿大学:GLIP 合作者中包括 UCLA 的 Kai-Wei Chang 与 UW 的 Jenq-Neng Hwang(据论文署名),显示其经由微软系项目接入的美国多校合作网络。

五、业界合作关系深度分析

钟亦武的产业连接呈"三次头部企业实习 + 一次持续性研究合作"的结构,且均发生在其职业生涯早期,属于典型的"以实习换深度合作、以合作成名作"的青年学者路径:

  • 微软研究院(深度最高):2021 年实习期间作为一作完成 RegionCLIP(区域级语言-图像预训练,将 CLIP 式对齐从整图下沉到物体区域),并作为合作者参与 GLIP(将目标检测统一为短语定位任务)。GLIP 已成为语言-图像预训练与开放词汇检测的代表性工作之一(Semantic Scholar 引用约 1780 次),微软以开源项目形式发布(GLIP 官方仓库),被后续大量开放词汇检测与多模态工作继承;RegionCLIP 引用亦达约 950 次。这两项工作使其在博士中期即进入开放世界视觉感知的"谱系作者"行列。需说明:两篇 CVPR 2022 论文中 1 篇入选最佳论文候选(top 0.4%),其个人主页未注明具体是哪一篇,本报告不作认定。
  • Meta AI(硅谷总部):2022 年实习,获 Meta 优秀实习生;实习合作者 Licheng Yu 随后成为其 CVPR 2023 视频理解论文的合作者,显示 Meta 内核团队(视频-语言)与其研究方向的自然衔接。
  • 腾讯 AI Lab(双站点):中国头部企业中与其绑定最深者——深圳(2018)、西雅图(2019)两次实习,并以西雅图团队为班底发表 ECCV 2020 一作论文;该团队负责人 Liwei Wang 后转任港中文教授,成为其博士后合作导师,形成"企业研究院→大学→北大教职"的完整人才回流链路。
  • 合作模式研判:其业界关系以"研究实习 + 联合论文"为主,属于微软亚研—MSR Redmond—Meta FAIR 一系的"实习生产出顶会一作"模式;目前公开资料未显示其主持企业横向项目、担任企业顾问或参与创业的记录(其课题组 2026 年才建立,产业合作尚待观察)。值得注意的是,其官方联系邮箱为 outlook 个人域而非北大域,与其长期海外—产业履历相符。

六、重要奖项与学术兼职

类别 名称/内容
人才计划 国家级青年人才项目(海外)获得者(据智能学院官网教师页);北京大学博雅青年学者(同上)
会议奖项 CVPR 2022 最佳论文候选(Best Paper Finalist,top 0.4%,2 篇 CVPR 2022 论文中 1 篇,据个人主页);CVPR 2023 Doctoral Consortium(博士联盟)奖(top 13%);CVPR 2025 杰出审稿人(top 5.6%)
企业荣誉 Meta 优秀实习生(据智能学院官网教师页)
审稿服务 CVPR 2025 杰出审稿人;长期在 CVPR/ICCV/ECCV/EMNLP 等会议评审(据个人主页及获奖表述归纳)
学术活动 2024 年香港中文大学多模态研讨会(Multi-Modal Symposium 2024)邀请报告"Learning Open-World Visual Knowledge from Natural Language"(据个人主页)
学术兼职 截至本报告日,公开资料未披露其担任期刊编委、学会职务或国家级奖项的记录

七、Connection 圈层总结

钟亦武的学术关系网络呈"一师承、双工业、三圈层"的紧凑结构:

  • 师承圈(UW-Madison—港中文):博士导师 Yin Li(UW-Madison,视频理解与结构化视觉表征方向)是其学术谱系的根;博士后合作导师 Liwei Wang(港中文,前腾讯 AI Lab 西雅图)则是把其从"微软系开放词汇检测"引向"视频-语言与多模态记忆"的关键纽带。二人分别构成其国际合作与港澳合作的两个锚点,且入职北大后与 Yin Li 的联合产出(PAVE、M3Eval)仍在延续。
  • 学院圈(NLP 方向组 + CV 博导群):在北大智能学院内部,他以"自然语言处理学科方向骨干成员(邓志鸿、郑子隆、贾子夏组)"与"计算机视觉方向博导"双重身份嵌入学院学科版图,是学院六个关键领域中"自然语言"与"计算机视觉"两大方向的天然桥接人物;与朱毅鑫的 M3Eval 合作则初步打通了与认知推理—具身智能群体的连接。其多模态大模型与具身智能方向与学院跨媒体通用人工智能全国重点实验室的"通用智能体"目标高度对齐,具备依托国家级平台快速组建课题组的条件。
  • 国际工业学术圈(微软—Meta—腾讯):经由 2021 年微软研究院实习(杨建伟、高剑锋团队)产出的 RegionCLIP 与 GLIP,他在开放词汇检测/语言-图像预训练谱系中拥有两项高引"硬通货";经由 Meta 与腾讯的双边实习,保持了与硅谷、深圳两地多模态团队的持续联系。这一"美国大厂方法论 + 中国大厂数据与场景"的组合,是其区别于纯学院派青年教师的显著特征。
  • 成长性判断:作为 2026 年方入职的青年 PI,其网络资本集中在个人学术声誉(两项高引成果、三项 CVPR 级荣誉)而非团队与平台积累;课题组建组、首批博士生培养与院内合作尚处起步期(首批 2026 级学生刚入学,北大内部已见与朱毅鑫的合著实例)。可预期的网络扩张方向为:以博雅青年学者与海外优青身份接入学院大平台,依托视觉—语言跨界背景在 NLP 与 CV 两个学科方向组之间承担枢纽角色,并延续"顶会一作 + 企业实习"的学生培养出口。

主要资料来源

  1. 北京大学智能学院官网教师页:钟亦武(https://sai.pku.edu.cn/info/1362/3348.htm,北大信息科学技术学院网站同步镜像 cis.pku.edu.cn/info/1362/3348.htm)——职称、人才计划、研究领域、教育与合作履历、荣誉
  2. 个人主页:https://yiwuzhong.notion.site/homepage(原 https://pages.cs.wisc.edu/~yiwuzhong/ 重定向)——博士导师、论文题目、博士后合作导师、实习经历时间线、获奖比例、论文逐条记录
  3. 北大智能科学与技术研究所学科方向页:自然语言处理(https://www.cis.pku.edu.cn/info/1087/2306.htm)及学科方向总页(https://www.cis.pku.edu.cn/xkjs/xkfx.htm)——NLP 方向负责人与成员名单
  4. 招生帖"北京大学智能学院钟亦武老师招收多模态推理/具身智能方向博士"(今日头条,2025 年 4 月)——2026 年入职安排、论文与引用统计、招生要求
  5. Semantic Scholar 作者档案(authorId 1828787912,经 Google Scholar user=irrbH_IAAAAJ 交叉比对确认同一人)——论文列表、合作者、引用数据
  6. 本库交叉引用:pku_sai_dengzhihong_network.md(NLP 方向组口径)、pku_sai_xuchao_network.mdpku_sai_zenggang_network.mdpku_sai_fengjufu_network.mdpku_sai_peiyuru_network.md(2027 年招生指南计算机视觉方向博导名单)
  7. 北京大学人工智能研究院教师页:朱毅鑫(https://www.ai.pku.edu.cn/info/1173/1865.htm)——院内合作者身份核实