跳转至

PKU-VVT 卢宗青 长聘副教授

报告生成时间:2026年8月20日
个人主页:卢宗青
所属团队:北京大学计算机学院视频与视觉技术研究所


一、学者基本信息

项目 信息
姓名 卢宗青(Zongqing Lu)
现职 北京大学计算机学院视频与视觉技术研究所长聘副教授、博士生导师
研究方向 强化学习、多智能体系统、多模态大模型、通用智能体;近年延展至具身智能与人形机器人基础模型
北大任职轨迹 2017年秋以助理教授身份加入;2024年1月起任长聘副教授
学术身份 国家级青年人才、智源学者
团队与平台 早期公开资料称其负责“决策智能”课题组;现嵌入视频与视觉技术研究所的研究生导师团队;个人主页同时列示 PKU-RL 开源组织
研究主线 从多智能体通信/协作、分布式与边缘智能,逐步转向视觉强化学习、开放世界智能体、多模态大模型和具身基础模型
产业身份 BeingBeyond(北京智在无界科技有限公司)创始人;公司聚焦人形机器人通用大模型

信息以北京大学计算机学院主页、个人主页和相关公开论文/机构信息为准。下文“合作”主要指共同论文、共同平台或明确公开的项目关系,不将同院任职一概等同于直接共同指导。

二、教育背景与职业履历

公开资料形成一致的履历链条如下:

  • 东南大学阶段:获得学士、硕士学位。现有权威公开简介未披露具体年份、专业及导师姓名。
  • 新加坡南洋理工大学(NTU)阶段:2014年获计算机科学博士学位。检索到的北大英文简介、个人主页均明确为 NTU,而非清华大学交叉信息研究院;公开可核材料亦未给出其博士导师姓名。因此,不能将其博士导师写作马雄峰、吴翼或其他未获证实的人士。
  • 宾夕法尼亚州立大学阶段:2014—2017年在计算机科学与工程系从事博士后研究。公开简介未列出合作导师,报告不作推定。
  • 北京大学阶段:2017年秋加入北京大学计算机学院,早期为博雅助理教授/数字媒体研究所研究员,并任“决策智能”课题组负责人。2024年1月起获长聘副教授职位。其研究议题也由早期的多智能体强化学习、移动/边缘智能,扩展到多模态模型与通用智能体。
  • 与清华体系的关系辨析:其教育履历不属于“清华交叉信息院—姚班体系”。可确认的是,他在论文网络中与清华深圳国际研究生院学者李秀等存在跨机构合作,例如 ICLR 2024 的跨域策略适配工作;这属于论文合作,不能据此推定为其就学、任职或师承关系。
  • 智源与创业阶段:公开报道显示其曾任智源研究院多模态交互研究中心负责人,并负责国家自然科学基金委原创探索计划“通用智能体”项目。2025年1月成立智在无界,个人主页明确其为 BeingBeyond 创始人,形成“北大基础研究—智源协同—公司工程验证”的转化链路。

三、学生培养情况

公开网页没有发布完整的“卢宗青指导学生及毕业去向”名册。以下选取在其论文中持续出现、且研究主题与其团队高度一致的学生/青年研究者(共7人);其中“培养关联”依据共同署名与项目线索判断,除非学校或本人公开标明导师关系,否则不将其表述为已核实的单一导师关系。公开可查的个人毕业去向较少,故明确区分“未公开”。

人员 公开可见的合作/研究证据 培养或网络意义 已公开去向
蒋杰川(Jiechuan Jiang) 与卢宗青共同提出 ATOC 注意力通信模型,用于大规模多智能体协作 代表团队早期“学习通信—协作决策”主线,是该方向最具辨识度的核心共同作者之一 未检索到可靠的公开毕业去向
朱丽雯(Liwen Zhu) 与裴希、卢宗青、田永鸿合作 MetaVIM,研究去中心化交通信号控制 连接强化学习方法与视频与视觉技术研究所的智慧交通应用场景 未公开
裴希(Peixi Peng) MetaVIM 共同作者;亦在研究所论文序列中持续出现 与朱丽雯共同构成交通控制/内在动机强化学习的学生型协作节点 未公开
袁昊祺(Haoqi Yuan) 共同完成 Minecraft 长程任务的技能强化学习与规划、ResDex 灵巧抓取、Being-0 等工作 从开放世界技能学习延伸至灵巧操作和人形机器人,是连接“智能体—具身”转向的高频作者 未公开
冯翼成(Yicheng Feng) Being-0、Being-VL 及后续离线机器人策略学习等共同作者 参与视觉语言、具身机器人与公司协同研究,是新阶段多模态/具身主线的重要节点 未公开
张万鹏(Wanpeng Zhang) Being-VL 第一作者;后续与团队合作机器人离线策略学习和 VLA 可靠性研究 显示团队已将视觉表征、视觉语言模型与机器人策略学习并联推进 未公开
李博宇(Boyu Li) SELU 共同作者,研究未知环境中具身多模态大模型的自学习 对应团队由传统 RL 向“MLLM 自反馈—环境理解—决策”扩展的研究线 未公开

从培养模式看,团队并非只围绕单一算法课题展开:早期以多智能体通信和交通控制为代表,中期转向开放世界技能与规划,近年在机器人抓取、人形机器人、视觉语言编码等方向形成联合培养/共同攻关网络。由于院系公开信息未给出完整的学位关系和毕业去向,本报告不虚构“博士毕业生名单”或雇主;后续可由课题组或学院补充正式名单后再更新。

四、学术合作网络

4.1 北大内部与视频视觉平台合作

卢宗青所在的视频与视觉技术研究所具有明显的平台型协作特征。2024年,研究所导师团队获“北京大学优秀研究生导师团队”,成员包括高文、黄铁军、田永鸿、王亦洲、马思伟、段凌宇、熊瑞勤、施柏鑫、张史梁、卢宗青和蒋婷婷等。该关系首先体现共同培养和共同平台,而非自动意味着每两人均有联合论文。

  • 田永鸿:在 MetaVIM 论文中与卢宗青、朱丽雯、裴希共同署名,是可直接确认的内部论文合作。该工作把元变分内在动机强化学习用于去中心化交通信号控制,说明双方在机器学习、视觉/多媒体平台与智能决策应用之间存在实质交叉。
  • 王亦洲、蒋婷婷:与卢宗青同属获奖导师团队和同一研究所生态,分别代表计算机视觉/统计学习及医学影像/视觉方向。当前检索未找到足以确认的直接共同论文,宜定位为“同平台、可形成视觉感知—策略学习互补”的近邻关系,而非宣称既有项目合作。
  • 唐浩:唐浩现于北大计算机学院从事生成式模型、世界模型、空间智能、多模态大模型与具身智能。其研究议题与卢宗青在世界模型/多模态/具身方向高度相邻,但截至本次公开检索,未找到明确共同署名或共同项目材料。因此应视为潜在的院内议题邻接者,不宜写成已验证的直接合作者。
  • 高文、黄铁军、施柏鑫等:通过视频与视觉技术国家工程研究中心的导师团队、研究生培养和多媒体平台形成组织层面的连接;这为卢宗青将策略学习接入视觉数据、感知与硬件系统提供了院内接口。

4.2 跨机构学术合作与来源网络

  • 新加坡南洋理工大学—宾州州立大学:构成其海外训练和博士后网络的两端。公开资料确认机构与时间,但未公开博士导师或博士后合作导师,故本报告不延伸师承树。
  • 清华深圳国际研究生院、上海人工智能实验室、腾讯互动娱乐事业群:ICLR 2024 论文《Cross-Domain Policy Adaptation by Capturing Representation Mismatch》由贾飞、陈家白、杨敬雯、卢宗青、李秀合作,其中机构分别涉及清华深圳国际研究生院、上海人工智能实验室、腾讯 IEG、北大和智源。它是其与清华及腾讯研究人员的清晰跨机构论文连接,主题为动力学差异下的策略迁移。
  • 智源研究院:卢宗青的公开身份包括智源学者,且曾负责多模态交互研究中心;公司报道还称核心成员有多位来自智源。这一节点既是国家级科研组织协作平台,也是其从通用智能体研究走向多模态和具身方向的重要中枢。
  • 南京/东南地区网络:可确认的教育联系是东南大学,而非南京大学。检索未找到可据以确认“与南京大学强化学习群体长期合作”的材料,故不将地域上的潜在联系扩写为合作事实。
  • 加州大学圣地亚哥分校、中国人民大学等:Being-VL 的公开作者机构列有北京大学、UCSD、中国人民大学与 BeingBeyond,表明其新一代视觉语言研究已形成跨校共同作者网络。这里可确认的是论文级合作,具体人员隶属和职责仍应以论文版本为准。

4.3 研究主题驱动的核心合作图谱

其合作网络可按主题分为三条连续演化的边:

  1. 多智能体通信与协作边:以蒋杰川及 ATOC 为代表,解决部分可观测、分布式环境下何时通信、与谁通信的问题;这奠定了“智能体交互与协调”的早期方法基础。
  2. 决策学习与真实系统边:以朱丽雯、裴希、田永鸿及 MetaVIM 为代表,把元强化学习、内在动机与交通控制等多智能体应用结合,体现从基准问题到系统场景的迁移。
  3. 开放世界—多模态—具身边:以袁昊祺、冯翼成、张万鹏、李博宇等共同作者为主,覆盖 Minecraft 长程规划、未知环境自学习 MLLM、通用灵巧抓取、Being-0 与 Being-VL。该边将语言/视觉表征、技能库和机器人控制纳入同一研究链,也是当前最活跃的网络中心。

五、业界合作关系深度分析

5.1 BeingBeyond(智在无界):从科研课题到具身模型公司

卢宗青个人主页明确其为 BeingBeyond 创始人。公开报道显示,北京智在无界科技有限公司成立于2025年1月,聚焦人形机器人通用大模型;其在2025年完成数千万元融资,由联想之星领投,星连资本(Z基金)、燕缘创投、彬复资本跟投。融资用途公开表述为核心技术研发、模型迭代和产业化验证。

该公司的研究—产业连接并非泛泛“教授创业”,而是围绕具体技术路径展开:

  • 数据路径:团队公开强调从互联网人类运动和手部操作视频中获取预训练信号,再以较少真机数据补足;这与卢宗青长期的强化学习、视觉与通用智能体研究形成数据与算法连续性。
  • 系统路径:Being-0 论文以基础模型负责高层指令理解、规划与推理,技能库承担低层运动和灵巧操作,并加入轻量视觉语言“Connector”协调层级。这说明其产业化方案不是单一端到端控制器,而是“基础模型+模块化技能”的分层架构。
  • 技术转化边界:北大与公司之间具体专利、人员兼职、知识产权归属及采购关系没有在已检索公开材料中完整披露,不能作超出公开证据的判断。可以确认的是公司、论文项目页与北大/跨校作者网络同时出现,体现了研究人才与技术议题的协同。

5.2 产业伙伴与应用协作的层级判断

  • 资本型伙伴:联想之星、星连资本、燕缘创投、彬复资本通过融资提供研发和产业验证资源;它们是公司层面的资本关系,不等同于北大科研项目的合作单位。
  • 腾讯 IEG:在跨域策略适配论文中以作者机构出现,证明了研究人员层面的论文协作。该证据支持“有跨机构研究合作”,但不足以证明卢宗青团队与腾讯存在持续商业合同或联合实验室。
  • 智源研究院:兼具科研组织、人才来源和项目平台属性。报道所称多位核心成员来自智源,结合卢宗青曾任多模态交互研究中心负责人,显示其在学术与创业之间承担较强的枢纽作用。
  • 机器人本体及场景合作:Being-0 已在全尺寸人形机器人和大室内环境进行实验,但公开论文摘要未充分披露本体厂商、场景客户或商业部署清单。对此应保留为“工程验证能力已公开展示”,不应推定具体供应链或客户关系。
  • 大模型/智能体企业合作的结论:截至本次检索,未发现其与阿里、字节跳动、华为等形成可独立核验的长期公司合作材料。报告仅列已证实的 BeingBeyond、腾讯论文节点与智源平台,避免将行业共现、论坛同台或人才流动误写为合作。

六、重要奖项与学术兼职

  • 国家级青年人才、智源学者:北京大学计算机学院与视频与视觉技术研究所公开主页均有此表述,是目前最明确的人才荣誉信息。
  • 北京大学长聘副教授、博士生导师:个人主页给出 2024年1月起长聘副教授的时间点;学院主页确认其博士生导师身份。
  • 北京大学优秀研究生导师团队:作为高文院士领衔的视频与视觉技术研究生导师团队成员,该团队于2024年获北京大学优秀研究生导师团队称号;此为团队荣誉,应与个人获奖区分。
  • 学术服务:学院主页确认其担任 ICML、NeurIPS、ICLR 领域主席;较早的北大英文简介还列出 NeurIPS、ICLR、IJCAI、AAMAS、INFOCOM 等会议技术程序委员会服务,以及 Nature Machine Intelligence 等期刊审稿工作。由于服务年份随届次变化,宜理解为公开履历中的长期学术服务记录,而非每届固定任职。
  • 科研项目:公开报道指向其负责国家自然科学基金委原创探索计划“通用智能体”项目。此处仅陈述项目领导关联,不将媒体所述经费数据作为未经基金公告复核的结论。

七、Connection圈层总结

卢宗青的关系网络可概括为“四层、三条主线”。

  • 第一圈层:直接共同研究者与学生型作者群。 蒋杰川、朱丽雯、裴希、袁昊祺、冯翼成、张万鹏、李博宇等,分别支撑多智能体通信、交通控制、开放世界技能、视觉语言与具身机器人等连续课题;其中后四者构成当前具身/多模态方向的高活跃节点。
  • 第二圈层:北大视频与视觉技术平台。 高文、黄铁军、田永鸿、王亦洲、蒋婷婷、唐浩等构成组织或议题邻接网络。田永鸿已呈现直接共同论文;王亦洲、蒋婷婷、唐浩更适合界定为院内平台和研究主题上的近邻,尚不宜夸大为直接合作。
  • 第三圈层:跨机构科研共同体。 NTU、宾州州立大学提供其海外学术履历背景;清华深圳国际研究生院、上海人工智能实验室、腾讯 IEG、UCSD、中国人民大学等通过具体论文连接;智源研究院则是国内多模态/通用智能体合作的重要平台。
  • 第四圈层:创业与产业验证生态。 BeingBeyond 是最强、证据最明确的产业节点,融资方提供资本支持,研究工作通过 Being-0、Being-VL 等项目与人形机器人、视觉语言和具身策略学习连接。腾讯 IEG具有论文级协作证据;其他大厂合作缺乏公开佐证,应继续跟踪而不作断言。

总体上,其网络的独特性在于:以强化学习的“交互、协作、技能学习”为方法底座,依托北大视频视觉平台和智源多模态平台,把共同作者网络逐步组织到具身基础模型与创业公司验证中。教育履历则应明确校正为“东南大学—南洋理工大学博士—宾州州立大学博士后—北京大学”,并不属于已获证实的清华交叉信息院师承链。