跳转至

上海交通大学 李永露 副教授

报告生成时间:2026年8月21日
个人主页:李永露
所属团队:上海交通大学 MVIG(Machine Vision and Intelligence Group,机器视觉与智能实验室)


一、学者基本信息

字段 信息
姓名 李永露(Yong-Lu Li)
出生年份 未见权威公开披露
职称 上海交通大学长聘教轨副教授(个人主页英文为 Tenure-Track Associate Professor)
所属单位 上海交通大学人工智能学院/电子信息与电气工程学院清源研究院;上海创智学院全时导师
实验室职务 RHOS Lab 负责人(PI);MVIG 核心成员,与卢策吾教授团队紧密协作
学术头衔 博士生导师;上海市海外高层次人才;AI100 青年先锋
国家级人才 未见其本人公开主页列示国家级人才计划入选信息
其他任职 CAAI 具身智能专业委员会执行委员兼副秘书长;VALSE Executive Area Chair;上海交大 ACM 班《计算机视觉》课程教师
邮箱 yonglu_li@sjtu.edu.cn
研究方向 物理推理、具身智能、人类行为理解;进一步覆盖人—机器人—物理场景交互、多模态基础模型、HOI 检测/重建与生成

李永露以“知识驱动的行为理解”为博士阶段主线,在人—物交互(HOI)研究中形成了从可交互性建模、局部身体状态(Part States)、行为知识库到视觉推理的连续技术脉络;成为独立教师后,进一步以 RHOS(Robot–Human–Object–Scene)实验室将该脉络扩展到具身数据、物理规律学习、人机协同学习与机器人操作。其公开主页列示的开源项目累计 GitHub 星标超过 13,000;其中 HAKE 是其最具辨识度的知识工程基础设施。

二、教育背景与职业履历

李永露的公开履历修正了“上海交大本科、UCLA 联培”“南方科技大学/同济大学任教”等流传信息:截至报告日期,能够由其本人主页和上海交大新闻相互支持的主线,是中科院自动化所学习/工作经历—上海交通大学博士—香港科技大学合作研究—回交大任教,而非 UCLA 联培或南科大、同济教职。其本人主页只明确列出 2014—2017 年在中国科学院自动化研究所师从杨一平教授、蔡莹皓副教授,2017—2021 年在上海交通大学计算机科学与技术专业攻读博士、导师卢策吾教授;2021—2022 年与香港科技大学邓智强(Chi-Keung Tang)教授、戴昱翼(Yu-Wing Tai)教授密切合作。未找到将其与 Stefano Soatto/UCLA 直接关联的可靠公开履历证据,故不将其写入职业链条。

时间线如下:

  • 2014—2017 年:于中国科学院自动化研究所学习和工作,接受杨一平、蔡莹皓指导。这一阶段提供了计算机视觉和几何/视觉建模训练基础。
  • 2017 年 7 月—2021 年:加入上海交通大学 MVIG,师从卢策吾教授攻读博士。博士论文为《知识驱动的行为理解》,围绕 HAKE 开展人—物交互、交互物体知识推理与人体局部状态行为建模;上海交大新闻确认其于 2021 年取得博士学位。
  • 2018—2021 年(博士期间代表产出):先后参与/主导 CVPR 2018 的 object part states、CVPR 2019 的 TIN、CVPR 2020 的 PaStaNet 与 2D–3D HOI 表征、NeurIPS 2020 的 HOI Analysis 等工作。需要特别澄清:常被称作“CDN、Cascade Disentangled Networks”的 CVPR 2021 HOI 方法并非李永露公开论文列表中的署名成果,不能归入其代表作;他在 HOI 领域被可靠支持的经典工作是 TIN、PaStaNet/HAKE、HOI Analysis、Interactiveness Field 等。
  • 2021—2022 年:与香港科技大学邓智强、戴昱翼合作研究。该段为跨区域学术合作/博士后式研究经历,公开材料没有支持其曾任南方科技大学或同济大学教师。
  • 2022 年 9 月—至今:加入上海交通大学清源研究院任长聘教轨助理教授;后晋升为副教授。其当前主页同时注明上海创智学院全时导师、RHOS Lab PI,并持续在 MVIG 中开展研究。
  • 2025 年:其团队论文 Human-Agent Joint Learning for Efficient Robot Manipulation Skill Acquisition 获 ICRA 2025 Human-Robot Interaction Best Paper Award;其本人为唯一通讯作者。同期获蚂蚁 InTech 科技奖(具身智能方向获奖者之一)。

上述博士培养路径说明,李永露是 MVIG 从"人体视觉理解"走向"具身智能"的关键校友—青年教师节点:卢策吾提供人类活动理解、视觉与机器人交叉平台;港科大合作扩展了视觉研究网络;回到交大后,他以独立 PI 身份把行为知识与物理推理转译为机器人学习问题。博士论文获2022 年度中国人工智能学会吴文俊人工智能科学技术奖"优秀博士学位论文奖"(2023 年 5 月颁奖,为第十二届)。

三、学生培养情况

李永露于 2022 年开始独立教职,独立毕业生的公开去向仍处于形成期。因此本节严格区分“可由论文通讯/项目页面确认的 RHOS 直接或主要指导学生”和“在 MVIG 联合培养体系中合作的研究生”,不把论文共同署名自动等同于唯一导师关系。其培养特点是:让学生围绕一个持续维护的开源系统或数据/任务平台完成研究闭环,再将行为理解、视觉推理延伸至真实机器人数据与操作策略。

1. 岳旭(RHOS 团队研究生,直接指导关系高度可见)

岳旭在李永露近年论文中持续以第一作者出现,研究覆盖视觉—文本数据蒸馏(ICML 2024)、关键样本选择的数据蒸馏(CVPR 2024)、多模态机器人示教系统 exUMI(CoRL 2025),并在李永露多篇工作中由其担任通讯作者。这条轨迹显示其培养重点从视觉表征和训练数据效率,逐步转向机器人示教数据采集与具身策略学习;它是 RHOS “数据生产—筛选—学习”研究链条中最完整的学生案例之一。公开可见资料尚未披露其毕业/任职去向,故报告不作推断。

2. 夏倩雯(Xiaoqian Wu,MVIG/RHOS 合作培养研究生,HOI 与视觉推理骨干)

夏倩雯与李永露共同完成了 ECCV 2022 的身体局部交互性学习、NeurIPS 2023 的 Symbol-LLM、CVPR 2024 Highlight 论文 Pangea 等工作,在若干成果中李永露为通讯作者或共同通讯作者。她的工作由 HOI 中“身体何处在交互”的细粒度视觉问题,发展到视觉活动的符号推理和跨数据集语义空间统一,体现了李永露将学生训练从指标型检测推进到知识表示与可解释推理的方式。公开页面未明确披露其唯一导师和后续去向,宜将其表述为 MVIG/RHOS 合作培养成员。

3. 刘新鹏(Xinpeng Liu,MVIG/RHOS 合作培养研究生,动作与运动建模骨干)

刘新鹏是 HAKE 后续发展与具身动作研究的长期共同作者,参与 HAKE TPAMI 2023、ECCV 2024 的运动语义/人—场景交互、ICLR 2025 的人体逆动力学及 CVPR 2025 的人类动力学空间等工作。李永露在这些论文中多以通讯作者或共同通讯作者身份提供研究牵引。该合作显示学生培养并非停留于图像中的 HOI 分类,而是逐步建立“人体运动—物理状态—动作语义—机器人模仿”的可迁移表示。现阶段公开信息不足以确认其已毕业或任职单位。

4. 罗晟城(Shengcheng Luo,MVIG/RHOS 联合培养研究生,机器人交互方向)

罗晟城是 ICRA 2025 HRI 最佳论文 Human-Agent Joint Learning for Efficient Robot Manipulation Skill Acquisition 的第一作者之一,也参与 ECCV 2024 的 DISCO 具身导航与交互。前述最佳论文由李永露作为唯一通讯作者,卢策吾共同参与,清楚体现“李永露独立课题方向 + MVIG 联合培养环境”的结构。其研究的核心是将人类演示、智能体学习和机器人操作技能放到同一学习框架中,是李永露从 HAKE 行为知识过渡到人机共同学习的代表性人才培养成果;公开资料尚未给出毕业去向。

5. 文博然(Boran Wen,RHOS/马利庄团队合作培养研究生,开放词汇 HOI 重建方向)

文博然作为第一作者参与 CVPR 2025 Reconstructing In-the-Wild Open-Vocabulary Human-Object Interactions,论文共同通讯作者包括陈玉珑、马利庄和李永露。该成果对应李永露同时身处 MVIG 与马利庄教授团队的联合研究生态:既利用开放世界视觉理解,又服务于三维交互重建。对学生而言,这种共同指导模式提供了“行为理解—三维视觉—数字媒体/图形学”的跨方向训练;目前公开材料未明确其个人毕业去向及唯一导师。

6. 洪丽(Hong Li,RHOS 团队研究生,视觉—触觉与物理推理方向)

洪丽在 ICLR 2025 The Labyrinth of Links、2026 年视觉—触觉特征学习和可穿戴机器人示教等系列工作中与李永露合作,后续论文中李永露明确为通讯作者。其选题连接多模态大模型的关联推理、触觉感知和具身示教,反映 RHOS 对学生的训练已从纯视觉扩展为面向实际操控的多传感器研究。由于主页尚无正式成员名册与履历页,报告仅将其标为团队研究生,不据论文年份推断年级、学位或去向。

7. 徐昕宇(Xinyu Xu,MVIG/RHOS 合作培养研究生,导航与人形操作方向)

徐昕宇参与了 ECCV 2024 的 DISCO、NeurIPS 2024 的 HumanVLA、ICCV 2023 的 EgoPCA 等研究,贯通场景语义、第一视角手—物交互和视觉语言驱动的物体整理。李永露在若干论文中为通讯作者/共同通讯作者,卢策吾为共同合作者,说明其处于两位教师协同培养的研究链条中。其工作表明实验室的人才培养设计不以单一任务分割,而是由认知场景表征逐渐进入人形机器人操作;公开资料未披露离校或任职信息。

总体看,李永露目前可见的学生网络仍以在读研究生和联合培养为主,尚不宜为了满足“校友去向”而虚构其独立学生已进入的机构。能够确认的外溢样本是:樊浩威(Hao-Wei Fan)曾在 2020 年 7 月至 2022 年 6 月作为 MVIG 访问学生接受卢策吾与李永露共同指导,现于北京大学前沿计算研究中心攻读博士(导师董豪);这说明李永露在获得独立教职前已参与本科/访问学生培养,并形成向国内顶尖博士项目输送的人才通道。

四、学术合作网络

4.1 实验室内部与校内网络

卢策吾—MVIG 主轴。 卢策吾是李永露博士导师,也是其最稳定的高频合作者。双方共同署名 HAKE、HOI 检测、人体运动、机器人学习等跨越 2017—2026 的系列工作。关系的演化很清晰:博士阶段由卢策吾主导的 MVIG 课题组中开展人类行为理解;独立任教后,李永露以 RHOS 作为独立研究单元,但仍在 MVIG 共享学生、基础设施及具身智能问题设置。ICRA 2025 HRI 最佳论文是这一“学生—导师—青年 PI”共同网络持续协作的代表。

马利庄团队的跨学科平台。 上海交大官方在 ICCV 2023 新闻中明确将李永露列为马利庄教授团队成员,团队还包括卢策吾、盛斌、易冉、陈玉珑、院旺等人。该网络使其与数字媒体、三维重建、图形学和虚拟现实方向建立制度性连接。2025 年开放词汇 HOI 重建工作中,马利庄、陈玉珑与李永露的共同通讯关系正是这种协作的论文证据;它避免 RHOS 局限为机器人单一赛道,保留了从视觉内容理解通向三维交互生成的能力。

HAKE 的核心作者群。 梁旭、黄希杰、徐岳、方浩树、刘新鹏、夏倩雯、吴小倩等研究者在 TIN、PaStaNet、HAKE 与后续工作中反复出现。这一群体不是松散的单篇合作,而是围绕“人类局部状态—对象可供性—动作推理”构建了数据、模型、基准和开源代码的共同体;李永露是其知识结构和系统化表达的核心推动者之一。

4.2 跨机构与国际网络

香港科技大学网络。 2021—2022 年,李永露与邓智强、戴昱翼在港科大合作;之后的 ECCV 2024 数据蒸馏、CVPR 2022 HOI 可交互性场等论文仍可见两位学者共同署名。这一联系将其嵌入港科大视觉分析传统,并带来视觉表征、三维/几何及学习方法的持续合作。需要强调的是,这一海外节点是 HKUST,而非 UCLA/Stefano Soatto。

中科院自动化所早期网络。 杨一平、蔡莹皓是其 2014—2017 年阶段的导师。其 2016 年 ICPR 论文仍可见该合作谱系,说明李永露在加入 MVIG 前已与自动化所的视觉几何/无人机图像建模研究群体形成联系;这为后来的视觉研究提供了较早的跨机构节点。

国际机器人与多模态协作。 ICRA 2025 获奖论文的共同作者 Katherine Rose Driggs-Campbell(美国伊利诺伊大学芝加哥分校)带来人机协同与机器人学习的国际连接;ECCV 2024 DISCO 论文与香港大学杨彦超合作;CVPR 2025 开放词汇 HOI 重建工作连通不同三维视觉作者群。与传统“单一海外访问”相比,李永露当前国际网络更多通过共同课题、学生合作和顶会论文形成。

五、业界合作关系深度分析

5.1 从开源基础设施到产业问题的技术接口

李永露的产业关联首先表现为可复用开源资产,而非以个人公司任职为中心。HAKE 把人体部位状态、交互物体、行为知识和规则组织成开源知识引擎;AlphaPose 生态、HAKE 数据与代码在其主页中被持续维护。此类资产为视频分析、内容理解、交互式数字人、机器人模仿学习提供了可调用的感知与语义层,降低企业将视觉研究接入实际场景的门槛。

其第二层接口是“具身数据与物理推理”。2025 年蚂蚁 InTech 科技奖对其研究方向的概括为“具身数据的挖掘、生产与利用,以及面向物理理解与推理的具身模型基建”。这说明产业界认可的并不是单个 HOI 检测器,而是从人类行为数据中抽取可泛化知识、再提供给机器人/智能体的技术路线。RHOS 围绕遥操作、示教、机器人数据选择、视觉—触觉学习的工作,正补足了这一数据闭环。

第三层是公共治理的视觉应用。其主页列示为 2024 世界互联网大会领先科技奖的获奖项目“社会治理智能化的视觉理解共性技术及应用”。该成果应被理解为其参与马利庄团队视觉理解技术体系的公共场景转化,而不应夸张为李永露个人主导的商业化公司项目。它表明 HAKE/行为理解背景能够连接社会治理、公共视频理解等大型应用语境。

5.2 产业界联系、人才与研究议程的双向影响

奖项和产业研究社群。 百度奖学金、华为奖学金、WAIC 云帆奖及 2025 蚂蚁 InTech 科技奖构成李永露与头部科技产业研究生态的公开连接。其中,蚂蚁奖属于面向青年计算机科研人员的公益性资助,并不自动意味着雇佣、投资或联合研发关系;但它将具身智能的数据和物理推理议题带入产业技术评审体系。2022 年他还在 HarmonyOS 技术创新沙龙作“知识驱动活动推理”报告,反映其与开源操作系统/开发者社区的知识传播联系。

技术转移的现实路径。 李永露的研究具有三段式转移结构:第一段以 HAKE、AlphaPose、数据标注和 benchmark 将研究成果标准化;第二段通过多模态/三维交互理解使其可迁移至视频内容、数字媒体和仿真场景;第三段通过 RHOS 的示教、触觉和人机协同,将“看懂人做什么”转换为“让机器人学习怎么做”。相较直接宣布面向某企业部署,该路径更符合青年 PI 的公开证据,也更能说明其产业价值:提供可被不同机器人、平台或内容智能团队吸收的通用技术层。

人才和场景反馈。 上海创智学院全时导师、上海交大 ACM 班课程教师及 CEAI 组织服务使他同时触达学生、创业者和产业研发人员。其在具身智能活动中持续报告“数据与物理推理”“机器人推理”等议题,说明产业问题已反向影响其研究议程:从早期 HOI 检测准确率,转向数据规模、失败分析、因果/物理规律和长程操作泛化。公开资料未显示其本人担任企业创始人、高管或特定公司首席科学家,因此本报告不将 MVIG 其他教师的创业身份移植给李永露。

六、重要奖项与学术兼职

时间 奖项或学术服务 说明
2019 华为奖学金 博士阶段荣誉
2020 WAIC 云帆奖“明日之星”;华人 AI 新星百人 主页列示;后续于 2023 年获云帆奖“璀璨明星”
2021 百度奖学金(全球十人);上海市优秀博士毕业生;NeurIPS Outstanding Reviewer 反映博士阶段学术与服务能力
2022 吴文俊人工智能科学技术奖优秀博士学位论文奖 博士论文《知识驱动的行为理解》获奖,2023 年颁奖
2022 NeurIPS Top Reviewer 主页列示
2023 WAIC 云帆奖“璀璨明星” 面向 35 岁以下中国 AI 青年学者的荣誉
2024 世界互联网大会领先科技奖 项目为“社会治理智能化的视觉理解共性技术及应用”;团队成果,非个人单独获奖
2024—2025 NeurIPS Area Chair 主页列示为 NeurIPS 2024、2025 AC
2025 ICRA Best Paper Award on Human-Robot Interaction Human-Agent Joint Learning for Efficient Robot Manipulation Skill Acquisition;李永露为唯一通讯作者
2025 蚂蚁 InTech 科技奖;AI100 青年先锋 前者聚焦具身数据与物理推理,后者为 MIT Technology Review China/DeepTech 相关评选
2025 PRCV Contest Chair;CEAI 2025 Organizing Chair 会议组织服务
2026 ICLR Area Chair、CoRL Area Chair;CAAI 具身智能专委会执行委员兼副秘书长 主页列示的持续学术服务

此外,其公开服务列表显示:担任 CVPR(2020—2025)、ICCV、ECCV、NeurIPS、ICLR、ICML、AAAI、CoRL、ICRA/IROS 等会议审稿人,并为 TPAMI、IJCV、TVCG、TCSVT、Pattern Recognition 等期刊审稿。这一服务网络增强了其在计算机视觉、机器学习、机器人和图形学交叉社区中的同行可见度。

七、Connection圈层总结

第一圈层:师承与独立课题组。 卢策吾是直接博士导师和最核心合作者;RHOS 研究生与 MVIG 共同培养学生构成李永露当前最紧密的人才—论文共同体。该圈层以 HAKE 及其后续的物理推理、人机协作和机器人示教为共同语言,特点是“从理解人到让机器人学习人”。

第二圈层:MVIG 与马利庄团队的校内协同。 卢策吾、马利庄、盛斌、易冉、陈玉珑、院旺等构成上海交大视觉、三维媒体和机器智能的横向平台。李永露在其中连接人体行为理解、三维 HOI 重建、数字媒体与具身智能;这使他作为青年教师并非孤立 PI,而是嵌入一个可共享视觉、图形、机器人和公共治理资源的复合团队。

第三圈层:跨机构学术节点。 香港科技大学的邓智强、戴昱翼构成最明确的海外合作节点;中科院自动化所的杨一平、蔡莹皓是其早期研究谱系;Katherine Driggs-Campbell、杨彦超等通过人机协同、导航与具身论文提供国际协作延展。网络结构从“海外短期身份”转向“共同研究问题和共同作者”的连接方式。

第四圈层:开源与产业技术社群。 HAKE、AlphaPose、RHOS 及其数据/代码是其最具扩散性的连接器;百度、华为、WAIC、蚂蚁 InTech、HarmonyOS 开发者活动等构成产业交流节点。其深度不主要体现为企业任职,而在于把可复用视觉—行为—具身数据基础设施提供给产业和开发者生态。

第五圈层:公共应用与学术组织。 世界互联网大会领先科技奖所对应的社会治理视觉理解项目、CAAI 具身智能专委会、VALSE、CEAI、PRCV 等组织角色,使其技术网络延伸到公共治理、国内学术共同体与青年人才培养。

总体判断: 李永露是典型的“MVIG 核心毕业生—回流独立青年 PI”节点。他的网络优势不是单一机构头衔,而是将卢策吾的视觉/具身智能学派、马利庄团队的数字媒体与三维视觉平台、港科大的视觉分析合作及开源开发者社区进行连接。当前独立学生校友网络尚年轻,最应关注的未来指标是 RHOS 首批独立培养学生的毕业去向、具身数据系统的持续开放程度,以及人机协作研究能否在真实机器人平台形成可复现的跨机构成果。

主要公开来源: 李永露个人主页上海交大:李永露获吴文俊优秀博士学位论文奖上海交大:马利庄团队 ICCV 2023 成果及成员构成樊浩威个人主页(MVIG 联合指导经历)上海科技大学讲座简介(职务、学术服务与奖项)