人大信息学院 李锡荣 教授
报告生成时间: 2026年8月
个人主页: https://lixirong.net/ (在线版本有脚本防护,本报告采用其 Wayback Machine 存档核实内容)| 实验室主页:https://ruc-aimc-lab.github.io/ | 学院师资页:http://info.ruc.edu.cn/jsky/szdw/ajxjgcx/jsjkxyjsx1/js2/fe4411ba1320491698c4c7e555d03510.htm DBLP: https://dblp.org/pid/58/5856.html (pid 58/5856,Xirong Li 0001,ORCID 0000-0002-0220-8310) Google Scholar: 官方页面称引用9000余次;个人 Profile ID 未能从公开检索中直接确认,不列具体 ID
一、学者基本信息
李锡荣,中国人民大学信息学院教授、博士生导师,计算机科学与技术系,领导人工智能与媒体计算实验室(AIMC Lab),实验室隶属于数据工程与知识工程教育部重点实验室。主要研究方向为多模态人工智能、多媒体内容理解与检索、计算机视觉、AI辅助诊断(眼科影像智能分析)。在相关领域发表论文百余篇,谷歌学术引用9000多次,入选爱思唯尔2023至2025年"中国高被引学者"榜单。主要奖项包括:CIVR 2010最佳论文奖(一作)、IEEE TMM 2012年度期刊最佳论文奖(一作)、ACM SIGMM 2013年杰出博士论文奖、ACM MM 2016 Grand Challenge Award(通讯作者)、2017中国多媒体大会优秀论文奖(通讯作者)、2022年CCF科技成果奖自然科学二等奖(第4完成人)、2024年CCF科技成果奖科技进步三等奖(第1完成人,项目《基于眼底影像的眼病人工智能辅助诊断技术与系统》)、2024年度中国电子学会硕士学位论文激励计划(优硕)指导教师。曾任国际多媒体建模会议(MMM 2021)、国际多媒体检索会议(ICMR 2026)Program Co-Chair,ACMMM 2021 Grand Challenge Co-Chair,IET Computer Vision编委;现任ACM TOMM、Multimedia Systems等编委。
关于职称与履历的两点澄清:(1)李锡荣现为教授(2022年8月起),2016—2022年为副教授,2012—2016年为讲师,均在人大信息学院;(2)其官方履历与个人主页均未出现新加坡国立大学(NUS)任职经历——从清华硕士毕业(2007.06)到赴荷兰读博(2007.08)再到入职人大(2012.05)之间没有时间空档,DBLP记录中也未见与NUS团队合作论文,"曾任职NUS"的说法未获任何公开一手资料支持。
教育与工作经历(据人大信息学院官方师资页)
| 时间 | 机构 | 职位/学位 | 导师/合作导师 |
|---|---|---|---|
| 2022.08—至今 | 中国人民大学 | 教授 | — |
| 2016.08—2022.08 | 中国人民大学 | 副教授 | — |
| 2012.05—2016.08 | 中国人民大学 | 讲师 | — |
| 2007.08—2012.03 | 荷兰阿姆斯特丹大学 Intelligent Systems Lab Amsterdam(ISLA) | 博士 | Cees G. M. Snoek(官方页面仅列实验室,导师判定依据见第三、四章) |
| 2005.09—2007.06 | 清华大学计算机系 | 硕士 | 公开资料未披露 |
| 2001.09—2005.07 | 清华大学计算机系 | 本科 | — |
研究方向
- 图像/视频搜索与跨模态检索:ad-hoc视频搜索(W2VV++)、文本-视频检索、部分相关视频检索(PRVR)、中文短视频理解(ChinaOpen数据集)
- 多模态深度学习与多模态大模型:多模态大模型幻觉评测(PhD基准)、视频-音效匹配、视觉问答
- 医学影像分析(AI for Ophthalmology):眼底多病种识别(AMD、糖网、早产儿视网膜病变)、眼底图像配准与匹配(SuperRetina)、视网膜血管分割、OCT病灶定位、多模态眼底大模型(Fundus-R1)
- 多媒体内容安全:DeepFake生成与检测、图像篡改检测(MVSS-Net)
二、DBLP数据统计
身份确认与消歧说明
经消歧确认对应DBLP身份为 pid 58/5856(Xirong Li 0001)。DBLP作者检索共有4个"Xirong Li"条目:无后缀的 "Xirong Li"(pid 443/0709,无机构标注)、"Xirong Li 0002"(宜春学院物理科学与技术学院)、"Xirong Li 0003"(武汉大学电子信息学院)。pid 58/5856 条目标注机构为"Renmin University of China"+"PhD 2012, University of Amsterdam",个人网址挂接 lixirong.net,与官方履历完全吻合,消歧难度低。需注意极早期清华时代论文(2005—2008)因历史原因可能散落在无后缀条目中,本报告统计以 pid 58/5856 记录为准。
DBLP发表记录统计
据DBLP记录(截至2026年8月,pid 58/5856),共收录 225条 记录,其中:主编会议论文集(MMM 2021两卷、ICMR 2026)3条;arXiv(CoRR)预印本72条;正式发表论文150篇(2005—2026年)。与官方页面"发表论文百余篇"一致。
按年份分布(正式发表,不含CoRR):
| 时期 | 论文数 | 特征 |
|---|---|---|
| 2005—2007 | 8篇 | 清华硕士阶段:TRECVID评测、图像标注(与MSRA合作) |
| 2008—2012 | 17篇 | 阿姆斯特丹大学博士阶段:社交图像标签相关性、MediaMill TRECVID |
| 2013—2017 | 39篇 | 入职人大初期:图像标注、零样本学习、跨语言检索(COCO-CN) |
| 2018—2022 | 58篇 | 多方向扩张:视频检索(W2VV++、Dual Encoding)、眼底AI、DeepFake |
| 2023—2026 | 28篇 | 多模态大模型时期:MLLM幻觉评测、视频-音效、眼底大模型 |
正式发表的主要会议/期刊分布:ACM Multimedia约20篇、TRECVID评测报告9篇、ICMR 6篇、CVPR 5篇(含2025 Highlight)、ICCV 4篇、MICCAI/OMIA相关5篇、IEEE TPAMI 3篇、IEEE TMM约6篇、IJCAI/SIGIR/AAAI/WWW/ACL Findings/ECCV各1—3篇;中文期刊《软件学报》等亦有发表。
核心合作者统计(基于pid 58/5856全量记录解析,含CoRR)
| 合作者 | DBLP pid | 合作次数 | 合作年份 | 身份/所属机构 |
|---|---|---|---|---|
| Gang Yang(杨刚) | 36/4658-1 | 47 | 2013—2025 | 人大信息学院副教授,AIMC实验室同僚(日本富山大学博士,曾任华为系统架构工程师),全网络最高频合作者 |
| Dayong Ding(丁大勇) | 83/2408 | 31 | 2005—2024 | 清华TRECVID 2005老搭档,2019年后集中于眼底影像方向;现机构公开资料未确认 |
| Cees G. M. Snoek | s/CeesSnoek | 30 | 2008—2024 | 阿姆斯特丹大学教授,博士导师,ISLA/MediaMill团队负责人 |
| Jianfeng Dong(董建锋) | 51/7830 | 29 | 2015—2026 | 浙江工商大学研究员;2015—2016年在人大多媒体计算实验室访问学习,长期紧密合作者 |
| Jieping Xu(许洁萍) | 96/979 | 25 | 2013—2020 | 人大信息学院教师,同事(音乐/音频检索方向) |
| Qijie Wei(魏启杰) | 205/3935 | 21 | 2016—2026 | 博士生(推测),眼底影像方向(SuperRetina等) |
| Aozhu Chen(陈坳珠) | 232/0013 | 21 | 2020—2025 | 博士生(2019级,2024年答辩,ChinaOpen一作) |
| Juan Cao 0001(曹娟) | 75/2820-1 | 19 | 2018—2025 | 中科院计算所研究员,多媒体内容安全方向(DeepFake/篡改检测) |
| Fan Hu(胡帆) | 71/7046 | 18 | 2021—2025 | 博士生(2025年5月答辩,论文《跨模态检索的特征融合方法研究》) |
| Chaoxi Xu | 220/3928 | 17 | 2017—2022 | 博士生(已毕业,推测),W2VV++/Dual Encoding一作 |
| Qin Jin(金琴) | 47/2670 | 17 | 2013—2016 | 人大信息学院教授,AI·M³实验室负责人,同事 |
| Weihong Yu | 135/5444 | 16 | 2018—2026 | 学生/团队成员(推测) |
| Xun Wang 0007 | 82/1331-7 | 15 | 2018—2026 | 合肥工业大学王萌团队成员(推测) |
| Jianchun Zhao | 245/7475 | 15 | 2019—2023 | 团队成员(推测),眼底影像方向 |
| Ruixiang Zhao(赵瑞祥) | 257/9470 | 14 | 2023—2026 | 学生(推测),视频检索/电商视频方向 |
| Youxin Chen(陈有信) | 152/8103 | 14 | 2018—2024 | 北京协和医院眼科教授、主任医师(曾任眼科主任),医疗合作核心 |
| Xixi He | 150/5274 | 12 | 2014—2024 | 团队成员(推测),早期音频概念标注方向 |
| Zijie Xin | 386/2059 | 11 | 2024—2026 | 学生(推测),音乐落地/流媒体视频理解 |
| Jun Wu 0022 | 20/3894-22 | 11 | 2019—2022 | 合作者(机构未确认),眼底相机相关医学影像研究 |
| Marcel Worring | 35/4613 | 10 | 2008—2013 | 阿姆斯特丹大学教授,ISLA,博士阶段团队核心成员 |
| Zhanhui Kang(康战辉) | 157/6432 | 9 | 2023—2025 | 腾讯专家,产业合作核心(见第六章) |
| Arnold W. M. Smeulders | 15/5400 | 9 | 2008—2016 | 阿姆斯特丹大学教授(后任职乌特勒支大学/拉德堡德大学),ISLA元老 |
| Kaibin Tian(田凯彬) | 289/6123 | 9 | 2021—2026 | 学生(推测) |
| Fangming Zhou | 54/9135 | 9 | 2020—2024 | 合作者(推测属中科院计算所曹娟团队) |
| Jiazhen Liu(刘家真) | 39/7764 | 6 | 2022—2026 | 硕士生(2021级,2024届优硕,SuperRetina/GeoFormer一作) |
| Jingyu Liu | 43/6883 | 7 | 2024—2026 | 学生(推测),CVPR 2025 PhD基准一作(官网新闻署名Jiazhen Liu,疑为同一人或DBLP署名差异,未完全确认) |
| Ruobing Xie(谢若冰)、Xingwu Sun(孙兴武) | 178/8590 / 228/5449 | 各6 | 2024—2025 | 腾讯(微信/腾讯搜索方向,推测) |
| Dong Wang 0022、Jianmin Li 0001、Bo Zhang 0010(张钹院士) | — | 各7 | 2005—2009 | 清华大学计算机系,硕士阶段合作团队 |
三、博士教育背景
博士阶段(阿姆斯特丹大学 ISLA,2007.08—2012.03)
李锡荣在荷兰阿姆斯特丹大学 Intelligent Systems Lab Amsterdam(ISLA,后并入 UvA 计算机科学系多媒体分析组)攻读博士学位。官方师资页仅写明实验室名称未写导师;综合以下一手证据,其博士导师可判定为 Cees G. M. Snoek 教授(现阿姆斯特丹大学教授、多媒体智能领域著名学者,QUVA深度视觉实验室创始人之一):
- DBLP记录显示两人合作30次(含CoRR),时间从2008年(博士入学次年)延续到2024年,是博士阶段之后仍持续的最紧密海外合作;
- 博士期间深度参与 Snoek 领导的 MediaMill 团队 TRECVID 评测(2008、2011年系统论文),回国后又以"University of Amsterdam and Renmin University"联队形式连续参加 TRECVID 2016、2017;
- 其博士成果获 ACM SIGMM 2013年杰出博士论文奖(该奖授予多媒体领域全球最佳博士论文)。
博士阶段代表性成果:
- Learning Social Tag Relevance by Neighbor Voting(WWW 2009 / CIVR 2010扩展版):社交图像标签相关性学习的开创性工作,获 CIVR 2010 最佳论文奖(一作)
- Annotating Images by Mining Image Search Results(IEEE TPAMI 2008):与微软亚洲研究院合作的基于搜索结果挖掘的图像标注方法
- Socializing the Semantic Gap: A Comparative Survey on Image Tag Assignment, Refinement and Retrieval(IEEE TMM 2012):图像标签综述,获 TMM 2012年度期刊最佳论文奖(一作)
- 2011年获国家优秀自费留学生奖学金(Chinese Government Award for Outstanding Self-Financed Students Abroad)
同期ISLA团队成员(合作者)包括 Marcel Worring、Arnold W. M. Smeulders、Dennis C. Koelma 等,构成了其延续至今的欧洲学术网络。
硕士阶段(清华大学计算机系,2005.09—2007.06)
硕士导师公开资料未披露。DBLP早期记录显示其2005—2007年密集参与清华大学 TRECVID 评测团队(合作者含张钹院士、李建民教授、王东等)及微软亚洲研究院合作项目(与马维英 Wei-Ying Ma、张磊 Lei Zhang、王鑫靖 Xin-Jing Wang 合作发表 TPAMI 2008、ACM MM 2007 论文),研究主题为视频检索与图像标注——这直接铺垫了他赴阿姆斯特丹攻读博士的方向选择。
四、导师/师承分析
师承谱系
Arnold W. M. Smeulders / Marcel Worring(阿姆斯特丹大学 ISLA)
└── Cees G. M. Snoek(博士,阿姆斯特丹大学,2005)
└── 李锡荣(博士,阿姆斯特丹大学,2012)
├── 直接指导(人大,博士/硕士生)
│ ├── 董建锋(访问学生2015—2016,现浙江工商大学研究员,CCF青年人才托举工程2023)
│ ├── 陈坳珠(博士2024届,ChinaOpen一作)
│ ├── 胡帆(博士2025届)
│ ├── 魏启杰(博士生,眼底影像方向)
│ └── 刘家真(硕士2024届,2024中国电子学会优硕)
└── 长期合作共建
├── 杨刚(人大副教授,同事型合作者,47次合作)
└── Cees Snoek(延续至2024年的师生合作)
说明:Snoek 的博士导师为阿姆斯特丹大学 ISLA 的 Marcel Worring 与 Arnold W. M. Smeulders(ISLA创始人、多媒体检索领域奠基人之一),因此李锡荣的学术谱系可上溯至阿姆斯特丹多媒体检索学派第二代。李锡荣与 Snoek 的师生合作在其毕业后仍延续13年(至2024年 TMM 论文 "Beyond Coarse-Grained Matching in Video-Text Retrieval"),这种"博士导师终身合作"模式是其国际网络的重要特征。
培养学生网络
李锡荣2012年入职人大后逐步建立AIMC实验室,培养学生中已形成外溢节点:
| 学生 | 身份确认 | 现状/去向 |
|---|---|---|
| 董建锋(Jianfeng Dong) | 浙江工商大学官网/百科确认:2015.05—2016.10在人大多媒体计算实验室访问 | 浙江工商大学研究员、硕导,可视媒体计算团队负责人之一,2023年中国科协青年人才托举工程;与李锡荣合作29次(2015—2026),是"访问学生→独立学者→长期合作者"的典型案例 |
| 陈坳珠(Aozhu Chen) | 学院新闻确认2019级博士生、导师李锡荣 | 2024年11月博士答辩(论文《面向开放场景的跨模态视频检索》),ChinaOpen数据集一作 |
| 胡帆(Fan Hu) | 答辩公示确认导师李锡荣 | 2025年5月博士答辩(论文《跨模态检索的特征融合方法研究》) |
| 刘家真(Jiazhen Liu) | 学院新闻确认2021级硕士、师从李锡荣 | 2024年度中国电子学会优硕;SuperRetina(ECCV 2022)、GeoFormer(ICCV 2023)、GeoFormer-pose(CVPR 2024)一作,获2024年港科大红鸟奖学金 |
| 王子玥 | 学院/公众号专访确认2021级硕士 | ACM MM 2022一作(视频检索否定理解),北京市优秀毕业生 |
| 魏启杰、赵瑞祥、田凯彬、辛子杰、Jingyu Liu、余伟宏、蓝邦翔等 | 据合作频次与新闻推断 | 在读/近期毕业团队成员(推测) |
五、现单位团队与核心合作者
AIMC实验室(人工智能与媒体计算实验室)
据信息学院官网科研团队页,AIMC Lab 隶属于数据工程与知识工程教育部重点实验室和计算机系,专职教师3位(博导1人、硕导2人)、学生近20人,师资页挂接 李锡荣(教授)与杨刚(副教授)。实验室官方列出的四个特色方向:眼科人工智能(眼底解剖结构分析与语义理解,"相关算法已集成到眼底影像人工智能辅助诊断系统,服务数百万患者")、任意样本学习(零样本/小样本)、DeepFake视频生成与检测、短视频智能分析与检索。实验室主页为 ruc-aimc-lab.github.io,官方称与荷兰、意大利、捷克、日本等多个国际团队及中科院计算所等国内单位开展合作。
需要说明:信息学院计算机系另设"多媒体计算实验室"(金琴教授的 AI·M³ 实验室),两者是并行的不同实验室;两者在2013—2016年有密集合作(金琴与李锡荣合作17次),并曾联合组队参加 ImageCLEF、MediaEval 等评测。
学院内同事合作者
| 姓名 | 身份 | 合作次数 | 合作年份 | 备注 |
|---|---|---|---|---|
| 杨刚 | AIMC实验室副教授 | 47 | 2013—2025 | 全网络最高频;两人共同构成AIMC双核心,杨刚侧重演化计算/神经网络与眼底影像工程化 |
| 金琴 | AI·M³实验室教授 | 17 | 2013—2016 | 多媒体评测时期联队(ImageCLEF/MediaEval),后各自独立发展 |
| 许洁萍 | 信息学院教师 | 25 | 2013—2020 | 音乐/音频方向,多媒体与语音交叉时期的合作 |
| 梁循 | 信息学院教授 | 少量 | 2023 | ChinaOpen论文合作者 |
| 杜小勇 | 信息学院教授(前院长) | 6 | 2013—2015 | 早期图像标注方向论文 |
跨机构核心合作者
| 合作者/团队 | 机构 | 合作次数 | 合作年份 | 领域 |
|---|---|---|---|---|
| 陈有信 | 北京协和医院眼科 | 14 | 2018—2024 | AMD多模态分类、OCT病灶定位、多中心AI临床验证(npj Digital Medicine、BJO等) |
| 王萌(Meng Wang)团队(杨勋 Xun Yang、Xun Wang 等) | 合肥工业大学(杨勋现中国科学技术大学) | 累计约15次 | 2018—2026 | 视频检索(PRVR、Dual Encoding、TPAMI/IJCAI系列) |
| 曹娟团队(盛强、周方明、陈欣茹等) | 中科院计算所 | 累计约20次 | 2018—2025 | 多媒体内容安全:图像篡改检测(MVSS-Net, TPAMI 2023)、DeepFake |
| 董建锋 | 浙江工商大学 | 29 | 2015—2026 | 跨模态检索(Dual Encoding、COCO-CN、ACM MM 2016 Grand Challenge) |
| Kaiwei Wang(王凯威) | 浙江大学(光电工程方向,据论文主题判断) | 4 | 2019—2020 | 眼底相机成像与病变分割(OCT分类、视盘视杯分割) |
| 康战辉团队(谢若冰、孙兴武、连凤宗、谢润荃等) | 腾讯 | 累计约20次 | 2023—2025 | MLLM幻觉评测、视频检索、电商视频(详见第六章) |
| Cees G. M. Snoek | 阿姆斯特丹大学 | 30 | 2008—2024 | 博士导师,视频-文本检索的持续合作 |
| 陈泉、蒋鹏 | 中山大学(推测) | 各6 | 2024—2026 | 电商视频音效匹配(AAAI 2025)、音乐落地(ICCV 2025) |
六、业界合作关系深度分析
李锡荣的产学研合作呈现"多媒体检索起家、医疗AI落地、大模型时期绑定腾讯"的三段式特征。
1. 腾讯(核心产业合作方)
合作深度:★★★★☆(重点研究计划资助+多篇顶会联合论文+数据集共建)
- 资助确认:学院新闻明确 ChinaOpen(ACM MM 2023)研究"受国家自然科学基金面上项目(62172420)、2022腾讯下一代广告系统犀牛鸟重点研究计划、中国人民大学校级计算平台支持"。
- 联合论文(康战辉、谢若冰、孙兴武、连凤宗、谢润荃等署名):
- CVPR 2025(Highlight,13008投2878录,仅13%入选Highlight):PhD——多模态大模型视觉幻觉评测基准(14k日常图像+750张反常识图像,10万+VQA三元组),数据已在 HuggingFace 开放;
- ICCV 2025:Hybrid-Tower——文本-视频检索的细粒度伪查询交互生成;
- ACL 2025 Findings:基于幻觉目标直接偏好优化的MLLM幻觉缓解;
- ACM MM 2023:ChinaOpen——基于B站数据构建的中文短视频开放场景多模态数据集(康战辉、梁循参与)。
- 历史渊源:2015年即有"RUC-Tencent at ImageCLEF 2015"联队论文,腾讯是其合作历史最长的企业之一。
- 合作主题从早期评测任务演进到当前的MLLM评测与视频检索,与腾讯(微信搜索/下一代广告系统)的业务方向高度对接。
2. 医疗AI落地(协和医院+眼底相机产业链)
合作深度:★★★★★(十余年持续合作+临床验证+国家级奖项)
- 北京协和医院陈有信教授团队:2018年起合作14篇论文,覆盖AMD双流CNN分类(J-BHI 2022)、OCT病灶半监督定位、ROP多示例学习、超广角眼底病变识别等;2024年发表于 npj Digital Medicine 的多中心研究证实其深度学习系统辅助低年资医师读片可将诊断一致率从72.9%提升至84.9%。李锡荣多次受邀在北京医师协会眼科专科医师分会年会做AI眼底报告。
- 2024年CCF科技进步三等奖(第1完成人):《基于眼底影像的眼病人工智能辅助诊断技术与系统》——实验室官方称"相关算法已集成到眼底影像人工智能辅助诊断系统,服务数百万患者"(具体承接企业名称公开资料未披露)。
- 浙江大学Kaiwei Wang团队(眼底相机光学成像)及Jun Wu等合作者:面向便携式/超广角眼底相机的算法工程化(MICCAI 2022 OMIA系列:眼底照片缺陷修复、广域相机模板掩码融合、角膜共聚焦显微镜神经分割)。
- 在研国家自然科学基金面上项目《广域视觉表征学习与眼底病智能诊断应用》(2025年获批):面向5种眼底影像的基座模型与跨设备迁移。
3. 微软亚洲研究院(硕士时期)
硕士阶段(2005—2007)即与MSRA的马维英、张磊、王鑫靖等合作,产出 TPAMI 2008《Annotating Images by Mining Image Search Results》等经典图像标注论文,这段经历是其学术网络的起点之一。
4. 其他产业合作线索
- TKDE 2025(AEFS:深度推荐系统的自适应早期特征选择):合作者 Gaofeng Lu、Jun Chen、Chaonan Guo、Yuekui Yang 等,DBLP未标注机构,从主题与作者组合推测为产业界研究团队,具体归属未确认;
- AAAI 2025(D&M:电商视频音效增强):基于某电商视频创作平台构建SFX-Moment大规模数据集,Minquan Wang、Ye Ma、Bo Wang等合作者疑为产业界人士(未确认);
- 国际评测战绩(团队负责人身份):TRECVID 2018 Ad-hoc Video Search 与 Video-to-Text 双任务冠军、ACM MM 2018 Hulu内容视频相关性预测挑战赛优胜、ACM MM 2015 MSR Bing图像检索挑战赛冠军。
5. 产学研模式总结
李锡荣的产业合作可概括为"评测驱动→系统落地":其团队长期以TRECVID/ImageCLEF等国际评测为练兵场(个人参赛史跨越2005—2018年,横跨清华、阿姆斯特丹、人大三个时期),在视频检索和眼底AI两个方向积累了系统级技术,最终分别对接腾讯的多模态大模型/视频业务与协和医院的临床诊断系统,并以第一完成人身份获得CCF科技进步奖。医疗方向的"医院+高校+器械工程"三方协作结构(协和临床+人大算法+浙大光学/便携相机工程)是其区别于纯多媒体学者的显著特征。
七、Connection 圈层总结
第一圈层(实验室双核与博士导师): 杨刚(47次合作,全网络最高频)是其任职人大13年来最紧密的合作者,两人构成AIMC实验室"李锡荣(多媒体检索/眼底AI算法)+杨刚(演化计算/神经网络/工程化)"的双核心结构。Cees G. M. Snoek(30次,2008—2024)作为博士导师,是延续16年的海外学术锚点,维系着与阿姆斯特丹学派的持续连接(TRECVID联队、TPAMI/TMM联合发表)。
第二圈层(跨机构学术同盟): 形成了三个稳定同盟——合肥工业大学王萌团队(视频检索方向,PRVR/Dual Encoding系列,累计约15次)、中科院计算所曹娟团队(多媒体内容安全,MVSS-Net/DeepFake,累计约20次)、浙江工商大学董建锋(由访问学生成长为独立PI的"师门外溢"节点,29次)。医疗侧的协和医院陈有信团队(14次)则是其医工交叉的临床支柱。
第三圈层(自主培养团队): AIMC实验室学生近20人,已毕业节点包括陈坳珠(博士2024届)、胡帆(博士2025届)、刘家真(优硕2024届)、王子玥等;在读核心成员有魏启杰、赵瑞祥、田凯彬、辛子杰、Jingyu Liu、余伟宏、蓝邦翔等(推测)。团队2024—2026年在CVPR(含Highlight)、ICCV×3、TPAMI、TMM、MICCAI、AAAI、ACL Findings等持续产出,研究方向集中在视频检索、MLLM评测、眼底AI三大主线。
第四圈层(产业与临床网络): 腾讯(康战辉团队,犀牛鸟重点研究计划+CVPR/ICCV/ACL联合论文+ChinaOpen数据集)是最重要的企业合作方;医疗方向通过协和医院、浙大眼底相机团队形成"临床+光学+算法"的落地链条,支撑其2024年CCF科技进步三等奖(第1完成人)与"服务数百万患者"的系统部署。微软亚洲研究院则是其硕士时期(2005—2007)的网络起点。
产出规模与学术影响: DBLP正式发表150篇(含CoRR共222篇论文记录),谷歌学术引用9000余次,爱思唯尔中国高被引学者(2023—2025连续三年)。研究方向从博士阶段社交图像标签(2008—2012),经视频检索与评测时代(2013—2018),扩展至眼底AI(2018至今)与多模态大模型评测(2023至今),形成"多媒体检索+医学影像"双主线。学术服务方面,MMM 2021与ICMR 2026两任Program Co-Chair、ACMMM 2021 Grand Challenge Co-Chair、ACM TOMM/Multimedia Systems编委,在多媒体社区拥有较高的组织性影响力。
八、数据来源与局限性说明
本报告主数据来自DBLP官方作者消歧记录(pid 58/5856)的全量XML解析(225条记录,含合著频次、年份、机构标注),并结合以下一手来源:
- 中国人民大学信息学院官方师资页(李锡荣):教育经历、工作经历、奖项、任职、联系方式
- 信息学院官网科研团队页(人工智能与媒体计算实验室/AIMC):实验室定位、师资、特色方向、合作单位
- 信息学院官网科研团队页(多媒体计算实验室/AI·M³)及金琴师资页:确认两实验室的并行关系
- 信息学院官网新闻:ChinaOpen(ACM MM 2023)受腾讯犀牛鸟资助、CVPR 2025 Highlight录用详情、刘家真优硕、陈坳珠/胡帆答辩公示、国家自然科学基金获批项目
- 个人主页 lixirong.net 的 Wayback Machine 存档(2025年9月快照,profile页):英文简历、奖项全集(含2011国家优秀自费留学生奖学金、TRECVID 2018冠军、MSR Bing挑战赛冠军等)、编辑部任职
- 杨刚(人大师资页)、董建锋(浙江工商大学/百科)、陈有信(协和医院官网)等合作者的官方页面
- CCF科技成果奖公开报道(2024年度获奖名单及项目介绍)
主要局限性:
- NUS任职说法未获证实:任务背景中提及"曾任职新加坡国立大学",但官方履历(清华硕士2007.06毕业后即赴荷读博,2012.03博士毕业、2012.05入职人大)无任何时间空档,个人主页存档与DBLP均无NUS记录,也未检索到与NUS团队(如Tat-Seng Chua组)的合作论文——本报告判定该说法公开资料未披露/未获证实;
- 博士导师为推断结论:官方师资页仅写"阿姆斯特丹大学 Intelligent Systems Lab Amsterdam"未署导师姓名,Snoek为导师的判定基于30次合作、MediaMill团队参与、SIGMM博士论文奖等强间接证据,未找到直接署名的一手文献;
- 清华硕士阶段导师公开资料未披露,早期清华/MSRA合作者(王东、李建民、张钹、马维英、张磊等)以合作者身份呈现,未断言师承关系;
- DBLP记录不含作者角色信息,学生/团队成员身份多依据学院新闻、答辩公示推断,标注"推测"处存在不确定性;"Jingyu Liu"与"Jiazhen Liu"(刘家真)在CVPR 2025论文上的署名差异未能完全确认是否同一人;
- 部分合作者(Dayong Ding、Jun Wu、Gaofeng Lu/Yuekui Yang等)的当前机构在DBLP与公开检索中未标注,相关归属描述为保守推测;眼底AI辅助诊断系统的落地承接企业名称公开资料未披露;
- lixirong.net 在线版本受脚本防护无法直接抓取,采用2025年9月Wayback存档(内容约更新至2024—2025年,其中"引用5000+/H指数35"为旧数据,与官方页面"引用9000+"不一致,本报告以官方页面为准);Google Scholar个人Profile ID未能确认,引用数据引自官方师资页。