跳转至

USTC-VIMC 李厚强 教授

报告生成时间:2026年8月21日
个人主页:李厚强(备用主页:http://staff.ustc.edu.cn/~lihq/ )
所属团队:中国科学技术大学人工智能与数据科学学院 / 多媒体计算与通信教育部-微软重点实验室(MCC)/ 李厚强-周文罡课题组


一、学者基本信息

项目 内容
姓名 李厚强(Houqiang Li)
出生年份 1969年3月
职称 教授、博士生导师(2007年12月起任教授)
现职单位 中国科学技术大学人工智能与数据科学学院(原信息科学技术学院电子工程与信息科学系,"六系")
行政职务 多媒体计算与通信教育部-微软重点实验室(MCC)主任;曾任信息科学技术学院副院长(官方教师主页职务栏仍作此记载)
学术头衔 IEEE Fellow(2021年当选)、国家杰出青年科学基金获得者(2013)、长江学者特聘教授(2017)、"万人计划"科技创新领军人才
联系方式 lihq@ustc.edu.cn
研究方向 视频处理与通信、视频编码与国际标准(AVS/JCTVC等)、计算机视觉与模式识别、视频理解、多模态大模型、人工智能与机器博弈、多媒体信息检索
学术产出 发表期刊会议论文300余篇,授权发明专利60余项,多项技术提案被视频编码国际/国家标准采纳
指导学生 与周文罡教授共同运行"李厚强、周文罡课题组";曾四次获中国科学院优秀导师奖(2013–2016)

二、教育背景与职业履历

教育背景(全部在中国科学技术大学电子工程与信息科学系完成):

  • 1987/09–1992/07:中国科学技术大学电子工程与信息科学系,学士(中科大8706级校友);
  • 1994/09–1997/07:中国科学技术大学电子工程与信息科学系,硕士;
  • 1997/09–2000/10:中国科学技术大学电子工程与信息科学系,博士(信号与信息处理方向)。

关于其博士学位导师,公开渠道(教师官方主页、校友会介绍、百度百科词条等)均未披露具体姓名,本报告无法核实,不作推断。需要澄清的是:李厚强并非吴枫的博士生。吴枫1999年才于哈尔滨工业大学获得博士学位(导师为高文院士),1999–2014年在微软亚洲研究院任职,2014年方正式加入中国科学技术大学任信息学院执行院长;而李厚强2000年即在中科大完成博士学业,二人属同代学者、长期合作共事关系而非师生关系。网络上"李厚强是吴枫院士学生"的说法缺乏依据。

职业履历(全部在中国科学技术大学):

  • 2000/11–2002/11:中国科学技术大学电子科学与技术博士后流动站,博士后;
  • 2002/12–2003/06:讲师(一说2002年12月出站留校任副教授,不同来源对早期职称记载略有出入);
  • 2003/07–2007/12:副教授;
  • 2007/12–至今:教授、博士生导师;
  • 曾任/现任多媒体计算与通信教育部-微软重点实验室(MCC)副主任、主任,信息科学技术学院副院长。实验室由教育部与微软亚洲研究院共建,早期由吴枫(现任中科大副校长,2025年当选中国工程院院士,11月21日公布)执掌,李厚强后接任主任。随着学校学科调整,其人事关系现已划入新组建的人工智能与数据科学学院(2025年前后学院重组;同课题组周文罡主页显示其自2026年5月起隶属该校"School of Artificial Intelligence and Data Science")。

学术轨迹小结:李厚强是典型的"一校终身"型学者,从中科大本科到教授的全部训练与任职均在六系完成。研究主线经历了从传统视频编码与通信(H.264/AVS时代,参与JCTVC、JVT、MPEG、AVS标准化)→ 深度学习驱动的视频压缩 → 计算机视觉与视频理解(跟踪、检索、手语识别、视觉定位)→ 多模态大模型与强化学习/机器博弈的演进,近年与周文罡联合课题组的研究明显向多模态大模型可信性、具身智能等前沿方向拓展。

三、学生培养情况

李厚强长期与周文罡(其2006–2011年间的博士生)联合指导研究生,构成"李厚强、周文罡课题组"。以下列举代表性学生(含联合指导),部分去向以公开信息为准:

1. 周文罡(中国科学技术大学教授,博士生/学术传承人)

2006–2011年在中科大六系攻读博士,导师为李厚强,是李厚强培养的最具影响力的学生。博士毕业后赴美国德州大学圣安东尼奥分校(UTSA)从事博士后研究(合作导师田奇),2013年回校任教,2018年12月晋升教授。国家优秀青年科学基金获得者(2018)、中国科学院百篇优秀博士学位论文奖(2013)。现为李厚强-周文罡课题组的共同负责人,研究覆盖计算机视觉、多模态检索、手语识别、强化学习与具身智能,与李厚强联合署名论文数量在其合作者中居首。

2. 王宁(工业界算法研究员,联合培养博士生)

2016年本科毕业于天津大学,保研至中科大六系,导师为周文罡与李厚强,2021年博士毕业,博士论文《面向高效视频目标跟踪的模型学习、压缩与集成》获2021年度中国图象图形学学会(CSIG)优秀博士学位论文奖。博士期间以第一作者发表顶会顶刊论文10篇(含CVPR×3、IJCV、TIP×2等)。毕业后进入工业界从事算法研发(其本人在知乎实名回答中确认"目前在工业界",具体单位未公开披露)。

3. 张宗萌(课题组博士研究生/近年代表学生,多模态大模型方向)

课题组近年最活跃的学生之一,研究方向为检索增强与大模型可信性。早期(2021年前后)曾与山东大学聂礼强、宋雪萌团队合作发表时序语言定位论文(IEEE TIP 2021一作),后转入中科大课题组。以第一作者在ICML 2024发表检索增强大语言模型可信对齐工作(Trustworthy-Alignment),并在ICML 2025以第一作者发表《Robust Multimodal Large Language Models Against Modality Conflict》(据媒体报道发表于ICML 2025,与华为赵洁合作,见4.3节)。

4. 邓家俊(博士毕业生,视觉定位方向)

课题组视觉定位(Visual Grounding)方向的代表学生。代表工作为TransVG系列:TransVG(ICCV 2021)与TransVG++(TPAMI 2023,与OPPO研究院欧阳万里等合作),是该领域的代表性成果,开源代码被广泛使用。其具体现任职单位未获公开资料确认。

5. 魏承承(博士毕业生,手语识别方向)

课题组连续手语识别(CSLR)方向的核心学生,与李厚强、周文罡、赵鉴等合作发表论文与多项发明专利(如基于强化学习/语法分类器的连续手语识别方法),代表性论文包括IEEE TCSVT 2021一作论文。毕业后去向未见于公开资料。

6. 赵鉴(博士毕业生,手语识别与多智能体强化学习)

博士期间研究方向横跨连续手语识别与多智能体强化学习,以第一作者在IEEE Transactions on Games(2022)发表CTDS多智能体强化学习工作,并参与多项手语识别专利。毕业后去向未见于公开资料。

7. 施余峰(课题组博士生,强化学习/智能博弈方向)

强化学习方向学生,参与J-Mac等泛化性强化学习研究(TPAMI 2025在投/录用),并作为"MCC智能空中博弈"团队成员(成员:施余峰、束维德、冯加恒、姜羿、王勇)在李厚强、周文罡指导下参加2023年第七届全国兵棋推演大赛"智能空中博弈算法挑战赛",获科目一冠军、科目二季军等奖项,体现课题组在军事智能/机器博弈方向的布局。

四、学术合作网络

4.1 校内核心合作圈(MCC实验室与六系)

李厚强的校内网络以MCC实验室为轴心,呈"吴枫—李厚强—周文罡—青年梯队"的代际结构:

  • 吴枫(中科大副校长,2025年当选中国工程院院士):长期合作者与实验室前任负责人。二人共同署名论文众多(视频编码、360度视频压缩、插帧等),并同为2015年国家自然科学奖二等奖"图像非均匀计算理论与方法"完成人(吴枫排名第1、李厚强排名第2,其他完成人为汪萌、刘东、洪日昌)。吴枫2014年从微软亚洲研究院回归执掌信息学院后,李厚强长期担任学院副院长与实验室主任,是其实验室层面的主要接棒人。
  • 周文罡:学生、现课题组共同负责人,是李厚强学术网络中最紧密的协作节点(详见第三章)。
  • 刘东、李力:视频编码/压缩方向的青年骨干同事,与李厚强频繁联合署名(如分数像素运动补偿、点云压缩、可学习图像压缩等),共同支撑MCC在智能视频编码方向的传统优势。
  • 洪日昌、汪萌:与李厚强合作密切的合肥系学者(均曾属中科大体系,后主要在合肥工业大学任职),是2015年国家自然科学奖获奖团队共同完成人。
  • 六系其他协作教师还包括俞能海、李卫平、查正军(专利合作)、张燕咏(TransVG++合作者)等。

4.2 跨机构学术合作

  • 田奇(Qi Tian,华为云):周文罡博士后的合作导师,长期与李厚强、周文罡保持三方联合署名(跟踪、检索、哈希、DocScanner等大量论文),是连接中科大VIMC与华为云AI研究体系的桥梁人物。
  • 欧阳万里(Wanli Ouyang,悉尼大学/OPPO研究院):视觉定位方向的长期合作者(TransVG++、行人重识别等)。
  • 梅涛、Tao Mei(微软亚洲研究院系):早期即与李厚强联合发表CVPR 2015等论文;梅涛后创办智象未来。
  • Guo-Jun Qi(马里兰大学/OPPO):GAN与表征学习方向合作者。
  • 其他长期合作者:Chang Wen Chen(纽约州立大学布法罗分校,早期H.264合作)、Yan Lu(微软亚洲研究院)、Ting Yao/Yingwei Pan(MSRA系)、以及山东大学聂礼强团队(经由学生张宗萌)等。
  • 标准化圈子:作为JCTVC/JVT/MPEG/AVS成员,与高文、马思伟等国内视频编码标准圈的学者同属一个学术共同体(注:此为领域共同体层面的关联,未见直接的紧密合作记录)。

4.3 与华为的合作(跨机构产业合作主线)

  • ICML 2025多模态冲突论文:2025年发表《Robust Multimodal Large Language Models Against Modality Conflict》(arXiv:2507.07151),由中科大人工智能与数据科学学院张宗萌、周文罡、李厚强与华为技术有限公司赵洁组成的研究团队完成。该工作提出模态冲突(Modality Conflict)概念及MMMC数据集,研究多模态大模型在视觉与语言输入冲突时的幻觉问题,是课题组与华为在大模型可信性方向的标志性合作。
  • 更早的华为合作:其ICML 2024论文(检索增强LLM可信对齐,一作张宗萌)作者中亦包含华为研究人员(Xiang Qi、Peng Zhang);此外公开履历显示李厚强早年即承担"华为基金项目"及"基于机器学习的下一代视频压缩编码技术研究"等委托研发项目,其教师主页科研项目列表中的多项"委托开发合同"(深度学习增强混合架构视频压缩编码等)与视频编码方向的企业需求高度吻合。
  • 华为云侧接口:田奇(华为云)与课题组的长期联合发表(见4.2)构成另一条华为合作通道。

五、业界合作关系深度分析

5.1 与华为:从视频编码到大模型可信性的长周期合作

李厚强与华为的合作呈现明显的阶段性演进:早期以视频编码横向课题为主(华为基金、"下一代视频压缩编码"委托研究),与其本人JCTVC/AVS标准化背景直接对接;中期通过田奇在跟踪、检索等视觉方向持续联合发表;近年则升级为大模型可信性方向的高水平联合研究(ICML 2024、ICML 2025,华为侧对接人为赵洁)。这条"标准—编码—视觉—大模型"的演化路径,说明华为与其课题组保持了跨越二十年的多层次合作,且华为侧人员深度参与论文署名,属实质性联合研究而非单纯资助关系。

5.2 微软、讯飞及其他企业合作

  • 微软(微软亚洲研究院):合作最深的企业机构。MCC实验室本身即"教育部-微软"共建;李厚强长期主持实验室年度运营经费项目;2021年与微软亚洲研究院谢幸等共同主办AIX前沿技术论坛(吴枫致辞);多名合作者(吴枫、梅涛、Yan Lu、Ting Yao等)出自MSRA体系。
  • 科大讯飞:课题组手语识别方向的横向合作方(周文罡主持"基于多元图像信息的手语识别技术研发"横向项目,2014–2016)。
  • 诺基亚(Nokia):早期国际合作项目方(2000年代视频编码国际合作)。
  • 其他:教师主页科研项目列表显示"机器视觉技术联合创新项目""图像视频分析技术研发(一期)"等多项企业委托合同,虽未逐一披露委托方,但与华为、头部视觉企业的合作方向一致。总体而言,李厚强的产业合作以视频编码/视觉技术的委托研发为基本盘,近年向多模态大模型联合研究延伸。

六、重要奖项与学术兼职

重要奖项:

  • 国家自然科学奖二等奖(2015,"图像非均匀计算理论与方法",排名2);
  • 国家技术发明奖二等奖(2019,"移动高清视频编码适配关键技术",排名2);
  • 安徽省科学技术奖一等奖(自然科学类,2012,"大规模图像数据处理的理论方法",排名1);
  • 国家杰出青年科学基金(2013);长江学者特聘教授(2017);"万人计划"科技创新领军人才;IEEE Fellow(2021年当选);
  • 中国科学院优秀导师奖(2013–2016连续四年);中国科学院朱李月华优秀教师奖(2013、2014、2016);
  • 国际会议最佳论文奖:IEEE VCIP 2012、ACM ICIMCS 2012、ACM MUM 2011;MobiMedia 2009最佳学生论文奖。

(注:网络上偶见"李厚强获国家优青"的说法不准确,其获得的是更高层级的国家杰青;其学生周文罡才是国家优青获得者。)

学术兼职:

  • IEEE Transactions on Multimedia 副编辑(2020–);
  • IEEE Transactions on Circuits and Systems for Video Technology 副编辑(2010–2013);
  • ICME 2021 大会共同主席;VCIP 2010 程序委员会共同主席;
  • IEEE电路与系统学会视觉信号处理与通信技术委员会(VSPC TC)委员、多媒体信号处理技术委员会(MMSP TC)委员;
  • 中国电子学会"网络多媒体"专委会副主任委员;
  • 国际/国内视频编码标准化组织 JCTVC、JVT、MPEG、AVS 成员。

七、Connection圈层总结

李厚强的关系网络呈现"一校为体、产业为翼"的结构,可分为四个圈层:

  1. 学术传承圈(最内圈):以MCC实验室为载体。吴枫与李厚强为同侪合作者(非师生关系,共同构成获奖共同体,两项国家级二等奖均与吴枫团队合作完成),李厚强接掌MCC实验室;向下则是李厚强→周文罡的师承(周文罡为李厚强指导的博士),二人以"李厚强、周文罡课题组"形式实现双导师联合培养模式(王宁为明确的联合指导案例;张宗萌、邓家俊等的指导归属以课题组联合署名为准),学生群体又进一步扩散至田奇(华为云)、欧阳万里(OPPO)、聂礼强(山大)等外部网络。

  2. 校内同侪圈:刘东、李力(视频编码)、俞能海、李卫平、查正军、张燕咏等六系/信息学院教师,以及合肥工业大学的汪萌、洪日昌——这一"合肥多媒体学派"是2015年国家自然科学奖的共同体基础。

  3. 产业合作圈(最活跃的外圈):华为(从视频编码委托项目到ICML 2025大模型可信性联合研究的二十年演进,对接人含赵洁、田奇)、微软亚洲研究院(实验室共建方与人才来源地)、科大讯飞(手语识别横向合作)、早期诺基亚。

  4. 标准与学会圈:AVS/JCTVC/MPEG标准化共同体、IEEE CAS学会技术委员会及TMM/TCSVT期刊编委网络、中国电子学会网络多媒体专委会。

总体而言,李厚强是一个以中科大六系为原点、以MCC实验室为平台长成的"建制型"网络节点:其网络价值不在于跨机构流动带来的广度,而在于对内稳定的代际传承(学生留校形成梯队)与对外长周期的产业绑定(尤其华为与微软),并借助国家奖、IEEE Fellow、标准化组织等多重制度性纽带巩固网络。近年其网络重心随课题组向多模态大模型与可信AI方向迁移,张宗萌等新生代学生与华为赵洁的ICML合作标志着该网络正在向大模型时代延伸。