HITSZ-NIE 吴建龙 副教授
报告生成时间:2026年8月20日 个人主页:吴建龙 | GitHub主页 | Google Scholar 所属团队:哈尔滨工业大学(深圳)计算机科学与技术学院 / 智能媒体研究组
一、学者基本信息
| 字段 | 内容 |
|---|---|
| 中文姓名 | 吴建龙 |
| 英文姓名 | Jianlong Wu |
| 当前职称 | 教授、博士生导师(据个人主页及百度百科;学院师资页仍列为副教授,存在信息更新滞后;基础学部副主任) |
| 所在单位 | 哈尔滨工业大学(深圳)计算机科学与技术学院 |
| 研究方向 | 多模态学习、计算机视觉、机器学习 |
| 人才计划 | 国家级青年人才;中国科协青年人才托举工程;哈工大"青年拔尖人才计划";"鹏城孔雀计划"特聘岗位 |
| 学术会员 | CCF高级会员、CSIG高级会员 |
| 论文发表 | 近五年在TPAMI、TIP、NeurIPS、ICCV、CVPR、ICML、ACM MM等顶级期刊与会议发表论文40余篇 |
| 学术引用 | Google Scholar引用4000余次( faculty页数据,实际可能更高) |
| 电子邮箱 | wujianlong@hit.edu.cn |
| 招生方向 | 博士后、博士、硕士(多模态学习相关方向) |
二、教育背景与职业履历
2.1 教育背景
吴建龙于2014年本科毕业于华中科技大学电信提高班(电子信息与通信工程专业)。此后进入北京大学电子学与计算机科学学院(EECS)攻读博士学位,师从林宙辰教授(IEEE Fellow)和查红彬教授,就读于北京大学 ZERO Lab(零误差实验室)。2019年获北京大学智能科学与技术专业博士学位,研究方向为计算机视觉。
博士导师确认: 根据其个人主页明确记载,博士导师为林宙辰教授(Zhouchen Lin)和查红彬教授(Hongbin Zha),均隶属于北京大学。林宙辰教授是IEEE Fellow、全球前2%顶尖科学家,在低秩矩阵恢复、子空间聚类等数学与机器学习交叉领域享有国际声誉。查红彬教授为北京大学机器感知与智能教育部重点实验室资深教授,研究方向涵盖计算机视觉与机器人。
2.2 职业履历
| 时间段 | 单位 | 职位 |
|---|---|---|
| 2014–2019 | 北京大学(ZERO Lab) | 博士研究生 |
| 2019–2022 | 山东大学计算机科学与技术学院 | 助理教授、研究员 |
| 2022–至今 | 哈尔滨工业大学(深圳)计算机科学与技术学院 | 副教授→教授、博导 |
在山东大学任职期间(2019–2022),吴建龙与聂礼强教授(当时亦在山东大学)建立了紧密的合作关系,这一合作在聂礼强调入哈工大(深圳)后得以延续并深化。2022年吴建龙加入哈工大(深圳),与聂礼强共同组建智能媒体研究组,在多模态学习领域形成了高产出的研究团队。
三、学生培养情况
吴建龙在个人主页上公开招募博士后、博士及硕士研究生。根据其发表论文的署名模式(标注"^"为通讯作者),可识别以下代表性在读或近期毕业学生:
3.1 李小杰(Xiaojie Li)
极高频合作者,自2022年起以第一作者身份发表多篇论文,吴建龙为通讯作者。代表性工作包括:HEAD(ECCV 2022)、Mask Again(ACM MM 2023)、GenView(ECCV 2024)、Mamba-FSCIL(TPAMI 2026)、Continuous Knowledge-Preserving Decomposition(ACM MM 2026)、AirForesight(ACM MM 2026)。研究方向涵盖自监督学习、少样本类增量学习、视觉-语言导航等。推断为博士研究生,系吴建龙在哈工大(深圳)指导的核心学生之一。
3.2 王潇(Xiao Wang)
高频合作者,以第一作者发表多篇高水平论文:Video DataFlywheel(TPAMI 2025)、HAIC(ACL 2025)、ReTaKe/AdaReTaKe(ACL 2025 Findings)。研究聚焦视频-语言理解与数据飞轮方法论。推断为博士研究生,其论文多次以吴建龙和聂礼强为共同通讯作者。
3.3 丁慕鹤(Muhe Ding)
以第一作者发表多篇论文:RA-BLIP(TMM 2025)、Preview-based Category Contrastive Learning(TCSVT 2025)、Long-Horizon Vision-Language Navigation by Memory Editing(ACM MM 2026)。研究方向涵盖检索增强多模态预训练与视觉-语言导航。推断为博士研究生。
3.4 张金龙(Jinrong Zhang)
第一作者论文:Breaking the Regional Perception Bottleneck of Multimodal Large Language Models via External Reasoning Framework(CVPR 2026)。同时为PVUW 2026 MeViS-Text Challenge第一名团队HITsz_Dragon的核心成员。推断为博士或硕士研究生。
3.5 何旭昇(Xusheng He)
第一作者论文:FineBadminton: A Multi-Level Dataset for Fine-Grained Badminton Video Understanding(ACM MM 2025)。同时为PVUW 2026 MeViS-Text Challenge第一名团队HITsz_Dragon的第一作者。研究方向涉及细粒度视频理解与视频分割。推断为博士或硕士研究生。
其他可识别的学生与合作者
- 甘涛(Tian Gan):2022–2023年间高频合作者,参与微视频标注、时序定位、掩码视频建模等工作。可能为山东大学时期指导的学生。
- 孙伟(Wei Sun):参与半监督动作识别(TIP 2023)、深度聚类(ClusMatch, TPAMI 2025)、跨模态语义一致性聚类(AAAI 2026)等工作。
- 杨奕波(Yibo Yang):参与EMANet(ICCV 2019)、GenView(ECCV 2024)、CorDA(NeurIPS 2024)等,可能为北京大学ZERO Lab时期或后续合作者。
- 向乾龙(Qianlong Xiang):第一作者论文DKDM(CVPR 2025),研究扩散模型知识蒸馏。
- 李子涵(Zihan Li):第一作者论文Self-Enhanced Image Clustering(AAAI 2026)。
四、学术合作网络
4.1 核心合作者(合作≥3次)
4.1.1 聂礼强(Liqiang Nie)—— 哈工大(深圳)教授、博导
合作关系定位: 聂礼强是吴建龙当前最核心的学术合作者。自2021年起,两人的合作几乎覆盖了吴建龙在哈工大(深圳)期间的全部研究方向,包括视频-语言理解、多模态大模型、半监督学习、深度聚类、视觉-语言导航等。聂礼强在多数论文中与吴建龙共同担任通讯作者。
合作起源: 两人在山东大学时期即建立合作关系(2019–2022),后先后调入哈工大(深圳),共同组建智能媒体研究组。聂礼强为多媒体与信息检索领域知名学者,CCF多媒体技术专委会主任,其研究偏重多模态信息检索与应用;吴建龙偏重计算机视觉基础理论与方法,二人形成"检索+视觉"互补的研究范式。
代表性合作论文: - A Survey on Video Temporal Grounding with Multimodal Large Language Model(TPAMI 2026) - ClusMatch: Improving Deep Clustering(TPAMI 2025) - Video DataFlywheel(TPAMI 2025) - Detecting and Grounding Multi-modal Media Manipulation(TPAMI 2024) - CorDA: Context-oriented Decomposition Adaptation(NeurIPS 2024) - CHMATCH(CVPR 2023) - Neighbor-guided Consistent and Contrastive Learning(TIP 2023)
4.1.2 林宙辰(Zhouchen Lin)—— 北京大学教授、IEEE Fellow
合作关系定位: 博士导师,毕业后仍保持合作关系。林宙辰的数学优化背景(低秩矩阵恢复、子空间分析)为吴建龙的研究提供了理论基础。
代表性合作论文: - ClusMatch(TPAMI 2025) - A Survey on Video Temporal Grounding(TPAMI 2026) - SSCNet: Learning-based subspace clustering(Visual Intelligence, 2024) - EMANet: Expectation-maximization attention networks(ICCV 2019)
4.1.3 张敏(Min Zhang)
高频合作者,自2022年起出现在多篇论文中(Mamba-FSCIL TPAMI 2026、GenView ECCV 2024、CorDA NeurIPS 2024、Mask Again ACM MM 2023等)。从合作模式推断,张敏可能为哈工大(深圳)或相关机构的合作教职/研究员,但公开信息有限,具体机构归属尚待核实。
4.1.4 Bernard Ghanem —— 沙特阿卜杜拉国王科技大学(KAUST)教授
国际合作者,KAUST AI Initiative副主任、IVUL实验室主任。合作论文包括GenView(ECCV 2024)和CorDA(NeurIPS 2024),聚焦自监督学习与大模型适配。此合作体现了吴建龙研究在国际层面的影响力。
4.2 机构内部合作者
4.2.1 邵睿(Rui Shao)—— 哈工大(深圳)教授
邵睿为哈工大(深圳)计算机科学与技术学院教授,与吴建龙、聂礼强共同发表论文"Detecting and Grounding Multi-modal Media Manipulation and Beyond"(TPAMI 2024),该论文亦与新加坡南洋理工大学Ziwei Liu合作。邵睿的研究方向涉及多模态媒体取证与安全。在PVUW 2026 MeViS-Text Challenge中,HITsz_Dragon团队以吴建龙、聂礼强为指导教师,邵睿作为同院同事可能提供了间接支持,但未列入该竞赛技术报告的署名作者。
4.2.2 管伟立(Weili Guan)
管伟立是PVUW 2026 MeViS-Text Challenge中HITsz_Dragon团队的署名成员之一,在多篇论文中作为合作者出现(StructAlign SIGIR 2026、MegaSR 2025等)。从MeViS竞赛论文的机构标注来看,管伟立隶属于"Harbin Institute of Technology, Shenzhen, China; Shenzhen Loop Area Institute, China"。在哈工大(深圳)计算机学院师资列表中未找到"管伟立"的独立教职条目,推测可能为博士后、特聘研究员或深圳湾实验室相关机构的研究人员。
4.2.3 其他院内同事
从HITSZ计算机学院师资列表可见,吴建龙所在学院拥有邵睿、邵奕天、施少怀等教授,以及多位副教授和助理教授,构成了一定的学术生态。但就公开论文合作记录而言,吴建龙在院内最紧密的合作者为聂礼强,其次为邵睿和管伟立。
4.3 跨机构合作者
| 合作者 | 机构 | 代表性合作 |
|---|---|---|
| 林宙辰(Zhouchen Lin) | 北京大学 | ClusMatch(TPAMI 2025)、EMANet(ICCV 2019) |
| 查红彬(Hongbin Zha) | 北京大学 | 博士联合导师,早期论文 |
| Bernard Ghanem | KAUST(沙特) | GenView(ECCV 2024)、CorDA(NeurIPS 2024) |
| Ming-Hsuan Yang | 加州大学默塞德分校 | Mamba-FSCIL(TPAMI 2026) |
| Ziwei Liu | 南洋理工大学(新加坡) | Detecting and Grounding Multi-modal Media Manipulation(TPAMI 2024) |
| Xian-Sheng Hua(华先胜) | 阿里巴巴达摩院(推测) | MegaSR(2025) |
| Jiaya Jia | 香港中文大学(深圳)/思谋科技 | High Quality Segmentation for Ultra High-resolution Images(CVPR 2022) |
| Chang Wen Chen | 宾夕法尼亚州立大学/香港城市大学 | A Survey on Video Temporal Grounding(TPAMI 2026) |
| Bernard Ghanem 团队 | KAUST | 持续合作 |
吴建龙的跨机构合作网络覆盖中国(北京大学、山东大学、香港中文大学深圳)、亚洲(南洋理工大学、KAUST)和北美(宾夕法尼亚州立大学、加州大学),体现了其研究在国际学术界的认可度与影响力。
五、业界合作关系深度分析
5.1 企业合作概况
吴建龙的研究具有显著的应用导向,多篇论文与企业研究团队联合发表,体现了产学研融合的特征。
5.1.1 快手科技(Kuaishou Technology)
合作证据: 在多篇论文中,张付哲(Fuzheng Zhang)和张迪(Di Zhang)作为共同作者出现。公开报道显示,张迪为快手副总裁、AI模型团队负责人。以张付哲和张迪为署名的合作论文包括: - Video DataFlywheel: Resolving the Impossible Data Trinity in Video-Language Understanding(TPAMI 2025) - HAIC: Improving Human Action Understanding and Generation with Better Captions(ACL 2025)
合作方向: 视频语言理解、视频数据飞轮方法论、人体动作理解与生成。快手作为短视频头部平台,在视频内容理解与多模态大模型方向有强烈的技术需求,与吴建龙-聂礼强团队的研究方向高度契合。
5.1.2 其他潜在企业合作
- SIGIR 2023工业轨道论文:OFAR: A Multimodal Evidence Retrieval Framework for Illegal Live-streaming Identification 发表于SIGIR工业轨(Industrial Track),涉及违法直播识别的应用场景,合作者包括Yuhong Li等,可能涉及企业合作但具体企业归属未在公开信息中明确标注。
- 秦鹏达(Pengda Qin):出现在多篇论文中(RA-BLIP TMM 2025、Preview-based TCSVT 2025、Differential-Perceptive ACM MM 2024),从合作模式推断可能来自企业研究团队,但具体归属尚待核实。
- 华先胜(Xian-Sheng Hua):在MegaSR(2025)中作为合作者出现,华先胜为知名工业界AI研究者,曾任职于阿里巴巴达摩院、蚂蚁集团等。
- Zijia Lin:在Video DataFlywheel(TPAMI 2025)中作为合作者出现,可能来自企业研究团队。
5.2 企业合作模式分析
从吴建龙的企业合作模式来看,主要呈现以下特征:
- 以视频-语言理解为核心应用场景:与快手的合作集中在视频内容理解这一核心方向,与企业业务需求直接关联。
- 产学研并重:合作的工业界论文多发表于TPAMI、ACL等顶级学术期刊和会议,保持了高学术标准的同时服务于企业应用需求。
- 聂礼强的中介作用:聂礼强作为多媒体与信息检索领域的资深学者,长期与企业界保持合作(如其在山东大学期间即有多项企业合作项目),在企业合作的拓展中可能起到桥梁作用。
- 深圳地域优势:哈工大(深圳)地处粤港澳大湾区,周边聚集了腾讯、华为、大疆、快手(深圳办公室)等科技企业,为产学研合作提供了地理便利。
六、重要奖项与学术兼职
6.1 重要奖项
| 年份 | 奖项名称 | 级别 |
|---|---|---|
| 2021 | 山东省科学技术进步一等奖 | 省部级 |
| 2021 | SIGIR最佳学生论文奖 | CCF A类会议最佳论文 |
| 2023 | 山东省技术发明一等奖 | 省部级 |
| 2023 | 中国科协青年人才托举工程 | 国家级人才计划 |
| 2024 | 中国自动化学会自然科学一等奖 | 国家级学会奖 |
| 2025 | "祖冲之奖"突出成果奖 | 重要学术奖 |
| 2025 | CVPR 2025 VideoLLMs Championship | 国际竞赛冠军 |
| 2025 | 入选全球前2%顶尖科学家榜单 | 国际学术影响力 |
| 2026 | PVUW 2026 MeViS-Text Challenge 第一名(HITsz_Dragon团队) | 国际竞赛冠军 |
6.2 学术兼职
| 类别 | 具体职务 |
|---|---|
| 期刊副主编 | IEEE TPAMI副主编(Associate Editor,2025年10月起);IEEE TMM副主编(2025年10月起) |
| 客座编辑 | IEEE TCSVT客座编辑 |
| 领域主席/Area Chair | CVPR、ICML、NeurIPS、ACM Multimedia、AAAI(2023–2026年持续担任) |
| 学术委员会 | CCF多媒体技术专委会副秘书长 |
6.3 主持项目
据学院主页信息,吴建龙主持三项国家级项目,包括国家自然科学基金面上项目和青年项目等。具体项目名称与编号在公开信息中未完整披露。
七、Connection圈层总结
基于上述分析,吴建龙的学术关系网络可划分为以下圈层:
第一圈层(核心圈): 聂礼强(哈工大深圳,最紧密合作者,几乎所有近期论文的共同通讯作者)、林宙辰(北京大学,博士导师,持续合作者)。这二人构成了吴建龙学术网络的核心节点:聂礼强代表当前的合作主线(多模态学习与应用),林宙辰代表学术根基(数学优化与视觉基础理论)。
第二圈层(学生与团队): 李小杰、王潇、丁慕鹤、张金龙、何旭昇等博士/硕士研究生构成活跃的研究团队。管伟立作为团队中的合作研究者(可能为博士后或副研究员),在MeViS等竞赛中发挥重要作用。甘涛、孙伟等可能为山东大学时期指导的学生,合作延续至今。张敏作为高频合作者亦属此层。
第三圈层(院内同事): 邵睿(同院教授,TPAMI合作)、哈工大(深圳)计算机学院其他教职人员。此圈层合作密度相对较低,但邵睿在多模态媒体安全方向的合作具有战略价值。
第四圈层(跨机构与工业界): - 国际学术合作:Bernard Ghanem(KAUST)、Ziwei Liu(NTU)、Ming-Hsuan Yang(UC Merced)、Chang Wen Chen(PSU)等,覆盖自监督学习、多模态取证、少样本学习等方向。 - 企业合作:快手科技(张迪、张付哲)为核心企业合作方,聚焦视频-语言理解。华先胜(阿里/达摩院背景)等亦有合作。SIGIR工业轨论文暗示更深层的产业应用合作。 - 竞赛合作:以HITsz_Dragon为队名在PVUW等国际竞赛中获奖,体现了团队在视频分割等前沿任务上的技术竞争力。
网络特征总结: 吴建龙的学术网络呈现"双核驱动"结构——以林宙辰(北大)为学术根基、以聂礼强(哈工大深圳)为合作主轴,辐射至KAUST、NTU等国际机构和快手等企业。其研究从博士期间的子空间分析与低秩矩阵恢复,演进至当前的多模态大模型与视频-语言理解,体现了从理论到应用的完整发展路径。PVUW 2026 MeViS-Text Challenge冠军和CVPR 2025 VideoLLMs冠军等竞赛成绩表明,其团队不仅在顶刊顶会持续产出,在国际技术竞赛中亦具有领先竞争力。作为国家级青年人才和IEEE TPAMI副主编(35岁左右即获此任命),吴建龙正处于学术生涯的快速上升期,其学术影响力预计将进一步扩大。
备注: 本报告基于公开可查的网络信息撰写,包括吴建龙个人主页(jlwu1992.github.io)、哈工大(深圳)教师主页、百度百科、CSIG学会公告、arXiv论文等。部分学生的身份(博士/硕士、入学年份)基于论文署名模式推断,未经本人确认。企业合作者的具体机构归属基于公开报道和合作模式推测,可能存在偏差。管伟立、张敏等合作者的确切机构归属尚需进一步核实。