跳转至

北大智能学院 英向华 教授

报告生成时间:2026年9月15日
个人主页:北京大学学者主页(Scholars@PKU)智能学院官网教师页北京大学人工智能研究院简介
所属团队:北京大学智能学院(信息科学中心);机器感知与智能教育部重点实验室成员;跨媒体通用人工智能全国重点实验室成员(据其北大学者主页 CV 页)


一、学者基本信息

字段 内容
姓名 英向华(Xianghua Ying)
职称 教授、博士生导师(北京大学智能学院;据智能学院官网师资页与北大学者主页)
所属单位 北京大学智能学院(研究所:信息科学中心);机器感知与智能教育部重点实验室成员;跨媒体通用人工智能全国重点实验室成员
人才头衔 国家自然科学基金优秀青年科学基金获得者(项目"机器视觉",批准号 61322309,2014.01–2016.12,据其北大学者主页科研项目页);北京大学博雅青年学者
学术兼职 中国计算机学会(CCF)人工智能与模式识别专业委员会专委;CCF 计算机视觉专业委员会专委;北京人工智能学会理事(据北京大学人工智能研究院官网)
联系方式 xhying@cis.pku.edu.cn(办公电话 010-62759076,据智能学院官网)
研究方向 计算机视觉、虚拟现实、计算成像学(官网口径);具体包括三维重建与摄像机标定、多视点几何、全向/全景视觉、场景特征检测与不变量表示;近年扩展至面向复杂场景的自主感知、环境建模、人脸识别、三维人体姿态估计与多模态场景理解(据其北大学者主页)
论文与专利 在 IEEE TPAMI、IJCV 及 ICCV、CVPR、ECCV 等顶刊顶会发表第一作者论文 30 余篇,其中以第一作者身份在 TPAMI 发表论文 4 篇;申请发明专利 7–10 项(不同官方页面口径略有差异),获授权发明专利 4 项(据智能学院官网与人工智能研究院官网)
文献计量参考 OpenAlex 作者档案 A5015981200,收录论文 97 篇、被引约 1332 次(截至 2026 年 9 月检索;非官方口径,仅供参考)

二、教育背景与职业履历

英向华 2004 年毕业于中国科学院自动化研究所,获模式识别与智能系统专业工学博士学位。其博士期间的研究集中于中心折反射(catadioptric)全向摄像机与鱼眼相机的成像模型与几何标定,代表性成果包括与自动化所胡占义研究员合作发表的 TPAMI 2004 论文《Catadioptric Camera Calibration Using Geometric Invariants》(据 OpenAlex 记录被引约 148 次)与 ECCV 2004 论文《Can We Consider Central Catadioptric Cameras and Fisheye Cameras within a Unified Imaging Model?》(被引约 165 次,为目前其署名论文中单篇引用最高者)。需要说明的是,其博士生导师姓名在官方页面与公开渠道均未明确披露;上述与胡占义研究员的多篇合作仅为论文层面的可证事实,依据本报告证据纪律,不由合著推断师承关系。其本科与硕士就读院校亦未见官方页面披露。

2004 年博士毕业后,英向华即入职北京大学智能科学与技术系(国内第一个智能科学系,时属北京大学信息科学技术学院;百度百科及人工智能研究院早期页面称"北京大学信息科学技术学院教授",与官方沿革一致)。2007 年至 2008 年,他赴美国南加州大学(USC)计算机系任访问学者,这是其主要的海外学术经历;访学期间的合作教授姓名公开资料未披露。2021 年 12 月北京大学组建智能学院后,他随智能科学系整体转入智能学院任教授至今,所在研究所为信息科学中心,并先后以成员身份进入机器感知与智能教育部重点实验室与跨媒体通用人工智能全国重点实验室。

职业履历时间线:

时间 事件
2004 年前 本科、硕士就读院校公开资料未披露
2004 中国科学院自动化研究所,模式识别与智能系统专业,工学博士(导师信息公开资料未披露)
2004 入职北京大学智能科学与技术系(后属信息科学技术学院智能科学系)
2006–2010 主持国家自然科学基金青年基金(60605010,2007–2009)、863 计划项目(2009AA01Z329,2009–2010),任 973 计划项目子课题负责人
2007–2008 美国南加州大学(USC)计算机系访问学者
2014–2016 主持国家自然科学基金优秀青年科学基金项目"机器视觉"(61322309)
2016–2020 国家重点研发计划"大范围复杂场景视觉大数据的透彻感知理论与方法"子课题负责人
2020–2023 国家重点研发计划"面向产品全生命周期及闭环反馈的信息物理系统融合理论"课题负责人
2021.12 至今 北京大学智能学院教授(信息科学中心)
2024–2026 主持北京市自然科学基金项目"基于环境空间感知的车载 360 环视成像优化方法研究"(L247029);主持国家自然科学基金面上项目"基于自监督多模态融合的移动机器人视觉和语言导航方法研究"(62371009,2024–2027)

其研究脉络大致可分三个阶段:博士至入职初期(2003–2012)以全向/全景视觉、摄像机标定与多视点几何的数学理论为主,形成以几何不变量、绝对二次曲线像的几何解释(TPAMI 2006)、球面透视投影约束鱼眼标定等为代表的方法体系;2013–2020 年前后转向移动机器人复杂场景语义学习、街景分析与理解、径向畸变校正(CVPR 2017 基于合成数据的 CNN 畸变校正,被引约 102 次)等"几何 + 学习"结合方向;2021 年以来则以多模态场景理解(全景音视频显著性检测与分割)、无源域自适应、点云分析与 BEV 三维目标检测、时序预测等为主线,成果进入 CVPR、ECCV、NeurIPS、ICLR、IJCAI、AAAI、ACM MM、IJCV 等顶会顶刊。

三、学生培养情况

英向华长期担任博士生导师,但官方页面未公布其指导学生名录,亦未见其本人或学院披露的学生获奖、毕业去向汇总。以下仅列出可查证的信息;按照证据纪律,论文合著信息仅用于呈现其指导下的学术产出,不据此推断师承关系。

1. 郭若皓(北京大学智能学院博士生,可查证)

据北京大学智能学院学生访谈("信研·求学"学长圆桌第 5 期专访),郭若皓为北京大学智能学院 2022 级博士生(文中另处写作 2023 级,以访谈页面为准),硕士毕业于中国农业大学信息与电气工程学院计算机视觉实验室(2019 届计算机科学与技术硕士,师从李振波教授),就读期间获国家奖学金(2020、2021)、"北京市三好学生"称号及中国农业大学研究生优秀学位论文。访谈明确其"目前就读于北京大学智能学院通用人工智能全国重点实验室",但未披露其博士生导师姓名。在论文层面,郭若皓是英向华近年多模态方向成果的第一作者核心:包括 CVPR 2025《Audio-Visual Instance Segmentation》、ACM MM 2024《Instance-Level Panoramic Audio-Visual Saliency Detection and Ranking》与《Open-Vocabulary Audio-Visual Semantic Segmentation》、ESWA 2025《SalienTR》等,与英向华及北京智源人工智能研究院(BAAI)、穆罕默德·本·扎耶德人工智能大学(MBZUAI)等机构合作者联合完成。

2. 近年论文中的博士生作者群体(2021–2026,仅论文署名信息)

英向华近年成果中高频出现的学生一作/合作者(按 OpenAlex 署名统计)包括:Bowei Xing(约 20 篇合作,2022–2026,ECCV 2024 层次化无监督关系蒸馏、ICRA 2024 点云域自适应、IJCV 2025 多模态提示对齐等,具 BAAI 署名关联)、Wenzhen Yue(IJCAI 2024/2025 时序异常检测与预测)、Ruibin Wang(BEV 三维目标检测,ESWA 2025)、Taiyan Chen(AAAI 2024 VPDETR 消失点检测)、Ji Shi(AAAI 2025 Normal-NeRF)、Jinfa Yang(时序知识图谱补全)、Yongjie Shi(2016–2024,CVPR 2017 CNN 畸变校正一作)等。上述人员的研究生身份、年级与导师归属以学院学籍信息为准,公开渠道未系统披露,其中文姓名亦未见官方页面确认,本报告不予转写以免误植。

3. 早期学生作者群体(约 2009–2017,仅论文署名信息)

在全向视觉与相机标定方向,英向华早期论文的学生合作者包括 Kun Peng(2009–2012,折反射相机自标定系列)、Jiangpeng Rong(2014–2017,径向畸变校正)、Jing Kong、Xiang Mei、Shiyao Huang、Ganwen Wang、Sen Yang 等(北京大学署名)。这批成果支撑了其优青项目(2014–2016)的执行,学生毕业去向公开资料未披露。

4. 培养特点与去向判断

从可证材料看,英向华的学生培养呈现"几何视觉基础 + 多模态前沿"的接续特征:早期学生承担标定与全景视觉理论工作,近年学生则进入视听联合分割、域自适应、BEV 感知与时序建模等方向,并普遍与 BAAI 等外部机构联合署名,显示其指导机制中嵌入了与新型研发机构的联合培养环节。其学生的代表性荣誉(如国奖、优秀学位论文)以郭若皓在中国农业大学硕士阶段所获为可查证案例;学生毕业后进入高校、研究院或企业的具体去向,公开资料未披露。

四、学术合作网络

4.1 学院/实验室内部(北大智能学院核心圈)

  • 查红彬(北京大学教授、机器感知与智能教育部重点实验室主任):英向华学术网络中最重要的长期合作者。据 OpenAlex 统计,二人 2005–2022 年间合作论文逾 40 篇,覆盖全景视觉、场景理解与三维重建等方向(如全景动态光场采集再现、街景分析等)。英向华入职北大后即深度嵌入查红彬所领导的机器感知团队(其历史个人主页即挂于查红彬"视觉与机器人"研究组域名之下),二人的"查红彬—英向华"组合是北大智能学院计算机视觉方向的标志性师资搭档(详见本库 pku_sai_chahongbin_network.md)。
  • 信息科学中心与重点实验室平台:英向华所在的信息科学中心是智能学院视觉方向教师的主要载体,与同事曾钢(三维场景建模)、袁晓如(可视化)、许超(图像视频编码)、崔锦实(多模态数据融合)等构成同一所系内的学术共同体;其作为成员的机器感知与智能教育部重点实验室在 2012、2017、2022 三次评估中均获"优秀类",2022 年后又叠加跨媒体通用人工智能全国重点实验室平台(与北京通用人工智能研究院等共建)。

4.2 国内合作

  • 中国科学院自动化研究所:其博士母校与早期合作网络。与胡占义研究员在 2003–2006 年间合作 6 篇论文(OpenAlex 统计),是其全向相机标定理论的源头性合作。
  • 北京智源人工智能研究院(BAAI):2023–2026 年间最活跃的机构合作方。郭若皓、Bowei Xing、Wenzhen Yue 等学生作者在多篇文章中具 BAAI 署名,合作产出覆盖 CVPR 2025、ACM MM 2024、IJCV 2025 等,方向为视听联合分割、无源域自适应与时序预测,构成"北大—智源"联合科研/培养通道。
  • 中国农业大学:与信电学院计算机视觉实验室(李振波团队)的持续性合作(合作者 Yanyu Qi,2023–2025),并通过硕士生源头(如郭若皓)形成人才输送链条。
  • 医工交叉合作:与北京海淀医院、温州医科大学等医疗机构存在署名合作(据 OpenAlex 机构记录,方向涉及医学影像与视觉应用),具体项目载体公开资料未披露。
  • 其他:与清华大学(2 篇)、中国科学院信息工程研究所、武汉理工大学、北京科技大学及台湾建国科技大学等有零星署名合作(据 OpenAlex)。

4.3 国际合作

  • 美国南加州大学(USC):2007–2008 年访问学者,为其国际网络的起点(合作者信息公开资料未披露)。
  • 美国卡内基梅隆大学(CMU)与加州大学伯克利分校(UC Berkeley):近年多模态方向的国际合作者 Liao Qu(CMU)、Dantong Niu(UC Berkeley)联合署名 CVPR 2025、ACM MM 2024 等全景音视频分割论文。
  • 穆罕默德·本·扎耶德人工智能大学(MBZUAI,阿联酋):CVPR 2025《Audio-Visual Instance Segmentation》合作机构。
  • 英国萨里大学(University of Surrey)与美国北卡罗来纳大学教堂山分校(UNC):历史署名合作记录(据 OpenAlex)。
  • 华为(英国):2025 年时序预测论文 OLinear 的合作方署名机构(Huawei Technologies, UK),详见下节。

五、业界合作关系深度分析

就公开可证材料而言,英向华的产业合作披露程度较低,呈现"学术项目主导、企业合作点缀"的格局:

  • 与新型研发机构的深度合作(BAAI):严格意义上北京智源人工智能研究院属非营利新型研发机构而非企业,但它是英向华近年最实质的"类产业"合作通道——学生联合署名、联合发表顶会论文的密度(2023–2026 年逾 25 篇次机构署名)远超任何商业公司,可视作其成果向大模型/多模态产业前沿靠拢的主要桥梁。
  • 华为(英国):2025 年 IJCAI/期刊线时序预测工作 OLinear 的合作方中出现 Huawei Technologies (United Kingdom) 署名,是其近年唯一可查证的企业署名合作,属单点论文合作,未见项目化、长期化的公开证据。
  • 面向产业场景的纵向课题:其主持的北京市自然科学基金项目(2024–2026)直接面向"车载 360 环视成像优化",863 计划项目(2009–2010)面向"大规模全景动态光场采集与再现系统",面上项目(2013–2016)面向"自动装配中复杂工件位姿计算",均具有明确的智能驾驶、工业装配应用指向,属于"应用牵引的基础研究"而非企业横向。
  • 专利储备:官方页面记载其申请发明专利 7–10 项、获授权 4 项(集中于标定与成像系统方向);专利的转让或许可情况公开资料未披露。
  • 未见创业与横向披露:公开渠道未见英向华或其团队创办企业、承担企业冠名联合实验室、或获得企业大额横向项目的记录,其产学研风格更接近"依托国家与地方纵向课题服务应用场景"的学院派路线。

六、重要奖项与学术兼职

类别 名称/内容
人才计划 国家自然科学基金优秀青年科学基金获得者("机器视觉",61322309,2014.01–2016.12);北京大学博雅青年学者
学术兼职(学会) CCF 人工智能与模式识别专业委员会专委;CCF 计算机视觉专业委员会专委;北京人工智能学会理事
学术兼职(会议组织) CVPR 2011–2016 程序委员会委员;ICCV 2011、2015 程序委员会委员;IEEE ICIA 2010–2015 程序委员会委员;IEEE ICMA 2011–2015 程序委员会委员(据智能学院官网)
学术兼职(期刊) 《计算机科学与应用》期刊编委
代表性科研项目 863 计划"大规模全景动态光场采集与再现系统"(2009–2010,负责人);973 计划"可视媒体智能处理的理论与方法"子课题负责人(2006–2010);国家重点研发计划课题负责人(2020–2023)与子课题负责人(2016–2020);国家自然科学基金青年基金、优青及 4 项面上项目负责人;北京市自然科学基金项目负责人(2024–2026)
科技奖励 公开渠道未见其本人获国家级/省部级科技奖励的记录;其博士期间主要合作者胡占义团队曾获 2004 年国家自然科学奖二等奖("视觉计算理论和算法研究"),英向华是否在完成人之列公开资料未披露,本报告不予采信

七、Connection 圈层总结

英向华的学术关系网络以"一锚、两翼、一桥"为结构特征:

  • 核心锚点(北大机器感知体系):以查红彬为轴心的机器感知与智能教育部重点实验室是其全部学术活动的容器。英向华 2004 年自中科院自动化所毕业后即进入该体系,二十余年未曾移动,是北大智能学院视觉方向"本土坚守型"中生代教授的典型;其与查红彬逾 40 篇的合作构成国内全景视觉与三维重建领域最持久的师出同门式(同事型)搭档之一。
  • 学术翼(自动化所源头 + 国内同行):向内承接中科院自动化所模式识别国家重点实验室(胡占义视觉几何学派)的理论源头,向外与中国农业大学(李振波团队,兼作优质生源地)、清华大学、中科院信工所等保持低密度合作;其学术谱系在理论端属"自动化所视觉几何—北大机器感知"复合脉络。
  • 前沿翼(多模态与国际节点):2021 年后通过 CMU、UC Berkeley、MBZUAI 等国际合作者与萨里大学、UNC 的历史联系,将全景视觉积累延伸至视听联合场景理解;USC 访学经历为其早期国际化节点。
  • 产业桥(BAAI 主导、企业点缀):以北京智源人工智能研究院为成果转化与学生联合培养的主通道,华为(英国)单点合作与车载 360 环视等应用型纵向课题为辅;未形成企业深度绑定或创业版图,产业影响力主要通过人才与论文外溢实现。

总体而言,英向华的网络结构呈"厚平台、稳搭档、窄企业"的形态:平台端坐拥教育部重点实验室与全国重点实验室双重背书,搭档端与查红彬形成二十年级别的稳定组合,而企业端披露有限。其网络资本的独特性在于"全景/折反射视觉几何"这一稀缺理论资产的长期持有——从 2004 年的 TPAMI 标定理论到 2024–2025 年的全景音视频理解,同一套成像几何功底贯穿始终,使其在北大智能学院视觉版图与智源多模态前沿之间保持不可替代的连接价值。

主要资料来源

  1. 北京大学智能学院官网师资页:专职教师—英向华专职教师列表(职称、研究所、研究领域、会议任职,2026-09 检索)
  2. 北京大学学者主页(Scholars@PKU):简介CV科研项目科研成果(现任归属、重点实验室成员身份、项目批准号与执行期)
  3. 北京大学人工智能研究院官网:在职教研人员—英向华(教育经历、USC 访学、CCF 兼职、北京人工智能学会理事)
  4. 北京大学智能学院招生指南(2024/2027)(智能学院沿革、机器感知与智能教育部重点实验室"优秀类"评估记录)
  5. 北京大学智能学院学生访谈:"信研·求学"学长圆桌第 5 期郭若皓专访(微信公众号,学生背景信息)
  6. OpenAlex 作者档案 A5015981200(论文、被引、合作者与机构署名统计,2026-09 检索;非官方数据)
  7. 百度百科"英向华"词条(历史表述"北京大学信息科学技术学院教授"之佐证;非一手来源)
  8. 中国科学院大学教师主页(胡占义)与中科院自动化所官网(胡占义履历与获奖背景)