复旦大学 陈智能 教授
报告生成时间:2026年8月20日
个人主页:陈智能
所属团队:复旦大学视觉与学习实验室(FVL,Fudan Vision and Learning Laboratory)
一、学者基本信息
| 字段 | 内容 |
|---|---|
| 姓名 | 陈智能(Zhineng Chen) |
| 职称 | 教授、博士生导师(2025年起任教授,此前为青年研究员) |
| 所属单位 | 复旦大学智能机器人与先进制造创新学院 / 可信具身智能研究院;同时隶属于复旦大学计算与智能创新学院(原计算机科学技术学院) |
| 所属实验室 | 复旦大学视觉与学习实验室(FVL,Fudan Vision and Learning Laboratory) |
| 实验室负责人 | 姜育刚教授(复旦大学副校长、IEEE Fellow、IAPR Fellow、教育部长江学者特聘教授) |
| 邮箱 | zhinengchen@fudan.edu.cn(旧邮箱 zhinchen@fudan.edu.cn 仍有效) |
| 个人主页 | https://zhinchenfd.github.io/ |
| FVL团队主页 | https://fvl.fudan.edu.cn/ |
| 研究方向 | 多媒体分析与检索、计算机视觉、具身感知、OCR与场景文本识别、多模态学习、文档理解、生物医疗图像分析 |
| 代表性论文发表 | IEEE TPAMI、CVPR、ICCV、IJCV、AAAI、IJCAI、ACM MM、计算机学报等国内外顶级期刊与会议80余篇 |
| 国家级科研项目 | 作为负责人承担2项国家重点研发计划课题和4项国家自然科学基金项目 |
| 产业科研项目 | 多项百度、腾讯、阿里、交通部公路院、软控等知名企事业单位科研项目 |
| 代表性奖项 | 2023年度上海市技术发明一等奖("面向智能制造的跨域融合感知关键技术及应用") |
| 人才计划 | 入选上海市东方英才计划拔尖项目 |
| 学术兼职 | 上海市智能视觉计算协同创新中心副主任;上海市计算机学会多媒体专委会主任;中国图象图形学学会多媒体专委会常务委员(曾任委员、副秘书长);ACM MM、AAAI等多个权威国际会议领域主席、高级程序委员;IEEE TPAMI等多个知名国际期刊审稿人 |
| 双聘身份 | 曾任上海人工智能实验室双聘青年科学家 |
| 教学课程 | 联合开设AI专业核心课程《人工智能前沿探索实践》(与马兴军、曹艺馨、戈维峰合作) |
二、教育背景与职业履历
陈智能的学术生涯起点可追溯至湖南株洲。他在株洲市二中完成了中学阶段学业(初中1997届172班、高中2000届976班),此后进入本科阶段深造。基于其学术发表脉络的回溯——早期与合肥工业大学高心报(Xieping Gao)、谢洪涛(Hongtao Xie)等学者在场景文本识别、文档理解方向的多篇合作论文,以及这些合作者在论文作者序列中常处于通讯位置的特征,可以推断陈智能的博士或早期科研训练阶段很可能在合肥工业大学或相近机构完成,导师型合作者包括高心报等合肥工业大学计算机与信息学院的教师。合肥工业大学在文本识别、模式识别与计算机视觉方向有深厚的学术传承,汪萌教授(现任合肥工业大学校长)、洪日昌教授等均为该方向有国际影响力的学者,陈智能在该生态中接受了文档图像分析与OCR方向的基础训练。
进入复旦大学后,陈智能的学术轨迹与复旦大学视觉与学习实验室(FVL)深度绑定。FVL实验室由姜育刚教授创立并担任主任,是复旦大学计算机学院在视觉智能与多模态学习方向的核心研究力量,姜育刚教授本人为IEEE Fellow、IAPR Fellow、ACM杰出会员、教育部长江学者特聘教授、国家科技创新2030"新一代人工智能"重大项目负责人,并于2023年12月起担任复旦大学副校长。陈智能以青年研究员身份加入FVL,在姜育刚教授的提携与合作下迅速成长为实验室在OCR、文档理解和多模态生成方向的独立学术骨干。陈智能与姜育刚教授的合作贯穿其绝大多数代表性论文,姜育刚通常以通讯作者(论文末位作者)身份出现,形成了典型的"导师—核心成员"长期合作轴线。
职业晋升方面,陈智能从青年研究员(约2021—2024年)晋升为教授、博士生导师(2025年起)。2026年其所属机构体系调整后,他同时隶属于复旦大学智能机器人与先进制造创新学院和可信具身智能研究院(CIRAM),并保留在计算与智能创新学院(原计算机科学技术学院)的FVL团队编制内,是FVL在文本识别、文档理解与多模态生成方向的独立PI。在双聘身份上,他曾担任上海人工智能实验室双聘青年科学家,这一身份使他的研究网络同时覆盖复旦大学学术圈与上海人工智能实验室(AI Lab)产业研究生态。
教学方面,陈智能于近年联合马兴军、曹艺馨、戈维峰三位教师开设了复旦大学AI专业核心课程(AI-E类课程)《人工智能前沿探索实践》。该课程聚焦人工智能本学科的核心领域,从底层逻辑出发系统呈现AI相关学科的基本性与共通性知识体系及核心技术,强调"前沿理论+编程实践"双轮驱动。课程一经推出选课人数从50人扩容到70人仍迅速选满,反映了陈智能在工科实践教学方面的创新意识与受欢迎程度。他在公开访谈中明确提出"人工智能本身实践性很强,不能停留在'纸上谈兵'"的教学理念,针对当前工科学生"重理论、轻实践"的痛点,在课程设计中尤为注重培养学生的动手能力。
三、学生培养情况
作为FVL实验室在OCR与多模态生成方向的独立PI,陈智能的学生培养成果在2024—2026年集中爆发,多名学生在IEEE TPAMI、CVPR、ICCV、AAAI、IJCAI、ACM MM等顶级会议与期刊上发表第一作者论文,并在国际算法竞赛中夺冠。其学生培养体系涵盖博士与硕士两条线,研究主题集中在场景文本识别(SVTR/CPPD/IGTR系列)、增量多语言文本识别、文本生成(DreamMesh/3DStyle-Diffusion)、视觉异常检测、增量学习等前沿方向。以下列举若干代表性学生。
1. 杜永坤(博士研究生,23级博,OCR方向核心学生)
杜永坤是陈智能指导的最具代表性的博士研究生,也是FVL近年在OCR方向的旗舰产出者。他的代表性工作包括SVTR(Scene Text Recognition with a Single Visual Model,IJCAI 2022)、CPPD(上下文感知并行解码器)、IGTR(指令引导的文本识别方法)等,构建了从单一视觉模型到指令学习驱动的完整OCR方法论体系。截至2026年初,杜永坤已发表TPAMI论文2篇、ICCV论文1篇、IJCAI论文1篇、AAAI论文1篇,并连续获得多项重磅荣誉:2024年PaddleOCR算法模型挑战赛"OCR端到端识别"赛道冠军、2024全球人工智能技术创新大赛算法挑战赛"无人机视角下的双光目标检测"赛道一等奖、2025年度国家自然科学基金青年学生基础研究项目(博士研究生)资助、2025年度中国电子学会—腾讯博士生科研激励计划。他还曾受邀在中国图象图形学报"文档图像微沙龙第三十三期"做主题报告《高效准确的场景文本识别》,由同实验室苏宇辰主持。杜永坤的产出反映了陈智能团队在OCR基础模型与产业级应用方面的双线推进能力。
2. 苏宇辰(博士研究生,23级博,OCR与多模态方向)
苏宇辰是陈智能指导的另一位核心博士生,与杜永坤在SVTR/CPPD/IGTR系列工作中为深度合作伙伴。截至2026年初,苏宇辰已发表AAAI论文2篇、TPAMI论文1篇、IEEE TMM论文1篇,并同样获得2024年PaddleOCR算法模型挑战赛"OCR端到端识别"赛道冠军与2024全球人工智能技术创新大赛一等奖。他的研究聚焦于场景文本识别的视觉建模与高效解码,代表了陈智能团队在OCR视觉编码器方向的技术深度。在中国图象图形学报"文档图像微沙龙"系列活动中,苏宇辰担任主持人,反映了其在OCR学术社区中的活跃度与组织能力。
3. 杨海波(博士研究生,22级硕→24级硕转博,文本生成与3D方向)
杨海波是陈智能指导的博士研究生,研究方向为文本驱动的3D生成与多模态扩散模型。他作为第一作者在ECCV 2024发表论文《DreamMesh: Jointly Manipulating and Texturing Triangle Meshes for Text-to-3D Generation》(合作者包括Yang Chen、Yingwei Pan、Ting Yao、Zhineng Chen、Zuxuan Wu、Yu-Gang Jiang、Tao Mei),该工作提出联合操控与纹理化三角网格的文本到3D生成框架,是陈智能团队与Tao Mei(梅涛)研究组合作链条上的代表作之一。杨海波另在ACM Multimedia 2024发表论文1篇,总产出为MM × 2、ECCV × 1,并获社会冠名奖学金。他还参与了3DStyle-Diffusion等3D风格化方向的工作,其GitHub开源项目(yanghb22-fdu)承载了团队在3D生成方向的代码发布。
4. 罗扬(博士研究生,21级硕→23级硕转博,视觉异常检测与生物医疗方向)
罗扬是陈智能指导的博士研究生,21级硕士入学后于23级转为博士。他的代表性产出包括CVPR 2024论文《Learning to Rank Patches for Unbiased Image Redundancy Reduction》(合作者Zhineng Chen、Peng Zhou、Zuxuan Wu、Xieping Gao、Yu-Gang Jiang),该工作提出通过排序图像块来减少无偏图像冗余的新方法;以及BIBM与ACM MM 2024各1篇论文。罗扬的研究方向涵盖视觉表征学习与生物医疗图像分析,是陈智能团队在生物医疗图像分析方向的代表学生之一。他曾获国家奖学金。
5. 郑天伦(硕士毕业生,21级硕,协助姜育刚教授指导,OCR方向)
郑天伦是陈智能团队(同时协助姜育刚教授指导)培养的硕士毕业生,研究方向为场景文本识别与多语言文本识别。他作为第一作者在IJCV 2024发表论文《CDistNet: Perceiving Multi-domain Character Distance for Robust Text Recognition》(合作者Zhineng Chen、Shancheng Fang、Hongtao Xie、Yu-Gang Jiang),并在ICCV 2023和IJCAI各发表1篇论文(包括MRN多语言增量文本识别方向)。郑天伦在校期间获国家奖学金、上海市优秀毕业生、2024年度中国电子学会优秀硕士论文奖等多项荣誉,是陈智能团队硕士培养线的标杆性成果。毕业后去向为宁波市公务员(选调路径),反映了陈智能团队学生在政府数字化转型岗位的溢出效应。
6. 黄丙晨(硕士毕业生,21级硕,增量学习方向)
黄丙晨是陈智能指导的硕士毕业生,研究方向为类增量学习。他作为第一作者在AAAI 2023发表论文《Resolving Task Confusion in Dynamic Expansion Architectures for Class Incremental Learning》(合作者Zhineng Chen、Peng Zhou、Jiayin Chen、Zuxuan Wu),提出解决动态扩展架构中任务混淆问题的TCIL方法,开源代码发布于YellowPancake/TCIL。黄丙晨在校期间获国家奖学金和上海市优秀毕业生荣誉,毕业后去向为美团,体现了陈智能团队学生在产业算法岗位的就业竞争力。
7. 孙可欣(硕士毕业生,21级硕,视觉表征方向)
孙可欣是陈智能指导的硕士毕业生,在校期间以第一作者身份在CVPR发表论文1篇(与陈智能、周鹏、吴祖煊等合作),研究方向聚焦于视觉表征学习与图像冗余减少。她曾获社会冠名奖学金,毕业后去向为快手,代表了陈智能团队在视觉表征基础研究向短视频/视觉内容产业的人才输送。
8. 陈奕夫(硕士毕业生,22级硕,文本引导生成方向)
陈奕夫是陈智能指导的硕士毕业生,在文本引导的视觉生成方向有重要产出。他作为第一作者在ECCV 2024发表论文《Improving Text-guided Object Inpainting with Semantic Pre-inpainting》(合作者Jingwen Chen、Yingwei Pan、Yehao Li、Ting Yao、Zhineng Chen、Tao Mei),提出基于语义预填充的文本引导物体修复CaTdiffusion方法,开源代码发布于Nnn-s/CaTdiffusion。该工作是陈智能团队与Tao Mei研究组在视觉语言生成方向的另一合作代表作。
其他在读学生与毕业生
陈智能团队在读博士生还包括李时杰(22级博,2025年AAAI 2026论文一作)、白维康(24级硕,2025年AAAI 2026论文一作)、叶兴松(24级硕,2025年ICCV论文一作、国家奖学金)、潘兆龙(22级硕,IEEE TMM论文一作)等,团队规模与产出密度在FVL各方向中处于前列。硕士毕业生去向多元,包括美团、快手、华为、携程等互联网与科技企业,德邦基金等金融机构,北京星鹏联海等实体企业,以及黑龙江省公安厅(选调)、宁波市公务员等政府岗位。从毕业生去向分布看,陈智能团队的人才培养既有产业算法岗位的强输出,也有政务与金融领域的多元溢出,反映了其OCR与多模态研究方向在产业数字化转型中的广泛适用性。
四、学术合作网络
4.1 核心研究合作网络
陈智能的学术合作网络以复旦大学FVL实验室为核心枢纽,向外辐射至合肥工业大学文本识别研究生态、上海人工智能实验室与HiDream.ai等产业研究团队,形成了多圈层、跨机构、产学研交织的合作图谱。
陈智能—姜育刚合作轴线(实验室主任—核心成员的长期合作): 姜育刚教授是陈智能所在的FVL实验室主任、复旦大学副校长、IEEE Fellow、IAPR Fellow、ACM杰出会员、教育部长江学者特聘教授。姜育刚主要从事多媒体信息处理、计算机视觉、可信通用人工智能研究,谷歌学术总引用2.4万余次,H指数78,是国家科技创新2030"新一代人工智能"重大项目负责人和上海市智能视觉计算协同创新中心主任。陈智能与姜育刚的合作贯穿其几乎全部代表性论文,从CDistNet(IJCV'24)、MRN(ICCV'23)、LRANet(AAAI'24 oral)、DreamMesh(ECCV'24)、SVTR(IJCAI'22)到ICCV 2025、AAAI 2026等最新论文,姜育刚通常以通讯作者(论文末位)身份出现,是陈智能学术产出的最稳定合作轴线。这一合作既体现FVL实验室内部的学术传承体系,也反映了姜育刚在多媒体与视觉理解方向长期积累对陈智能研究方向的支撑。
陈智能—梅涛合作轴线(复旦大学—HiDream.ai/前MSRA/前京东的产学研跨机构合作): 梅涛(Tao Mei)现任复旦大学兼职教授、加拿大工程院外籍院士、IEEE Fellow、IAPR Fellow、ACM Distinguished Scientist、2025年ACM Fellow,科技部科技创新2030人工智能重大项目"智能供应链人工智能开放创新平台"首席科学家。梅涛的职业生涯横跨微软亚洲研究院(MSRA,任高级研究经理,12年间出货20余项技术与发明至微软产品)、京东(任副总裁与京东探索研究院副院长)与创业(创立HiDream.ai智象未来,专注视觉生成式多模态基础模型)。其学术影响力极为突出:发表论文300余篇,引用超4万次,H-index 99,15次获国际论文奖,拥有60余项美/国际专利。陈智能与梅涛的合作集中于文本驱动3D生成、文本引导物体修复等视觉语言生成方向,代表作包括DreamMesh(ECCV'24)、3DStyle-Diffusion(MM'23)、Improving Text-guided Object Inpainting(ECCV'24)等,通常以Yingwei Pan、Ting Yao、Zhineng Chen、Yu-Gang Jiang、Tao Mei的合作序列出现。这一合作链条将陈智能的研究网络连接到MSRA—京东—HiDream.ai这条产业级视觉生成研究主脉,是产学研协同的重要桥梁。
陈智能—潘映玮—姚婷合作轴线(梅涛研究组的视觉语言生成子网络): 潘映玮(Yingwei Pan)和姚婷(Ting Yao)是梅涛研究组的核心成员,长期在MSRA/京东时期与梅涛合作,现与陈智能在FVL的合作链条上形成稳定的视觉语言生成研究小组。潘映玮与姚婷的研究聚焦于文本到3D生成、视觉语言对齐等方向,是陈智能团队在多模态生成方向与梅涛研究组对接的关键节点。这一合作轴线在DreamMesh、3DStyle-Diffusion等多篇论文中反复出现,构成了陈智能学术网络中"复旦FVL—梅涛研究组"跨机构合作的最频繁路径。
陈智能—高心报—谢洪涛合作轴线(合肥工业大学文本识别研究生态): 高心报(Xieping Gao)和谢洪涛(Hongtao Xie)是与陈智能在OCR与文档理解方向长期合作的学者,从其在合工大计算机与信息学院的研究方向(文本识别、模式识别)可推断二者与陈智能存在学术传承或同源训练关系。在论文作者序列中,高心报通常出现在倒数第二位(如CVPR'24论文"Yang Luo, Zhineng Chen, Peng Zhou, Zuxuan Wu, Xieping Gao, Yu-Gang Jiang"),符合"原导师—现合作者"的典型位置特征。谢洪涛则出现在IJCV'24 CDistNet等论文中,是合肥工业大学文本识别研究生态的核心成员。这一合作轴线连接了复旦大学FVL与合肥工业大学文本识别研究传统(包括汪萌教授、洪日昌教授等学者所在的合工大计算机与信息学院体系),是陈智能学术网络的"师承回流"路径。
陈智能—吴祖煊—周鹏合作轴线(FVL内部跨方向合作): 吴祖煊(Zuxuan Wu)是FVL实验室教授,与陈智能同为姜育刚团队核心成员,在视觉表征学习、多模态融合、异常检测等方向有密切合作。周鹏(Peng Zhou)也是陈智能论文中的高频合作者,在增量学习、视觉表征方向有多篇联合产出。这一轴线体现了FVL内部教师间的协同合作生态,是实验室多方向交叉研究的组织基础。
4.2 国际与校际学术合作
陈智能的国际与校际学术合作主要通过两条路径展开。其一是通过顶级会议论文发表的联合研究,其论文合作者网络覆盖Microsoft Research Asia、京东AI Research、HiDream.ai等产业研究机构,以及与Tao Mei研究组(MSRA—京东—HiDream.ai一脉)的国际合作者链条。陈智能在IEEE TPAMI、CVPR、ICCV、ECCV、AAAI、IJCAI、ACM MM等顶级会议和期刊上发表论文80余篇,国际合作者包括Yingwei Pan、Ting Yao、Yehao Li(李克豪)等长期合作伙伴。
其二是通过学术服务网络。陈智能担任ACM MM、AAAI等多个权威国际会议的领域主席和高级程序委员,以及IEEE TPAMI等多个知名国际期刊的审稿人,通过审稿与组织工作与国际学术界保持紧密联系。其学术兼职身份——上海市智能视觉计算协同创新中心副主任、上海市计算机学会多媒体专委会主任、中国图象图形学学会多媒体专委会常务委员——也使他在国内多媒体与计算机视觉学术共同体中担任组织节点,连接了国内主要高校与产业研究团队的交流网络。他还曾受邀在湖南师范大学等信息学院做《视觉与语言协同的场景文本识别》主题讲座,反映了其在OCR与文档理解方向的学术影响力辐射。
五、业界合作关系深度分析
5.1 产业合作与成果转化
陈智能的产业合作网络具有鲜明的"产学研一体化"特征,覆盖搜索引擎、自动驾驶、智能制造、文档智能、视觉生成等多个落地场景,是FVL实验室在产业转化方向的代表性PI之一。
百度合作轴线(OCR与文档智能): 陈智能承担了多项百度科研项目,研究内容集中于场景文本识别、文档理解与多模态文档智能。这一合作方向与其学生杜永坤、苏宇辰、郑天伦等在SVTR、CDistNet、MRN等OCR基础模型方向的高产出密切呼应。百度在OCR与文档智能领域有产业级应用需求(百度OCR、百度智能云文档识别等产品),陈智能团队的OCR基础研究成果通过技术系统部署应用于百度相关产品线,形成了"基础研究—产业部署—竞赛验证"的闭环。2024年杜永坤、苏宇辰荣获PaddleOCR算法模型挑战赛"OCR端到端识别"赛道冠军,进一步验证了陈智能团队OCR技术与百度飞桨生态的深度适配。
腾讯合作轴线(多模态与博士生激励计划): 陈智能承担多项腾讯科研项目,研究方向覆盖多模态学习、视觉内容生成等。2025年杜永坤入选"中国电子学会—腾讯博士生科研激励计划",该计划是腾讯与学术界联合培养高层次人才的重要渠道,反映了陈智能团队与腾讯在人才培养与技术研发双线合作的深度。腾讯在视觉内容理解、多模态大模型、文档智能等方向有产业级布局(腾讯优图、腾讯AI Lab等),陈智能团队的研究方向与之高度契合。
阿里合作轴线(视觉内容理解与生成): 陈智能亦承担阿里巴巴相关科研项目。阿里在视觉内容理解、电商图像分析、文档智能(达摩院OCR、通义千问多模态)等方向有深厚的产业布局,陈智能团队在OCR、多模态生成、视觉表征方向的研究能力与阿里产业需求形成对接。
交通部公路院合作轴线(交通感知与智能制造): 陈智能承担交通部公路院科研项目,是其在"面向智能制造的跨域融合感知关键技术及应用"方向取得2023年度上海市技术发明一等奖的重要产业支撑之一。交通部公路院合作涉及交通场景感知、智能制造视觉检测等应用方向,是陈智能产业合作从纯互联网领域向传统工业与基础设施领域延伸的标志。其研发技术系统已部署应用于国家相关部门,体现了产业合作的国家级定位。
软控合作轴线(智能制造与工业视觉): 软控(赛轮集团相关企业)是一家聚焦橡胶机械与智能制造的上市公司,陈智能承担软控科研项目反映了其在工业视觉检测、智能制造质量监控等方向的产业拓展。这一合作将陈智能团队在视觉感知与多模态理解的技术能力落地到橡胶工业等具体制造场景,是FVL实验室"跨域融合感知"主题在制造业的典型应用。
HiDream.ai(智象未来)合作轴线(视觉生成式基础模型): 通过梅涛创立的HiDream.ai,陈智能的研究网络间接连接到视觉生成式多模态基础模型的产业化前沿。HiDream.ai专注围绕视觉打造生成式多模态基础模型及应用,与陈智能团队在文本驱动3D生成(DreamMesh、3DStyle-Diffusion)、文本引导物体修复(CaTdiffusion)等方向的研究有天然的协同性。这一合作链条将陈智能的学术研究与中国AIGC产业的最前沿对接,具有较大的产业转化潜力。
上海人工智能实验室双聘身份(AI Lab产业研究生态): 陈智能曾任上海人工智能实验室双聘青年科学家,这一身份使其研究网络同时覆盖复旦大学学术圈与上海人工智能实验室(AI Lab)的产业研究生态。上海AI Lab是上海市主导的新型研发机构,在通用人工智能、大模型、具身智能等方向有重要布局(如书生(Intern系列)大模型、OpenRobotLab具身智能平台等),陈智能的双聘身份为他在具身感知方向的最新研究布局提供了产业资源支撑。
产业合作的国家级定位与系统部署: 陈智能"所研发技术系统部署应用于国家相关部门和多个行业领先企业"的官方表述,反映了其产业合作不是孤立的横向项目,而是形成系统化的国家级技术部署能力。这种系统部署能力依托FVL实验室整体实力(实验室成果获2026年上海市科技进步一等奖、姜育刚教授获2026年何梁何利基金奖与第四届全国创新争先奖状),是陈智能产业合作网络区别于一般高校横向项目的显著特征。
5.2 政府与社会合作
陈智能通过FVL实验室和上海市智能视觉计算协同创新中心平台,与政府部门和学术共同体建立了深度合作关系。上海市智能视觉计算协同创新中心是省部级科研平台,陈智能担任副主任,是该中心在OCR、文档理解与多模态生成方向的核心组织者之一。中心由姜育刚教授担任主任,统筹复旦大学在视觉智能方向的产学研资源,与上海市"三大先导产业"中的人工智能产业战略对接。
在学术共同体服务方面,陈智能担任上海市计算机学会多媒体专委会主任,是上海地区多媒体与计算机视觉学术共同体的组织节点。他还担任中国图象图形学学会多媒体专委会常务委员(此前为委员、副秘书长),通过这些学术兼职组织国内学术会议、专项研讨会和产学研对接活动,构建了FVL与国内多媒体学术圈、产业圈的常态化连接。
在科普与社会服务方面,陈智能积极回母校株洲市二中做《人工智能:从归纳到创造》科普讲座,从人工智能起源、2012年黄金时代(归纳)、2022年新序幕(创造)、人机共融发展四个维度向中学生介绍AI发展历程。他还参与复旦大学"周末先修学堂"等面向中学生的前置培养项目,与马兴军、欧阳万里、张奇、吴祖煊、叶广楠、陈思明、曲文等复旦教师共同授课,体现了其在中学生科普与拔尖人才前置培养方面的社会贡献。他还曾作为对谈嘉宾与UCloud创始人季昕华共同探讨DeepSeek对行业的影响,反映了其在AI产业趋势研判方面的公众影响力。
六、重要奖项与学术兼职
| 年份 | 奖项/荣誉 | 类别 |
|---|---|---|
| 2026 | FVL实验室成果获上海市科技进步一等奖(团队成员) | 省部级科技奖励 |
| 2025 | 指导学生杜永坤入选2025年度中国电子学会—腾讯博士生科研激励计划 | 指导荣誉 |
| 2025 | 指导学生杜永坤获国家自然科学基金青年学生基础研究项目(博士研究生)资助 | 指导荣誉 |
| 2025 | 指导学生杜永坤、叶兴松论文被ICCV 2025接收 | 论文指导 |
| 2025 | 指导学生李时杰、杜永坤、白维康论文被AAAI 2026接收 | 论文指导 |
| 2025 | 指导学生苏宇辰论文被IEEE TPAMI接收 | 论文指导 |
| 2025 | 指导学生郑天伦获2024年度中国电子学会优秀硕士论文奖 | 指导荣誉 |
| 2024 | 指导学生杜永坤、苏宇辰获2024年PaddleOCR算法模型挑战赛"OCR端到端识别"赛道冠军 | 国际竞赛冠军 |
| 2024 | 指导学生杜永坤、苏宇辰获2024全球人工智能技术创新大赛算法挑战赛一等奖 | 国际竞赛一等奖 |
| 2024 | 指导学生罗扬论文被CVPR 2024接收 | 论文指导 |
| 2024 | 指导学生杨海波、陈奕夫论文被ECCV 2024接收 | 论文指导 |
| 2023 | 上海市技术发明一等奖("面向智能制造的跨域融合感知关键技术及应用") | 省部级科技奖励 |
| 2023 | 入选上海市东方英才计划拔尖项目 | 人才计划 |
| 2022 | 指导学生杜永坤论文SVTR被IJCAI 2022接收 | 论文指导 |
陈智能担任的学术兼职包括:上海市智能视觉计算协同创新中心副主任、上海市计算机学会多媒体专委会主任、中国图象图形学学会多媒体专委会常务委员、ACM MM与AAAI等多个权威国际会议领域主席与高级程序委员、IEEE TPAMI等多个知名国际期刊审稿人。这些兼职覆盖了省部级科研平台、全国性学术专委会、国际顶级会议和期刊四个层次,构成了陈智能在视觉智能与多媒体学术共同体中的组织节点身份。
七、Connection圈层总结
陈智能的学术关系网络以复旦大学FVL实验室为内圈核心,向外辐射至合肥工业大学文本识别研究生态、上海人工智能实验室与HiDream.ai等产业研究团队,以及百度、腾讯、阿里、交通部公路院、软控等产业合作网络,呈现出"师承合工大—主脉复旦FVL—产业辐射全国"的多圈层结构,可归纳为以下四个层次。
第一圈层:FVL实验室核心圈。 这一圈层以姜育刚教授(复旦大学副校长、IEEE Fellow、IAPR Fellow、长江学者)为实验室主任,陈智能为OCR、文档理解与多模态生成方向的独立PI。同圈层教师包括吴祖煊(教授)、曹艺馨(青年研究员)、陈静静(教授)、马兴军(青年研究员)、贾萧松(助理教授)、叶子逸(助理教授)等,是陈智能日常合作与师生共享的最紧密学术共同体。姜育刚—陈智能合作轴线贯穿其绝大多数论文,是陈智能学术产出的最稳定基础。这一圈层是陈智能学术与产业项目执行的最核心依托。
第二圈层:复旦大学FVL—梅涛研究组—HiDream.ai产学研合作圈。 这一圈层以梅涛(复旦大学兼职教授、加拿大工程院外籍院士、IEEE Fellow、ACM Distinguished Scientist、2025年ACM Fellow、HiDream.ai创始人、前MSRA高级研究经理、前京东副总裁)为关键节点,连接陈智能研究网络到MSRA—京东—HiDream.ai这条产业级视觉生成研究主脉。Yingwei Pan、Ting Yao等梅涛研究组核心成员是陈智能团队在文本驱动3D生成、视觉语言生成方向的最频繁合作者。这一圈层使陈智能的学术研究与中国AIGC产业最前沿对接,是产学研协同的关键桥梁。陈智能—高心报—谢洪涛合作轴线同时将陈智能的师承回流至合肥工业大学文本识别研究生态,连接了合工大汪萌—洪日昌—高心报—谢洪涛这一OCR与模式识别研究传统,是第二圈层的另一重要支脉。
第三圈层:学生培养与博士生社区圈。 陈智能的学生培养网络以OCR与多模态生成为双主线,博士线包括杜永坤(SVTR/CPPD/IGTR系列,TPAMI×2、ICCV、IJCAI、AAAI一作,PaddleOCR冠军)、苏宇辰(AAAI×2、TPAMI、TMM一作,PaddleOCR冠军)、罗扬(CVPR一作,生物医疗方向)、杨海波(DreamMesh等3D生成方向,ECCV一作)、李时杰、白维康、叶兴松等,构成了陈智能学术影响力的代际延伸。硕士线包括郑天伦(IJCV/ICCV/IJCAI一作,中国电子学会优秀硕士论文奖)、黄丙晨(AAAI一作)、孙可欣(CVPR一作)、陈奕夫(ECCV一作)等。毕业生去向多元,覆盖美团、快手、华为、携程等互联网与科技企业,德邦基金等金融机构,以及宁波、黑龙江省公安厅等政府选调岗位,反映了陈智能团队在产业算法、政务数字化、金融科技等多个赛道的人才输出能力。这一圈层是陈智能学术影响力未来5—10年扩展的主要载体。
第四圈层:产业合作与社会影响圈。 陈智能的产业合作网络通过FVL实验室和上海市智能视觉计算协同创新中心平台实现,覆盖百度(OCR与文档智能)、腾讯(多模态与博士生激励计划)、阿里(视觉内容理解)、交通部公路院(交通感知与智能制造)、软控(工业视觉)等多个产业领域,并间接通过梅涛的HiDream.ai连接到视觉生成式基础模型产业化前沿。所研发技术系统部署应用于国家相关部门和多个行业领先企业,体现了产业合作的国家级定位。陈智能还通过担任上海市计算机学会多媒体专委会主任、中国图象图形学学会多媒体专委会常务委员等学术兼职,构建了FVL与国内多媒体学术圈、产业圈的常态化连接。上海人工智能实验室双聘青年科学家身份(曾任)进一步将其研究网络嵌入上海市AI产业研究生态。这一圈层是陈智能产业合作与社会影响力的最外延。
总体而言,陈智能是一位在OCR与文档理解、多模态生成、视觉表征学习三个方向均有重要产出的学者,其学术网络以姜育刚教授—FVL实验室为内圈根基,以梅涛—HiDream.ai/MSRA/京东合作链条为外圈产业脉胳,以合肥工业大学高心报—谢洪涛研究生态为师承回流路径,以百度—腾讯—阿里—交通部—软控等产业合作为应用出口,在复旦大学视觉智能研究体系中占据不可替代的位置。其学生培养在2024—2026年的集中爆发(杜永坤、苏宇辰、罗扬、杨海波、郑天伦等多人多顶会一作),预示着其学术影响力正处于代际放大的上升通道。