南大智能学院 司晨阳 准聘副教授
报告生成时间: 2026年8月
学院主页: https://is.nju.edu.cn/scy/main.htm 个人主页(PRLab): http://chenyangsi.top/ DBLP: https://dblp.org/pid/220/3068.html Google Scholar: https://scholar.google.com/citations?user=XdahAuoAAAAJ
一、学者基本信息
司晨阳(Chenyang Si),南京大学智能科学与技术学院(苏州校区)准聘副教授、特聘研究员,国家级青年人才(国家优秀青年基金(海外),"海优"),姑苏青年学者。研究方向为视觉理解与内容生成,涵盖计算机视觉基础网络、视频理解、生成模型基础研究、大规模视频/图像生成模型及生成模型的加速优化。其研发的多个生成算法已被集成至国际主流生成算法库(Hugging Face Diffusers、ComfyUI),并应用于多家企业产品系统;Google Scholar引用6800余次(截至2025年12月),单篇最高引用超过1000次。发表覆盖CVPR、ICCV、ECCV、ICLR、NeurIPS、AAAI、TPAMI、TIP、IJCV等顶会顶刊,其中5篇Oral、1篇Spotlight、1篇Highlight;担任CVPR、MVC领域主席及TPAMI、TIP、IJCV、NeurIPS等长期审稿人。
教育与工作经历: - 2021年,中国科学院自动化研究所模式识别国家重点实验室(NLPR)博士毕业。 - 2021年6月-2023年1月,新加坡SEA AI Lab(Sea AI Lab)研究员。 - 2023年2月-2025年2月,新加坡南洋理工大学MMLab博士后研究员。 - 2025年起,南京大学智能科学与技术学院(苏州校区)准聘副教授、特聘研究员。
研究主线与代表性贡献: 1. 骨架动作识别(博士期): AGC-LSTM(CVPR 2019)、时空推理与堆叠学习(ECCV 2018/Pattern Recognition 2020)等骨架序列建模工作,属NLPR视觉大数据团队传统强项。 2. 视觉基础网络: Inception Transformer(NeurIPS 2022,第一作者)与MetaFormer baselines(TPAMI 2024,与Weihao Yu、Shuicheng Yan、Xinchao Wang合作)——MetaFormer/PoolFormer系列已成为视觉骨干网络的重要基线,是其引用量最高的工作之一。 3. 视频生成体系(Vchitect生态): 作为Vchitect团队核心成员参与LaVie(IJCV 2025)、Vchitect-2.0、RepVideo等视频生成模型;VBench/VBench++(CVPR 2024 / TPAMI 2026)成为视频生成模型评测的事实标准。 4. 免训练生成加速与即插即用改进: FreeU(CVPR 2024,第一作者,Diffusion U-Net免训练增强,引用超千次级)、FreeInit(ECCV 2024)、FasterCache(ICLR 2025)、DCM一致性模型(ICCV 2025)——构成"生成质量与效率兼得"的方法论。
二、DBLP数据统计
2.1 发表记录总览
DBLP pid为220/3068,共收录87条发表记录(截至2026年8月):其中CoRR/arXiv预印本53篇,非CoRR的会议/期刊记录34篇。发表横跨2018-2026年,主题从骨架动作识别迁移至视频生成与视觉基础网络。
2.2 年度产出分布(非CoRR正式记录)
| 年份 | 论文数 | 年份 | 论文数 | 年份 | 论文数 |
|---|---|---|---|---|---|
| 2018 | 2 | 2022 | 4 | 2025 | 7 |
| 2019 | 1 | 2023 | 2 | 2026 | 4 |
| 2020 | 3 | 2024 | 10 | — | — |
| 2021 | 1 | — | — | — | — |
趋势分析: 全部记录(含CoRR)按年份分布为2018年5篇、2019年3篇、2020年4篇、2021年4篇、2022年9篇、2023年9篇、2024年16篇、2025年26篇、2026年11篇(截至8月)。三个阶段清晰:2018-2021年NLPR博士期的骨架动作识别;2021-2023年SEA AI Lab/初期视觉基础网络(iFormer);2023年入MMLab后进入视频生成爆发期,2024年(10篇正式记录)与2025年(26条含预印本)为双高峰,与Vchitect团队及VBench生态的产出节奏吻合。
2.3 主要发表会议/期刊分布(非CoRR,34篇)
| 会议/期刊 | 论文数 | 级别 | 会议/期刊 | 论文数 | 级别 |
|---|---|---|---|---|---|
| CVPR | 7 | CCF-A | IEEE TPAMI | 2 | CCF-A |
| ICCV | 4 | CCF-A | ICLR | 2 | 未分级(顶级) |
| ECCV | 4 | CCF-B | NeurIPS | 3 | CCF-A |
| AAAI | 2 | CCF-A | Pattern Recognit. | 2 | CCF-B |
| IJCAI | 1 | CCF-A | IJCV | 1 | CCF-A |
| SIGGRAPH | 1 | CCF-A | IEEE TIP | 1 | CCF-A |
| IEEE TVCG | 1 | CCF-A | IEEE RA-L | 1 | - |
| ICMR | 1 | 未分级 | — | — | — |
CVPR+ICCV+ECCV三大视觉会议合计15篇(44%),加上TPAMI/TIP/IJCV/TVCG等期刊,视觉主战场布局完整;NeurIPS/ICLR/SIGGRAPH承载基础网络与加速方向的跨领域工作。
2.4 合作者网络总览
DBLP记录对应214位唯一合作者,规模居四位调研对象第二位(仅次于符天凡)。网络呈"NLPR启蒙—SEA AI Lab—NTU MMLab双核心—回国新团队"的四级跃迁结构,其中NTU MMLab的Ziwei Liu(刘子玮)与上海AI Lab/中科院的Yu Qiao(乔宇)为两大平台型合作枢纽。
2.5 核心合作者(Top 20,按DBLP合作频次降序)
| 排名 | 合作者(DBLP名) | 合作次数 | 合作年份 | 身份/机构与关系 |
|---|---|---|---|---|
| 1 | Ziwei Liu 0002(刘子玮) | 37 | 2023-2026 | 南洋理工大学MMLab教授,博士后合作导师 |
| 2 | Liang Wang 0001(王亮) | 23 | 2018-2025 | 中科院自动化所研究员(IEEE/CCF Fellow),博士导师 |
| 3 | Yu Qiao 0001(乔宇) | 17 | 2023-2026 | 上海AI Lab主任/中科院自动化所研究员 |
| 4 | Tieniu Tan(谭铁牛) | 16 | 2018-2023 | 中科院院士,现南大党委书记、智科院学科带头人 |
| 5 | Yuming Jiang 0003(蒋雨明) | 14 | 2023-2026 | ETH Zurich博士/上海AI Lab,Vchitect团队伙伴 |
| 6 | Wei Wang 0115 | 14 | 2018-2021 | 中科院自动化所NLPR,博士期间团队教师 |
| 7 | Ziqi Huang(黄子琪) | 13 | 2023-2026 | NTU MMLab博士生→教师线,VBench第一作者 |
| 8 | Zhengyao Lv(吕政遥) | 10 | 2024-2026 | 香港大学博士生,FreeU/FasterCache共同作者 |
| 9 | Dahua Lin(林达华) | 9 | 2023-2026 | 香港中文大学教授,MMLab系 |
| 10 | Caifeng Shan(单彩峰) | 8 | 2025-2026 | 南大智科院教授(长江学者),新同事 |
| 10 | Tianxing Wu 0002(吴天星) | 8 | 2023-2025 | NTU博士生,FreeInit/LaVie |
| 12 | Yinan He(何逸楠) | 7 | 2023-2026 | 上海AI Lab/VBench团队 |
| 12 | Yaohui Wang 0001(王耀辉) | 7 | 2023-2026 | 上海AI Lab,LaVie/AnimateDiff一作 |
| 12 | Xinyuan Chen(陈鑫远) | 7 | 2023-2026 | 上海AI Lab/Vchitect |
| 12 | Tianlin Pan(潘天林) | 7 | 2025-2026 | 港大博士生,2025年后最密切合作者 |
| 12 | Weihao Yu 0001(余伟豪) | 7 | 2021-2024 | NUS博士生→港城大助理教授,MetaFormer一作 |
| 12 | Pan Zhou 0002 | 7 | 2021-2024 | NUS研究员,iFormer/MetaFormer |
| 12 | Yichen Zhou | 7 | 2021-2024 | NUS相关,MetaFormer系列 |
| 12 | Shuicheng Yan(颜水成) | 7 | 2021-2024 | NUS教授(IEEE/ACM Fellow),MetaFormer线 |
| 12 | Xinchao Wang(王鑫超) | 7 | 2021-2024 | NUS副教授,iFormer/MetaFormer |
| 20 | Chen Change Loy(吕健勤) | 6 | 2023-2025 | 南洋理工S-Lab教授 |
双核心结构: Ziwei Liu(37次)与王亮(23次)分别主导其海外期与博士期网络;谭铁牛(16次)既是博士期的NLPR学术谱系上游(王亮的导师),又在其回国后成为智科院的直接领导(司晨阳入职的学院由谭铁牛任学科带头人),师承与服务关系在此形成闭环。
三、博士教育背景与导师追溯
3.1 中科院自动化所NLPR博士阶段(约2017-2021)
司晨阳于中科院自动化所模式识别国家重点实验室获博士学位(2021年)。其博士期全部论文的署名单元高度稳定:Chenyang Si、Wei Wang、Liang Wang、Tieniu Tan(CVPR 2018/2019、ECCV 2018/2020、AAAI 2020、Pattern Recognition 2020、IJCAI 2021),表明其属NLPR王亮研究员(视觉大数据团队)指导的博士生,谭铁牛院士作为团队创始人在多数论文署名。该团队以骨架动作识别、行人重识别、视觉大数据分析著称。
3.2 师承谱系
谭铁牛(中科院院士,NLPR创始人)
└─ 王亮(博士2004届NLPR,中科院自动化所研究员,IEEE/CCF/CAAI Fellow)
└─ 司晨阳(博士2021届NLPR;SEA AI Lab研究员;NTU MMLab博士后;南大智科院准聘副教授,2025-)
└─ PRLab团队成员(2025年起,主页显示积极招募博士/硕士/RA/实习生)
该链条的特别之处在于"回流":谭铁牛2022年出任南京大学党委书记并亲自在苏州校区智科院建立专职科研团队(NJU-PR Lab),其"全国唯二"的团队布局使司晨阳从谭铁牛—王亮谱系的博士生转变为谭铁牛领导学院的青年教师。第三方分析亦将其列入谭铁牛智科院团队(NJU-PR lab)核心成员("司晨阳(海优)")。
3.3 与上游导师网络的关系
| 上游节点 | 关系 | DBLP直接合作 | 合作特征 |
|---|---|---|---|
| 王亮 | 博士导师(NLPR团队负责人) | 23次(2018-2025) | 骨架动作识别、行人搜索;回国后仍有合作延续至2025年 |
| 谭铁牛 | 学术谱系上游、现学院学科带头人 | 16次(2018-2023) | 博士期署名;现为其雇主单位领导 |
| Ziwei Liu | 博士后合作导师 | 37次(2023-2026) | 视频生成、VBench、FreeU全系列 |
| Shuicheng Yan / Xinchao Wang | SEA AI Lab期合作者 | 各7次(2021-2024) | Inception Transformer、MetaFormer |
四、南大智科院团队合作网络
4.1 NJU-PR Lab与同事层(苏州校区)
司晨阳是谭铁牛在智科院视觉方向的NJU-PR Lab(模式识别实验室/视觉计算与智能感知研究中心)核心成员之一。DBLP已显示其与同院教授单彩峰(Caifeng Shan,长江学者,8次合作,2025-2026)建立活跃合著关系(GOOD/Natcom、Ivy-Fake AIGC检测、视频理解等),表明入职后南大校内网络快速成型。该实验室其他成员包括赵放、吕月明、徐科、傅朝友、樊艳波、房钰棋、王帅等(据第三方整理,官方页面为准)。
4.2 Vchitect/MMLab国际合作集群(2023-2026)
博士后期的合作网络围绕两个枢纽展开:其一为NTU MMLab的Ziwei Liu课题组(Ziqi Huang、Yuming Jiang、Chen Change Loy等),其二为上海AI Lab的Vchitect团队(Yu Qiao、乔宇;Yaohui Wang、Yinan He、Jiashuo Yu等)。两大集群高度重叠于LaVie、VBench、VideoBooth等大项目——这些项目通常由十几至二十位作者联合署名,是当前视频生成领域"大兵团作战"的典型形态。
4.3 2025-2026年新合作格局
| 合作者 | 合作次数 | 机构 | 主要交集 |
|---|---|---|---|
| Tianlin Pan | 7 | 香港大学 | 跨模态交互(ICCV 2025)、DCM一致性模型 |
| Zhengyao Lv | 10 | 香港大学 | FreeU、FasterCache、DCM |
| Caifeng Shan | 8 | 南大智科院 | OOD检测、AIGC检测 |
| Jianxiong Gao | 5 | 未知/新团队 | GOOD相关 |
| Xiaojie Xu | 6 | 新团队/南大 | VBench++、局部学习 |
港大Kwan-Yee K. Wong组(6次)与港大黄子琪等成为其博士后出站后最活跃的论文伙伴,同时南大校内(单彩峰)合作并行推进。
4.4 人才培养的起点
其个人主页(PRLab @ Nanjing University)显示实验室"积极招募博士生、硕士生、研究助理、实习生",研究方向包括视频生成、智能体(Agent记忆架构、agentic RL、沙盒、社会模拟)、具身智能(世界模型、World Action Models)、统一视觉生成与理解、高效生成模型、评测基准六大板块。其中Agent与具身智能方向是2025年入职后的新拓展,超出其DBLP既有记录的主题范围。
五、业界合作关系深度分析
5.1 生成算法库集成——最直接的产业渗透
据学院官方页面,其研发的多个生成算法已被集成至Hugging Face Diffusers与ComfyUI——二者分别是全球最大的开源扩散模型库与节点式生成工作流引擎。FreeU、FreeInit等免训练方法天然适合此类"即插即用"分发,官方明确说明其"成功应用于多家企业的产品系统"(具体企业名单公开资料未披露)。以Diffusers的下载量级计,这是四位调研对象中工程影响面最广的成果转化形态。
5.2 SEA AI Lab(2021-2023)——产业研究院经历
Sea AI Lab是东南亚互联网公司Sea Group(冬海集团,Garena/Shopee母公司)设立的AI基础研究院。司晨阳2021-2023年在该机构任研究员,与Weihao Yu、Xinchao Wang、Shuicheng Yan等合作产出Inception Transformer(NeurIPS 2022)等工作。该经历兼具产业属性与学术自由度,属企业研究院而非产品部门。
5.3 上海AI Lab Vchitect团队——机构级大规模协作
2023-2026年与上海人工智能实验室(Yu Qiao乔宇系)的17次合作均属Vchitect/LaVie/VBench大项目。上海AI Lab是国内视频生成领域投入最大的新型研发机构之一,VBench亦由该生态发布与维护。此通道属学术机构间协作,但面向开源社区与企业评测需求。
5.4 VBench——评测标准的行业影响
VBench/VBench++(CVPR 2024、TPAMI 2026)已成为视频生成模型评测的事实标准之一,被业界模型发布广泛引用。评测基础设施的影响力通常高于单篇方法论文,是其产业可见度的重要来源。
5.5 产业问题与技术路线的对应关系
| 产业/应用约束 | 司晨阳相关技术议题 | 代表通道 |
|---|---|---|
| 视频生成推理成本高、延迟大 | 免训练加速、一致性模型、缓存复用 | FreeU/FreeInit/FasterCache/DCM |
| 生成质量不可控、需即插即用改进 | U-Net/初始化/采样过程改进 | FreeU系列 |
| 生成模型缺乏统一评测、宣传口径混乱 | VBench/VBench++多维评测 | Vchitect生态 |
| 生成内容滥用与检测需求 | 图像/视频AIGC检测(Ivy-Fake) | 与单彩峰合作 |
| 骨架/动作数据稀缺(早期) | 骨架动作识别、自监督学习 | NLPR博士期 |
六、Connection圈层总结
第一圈层——双导师核心: 王亮(23次,2018-2025)与Ziwei Liu(37次,2023-2026)分别构成其博士期与博士后期的绝对中心;前者赋予NLPR视觉大数据的谱系与方法训练,后者将其带入视频生成与MMLab国际网络。两段关系在时间上无缝衔接且在回国后均有延续。
第二圈层——谭铁牛谱系闭环: 谭铁牛既是其博士论文署名者(王亮的导师,三代谱系上游),又是其现任学院的学科带头人。司晨阳的回国入职是谭铁牛"唯二专职团队"(自动化所+南大)布局的组成部分,属谱系网络驱动的典型引才案例。
第三圈层——Vchitect/MMLab大兵团: Yu Qiao(17次)、Ziqi Huang/Yuming Jiang/Yinan He等构成的上海AI Lab—NTU—港中文联合网络,承载LaVie、VBench、RepVideo等旗舰项目;该网络是其学术声量的放大器。
第四圈层——南大智科院新网络: 与单彩峰(长江学者)的8次合作及NJU-PR Lab平台,使其在入职一年内完成校内网络落地;PRLab六大方向(含Agent与具身智能新拓展)显示其独立研究议程的成形。
第五圈层——产业与开源生态: Diffusers/ComfyUI集成与企业应用构成可验证的产业影响;SEA AI Lab经历提供企业研究院背景;VBench评测标准带来行业级可见度。
产出规模与发展阶段: 87条DBLP记录、214位唯一合作者、非CoRR记录34篇(CVPR/ICCV/ECCV合计15篇)、引用6800余次、国家级青年人才(海优)。其核心学术定位是"视频生成的质量—效率—评测三位一体"研究者,兼具NLPR谱系的本土根基与MMLab/Vchitect的国际网络,是智科院视觉方向青年梯队的代表性成员,也是四位调研对象中唯一确认隶属智能科学与技术学院(苏州校区)者。
七、数据来源与局限性说明
本报告主数据来自DBLP官方作者消歧记录(pid: 220/3068,87条发表记录),并结合以下公开信息源:
- 南京大学智能科学与技术学院官方教师页面(履历、职务、荣誉、引用量、研究综述)
- PRLab个人主页 chenyangsi.top(六大研究方向、项目链接、招生信息)
- DBLP作者XML记录(发表类型、年度分布、共同作者统计)
- 中科院自动化所官网(王亮、模式识别实验室背景,用于谱系核实)
- 第三方学科分析文章(谭铁牛NJU-PR Lab团队构成,含"司晨阳(海优)"表述,交叉验证学院归属)
局限性说明:
- 博士导师的表述: 学院官方页面仅说明"2021年博士毕业于中科院自动化所模式识别国家重点实验室",未直接点名导师。本报告依据其博士期论文署名结构(王亮、谭铁牛稳定出现于全部第一作者论文)推断王亮为指导教师、谭铁牛为谱系上游,此为基于公开署名证据的合理推断而非官方自述。
- 预印本比例高: 87条记录中53条为CoRR/arXiv;非CoRR统计(34篇)与全量统计(87条)差异较大,年度分布按非CoRR口径呈现,趋势分析同时参考全量。
- "海优"表述来源: 国家级青年人才(海外优青)身份由学院页面"国家级青年人才"及第三方"司晨阳(海优)"表述交叉印证,官方页面未注明具体项目名称。
- 团队/学生名单: NJU-PR Lab成员构成主要依据第三方整理,以学院官方页面为准;PRLab学生名单未公开,不作推断。
- 企业应用细节: "多家企业产品系统"应用的具体企业、部署规模未公开披露,报告仅作定性陈述。