人大高瓴 王希廷 预聘副教授
报告生成时间: 2026年7月
个人主页: https://gsai.ruc.edu.cn/wangxt DBLP: https://dblp.org/pid/134/4020.html(英文名 Xiting Wang,DBLP未做同名消歧,存在同名合并) ORCID: 0000-0001-5768-1095 Google Scholar ID: urC8meQAAAAJ
一、学者基本信息
王希廷,中国人民大学高瓴人工智能学院预聘副教授(Tenure-track Associate Professor)、中国人民大学"杰出学者"。她是一位从工业界顶级研究机构转入高校的典型学者,职业轨迹清晰而连贯:
教育与工作履历(据个人主页官方履历):
| 时间段 | 单位 | 身份 |
|---|---|---|
| 2007--2011 | 清华大学 电子工程系 电子信息科学与技术专业 | 本科 |
| 2011--2017 | 清华大学 高等研究院(IIIS)计算机科学与技术学科 | 博士 |
| 2017--2018 | 微软亚洲研究院(MSRA) | 研究员(Researcher) |
| 2018--2022 | 微软亚洲研究院(MSRA) | 高级研究员(Senior Researcher) |
| 2022--2023 | 微软亚洲研究院(MSRA)社会计算组 | 首席研究员(Principal Researcher) |
| 2023--2024 | 中国人民大学高瓴人工智能学院 | 准聘助理教授 |
| 2023/2024年至今 | 中国人民大学高瓴人工智能学院 | 预聘副教授 |
研究方向: 大模型的解释、对齐与评测(可解释、负责任的人工智能)。具体细分为:高普适性概念解释与神经元功能解读(稀疏自编码器 SAE、概念激活向量 CAV)、大模型价值观对齐(内部对齐 / 外部对齐)、跨学科的大模型能力评测(心理测量学方法)。
代表性荣誉与学术任职:
- 2025年度吴文俊人工智能青年科技奖得主
- 入选北京市人才计划青年项目
- CCF自然科学二等奖(第四完成人)
- 两篇论文被CCF-A类期刊 IEEE TVCG 评选为封面论文
- 曾任/现任 IJCAI、AAAI、ICML 领域主席(Area Chair)
- IEEE VIS 组委会档案主席(Archive Chair)
- Q1 期刊 Visual Informatics 编委
- AAAI 2021 杰出高级程序委员(Distinguished SPC)
- 两次受邀在 SIGIR 可解释推荐研讨会上发表主旨演讲
- CCF 高级会员、IEEE 高级会员
产业落地成就(核心标签): 其可解释AI相关科研成果落地于必应(Bing)搜索引擎——全球市场占有率第二的搜索引擎。这是她区别于绝大多数纯学术背景同侪的最鲜明特征,也是本报告第六节深度分析的重点。
二、DBLP 数据统计
2.1 身份定位与消歧处理
DBLP 作者检索 API(https://dblp.org/search/author/api?q=Xiting%20Wang&format=json)返回唯一命中:Xiting Wang,pid = 134/4020,即 https://dblp.org/pid/134/4020.html。
DBLP 页面标注记录总数 n = 144 条。但经逐条核查,该 pid 下混入了至少 5 位同名"Xiting Wang"的非计算机/跨领域论文,DBLP 尚未对该姓名做作者消歧(该 person 记录的 mdate 停留在 2013-09-10,说明长期未维护)。本报告已人工剔除以下 9 条明显不属于本人的记录:
| 年份 | 期刊/会议 | 标题(截断) | 判定依据 |
|---|---|---|---|
| 2026 | Adv. Eng. Informatics | 航空发动机部件级建模(物理信息神经网络) | 航空动力学,合作者 Jincen Jiang / Zhongzhi Hu |
| 2022 | CICAI | 航空发动机剩余寿命预测(张量分解) | 同上团队 |
| 2024 | Appl. Artif. Intell. | 中文医疗命名实体识别的适配器微调 | 医学 NLP,无任何重叠合作者 |
| 2024 | Remote Sens. | 兰州盆地气溶胶垂直结构与光学性质 | 大气遥感 |
| 2023 | Database (Oxford) | MantaID:生物数据库ID识别工具 | 生物信息学 |
| 2022 | Patterns | 高熵合金氧还原催化剂的机器学习发现 | 材料化学 |
| 2021 | Briefings Bioinform. | 药物重定位的解剖治疗化学分类深度融合学习 | 药学 |
| 2020 | J. Chem. Inf. Model. | 药代动力学性质预测 | 药学(同上团队 Meng Liu / Yu Li / Tao Lu) |
| 2016 | Comput. Biol. Chem. | ALK肺癌耐药突变的分子动力学模拟 | 计算生物学 |
消歧后的本人记录:135 条,其中: - 会议论文(inproceedings)+ 期刊论文(article)扣除 arXiv/CoRR 预印本后为 78 篇同行评审正式论文 - CoRR(arXiv)预印本 57 条
78 篇的量级与人大高瓴官方讲座简介中"发表论文60余篇"(2025年6月的表述)以及个人主页成果清单基本吻合。
2.2 年度产出分布(消歧后 135 条,含预印本)
| 年份 | 2013 | 2014 | 2015 | 2016 | 2017 | 2018 | 2019 | 2020 | 2021 | 2022 | 2023 | 2024 | 2025 | 2026 |
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| 记录数 | 1 | 2 | 3 | 4 | 3 | 4 | 9 | 6 | 11 | 16 | 15 | 19 | 22 | 20 |
趋势解读: 呈现三段式明显跃迁。 1. 2013--2017(清华博士期,13条):低产出、高质量,几乎全部为可视分析顶刊/顶会(TVCG、VAST、KDD、AAAI、TKDE)。 2. 2018--2023(MSRA期,61条):产出翻番,研究方向从可视分析转向可解释推荐、公平性、新闻推荐等工业AI课题。 3. 2024--2026(人大期,61条):三年即追平MSRA六年的总量,2025年单年22条为历史峰值。注意:人大三年的产出量已与MSRA六年持平,说明其转入高校后借助博士生团队实现了产能的结构性放大。
值得注意的是 2024 年以后 CoRR 预印本占比大幅上升(2025年22条中有13条为 CoRR),这是转入高校、以学生为一作大量投稿 ACL/NeurIPS/ICLR 的典型模式。
2.3 发表场所分布(正式论文,消歧后)
| 场所 | 篇数 | 类型 |
|---|---|---|
| ACL(Main + Findings) | 16+ | CCF-A,近年绝对主战场 |
| IEEE TVCG | 8 | CCF-A 期刊,博士期主战场,含2篇封面论文 |
| AAAI | 7 | CCF-A |
| KDD | 6 | CCF-A |
| IJCAI | 5 | CCF-A |
| WWW(The Web Conference) | 4 | CCF-A |
| ICML | 3 | CCF-A |
| SIGIR | 3 | CCF-A |
| ACM TOIS | 2 | CCF-A 期刊 |
| NeurIPS | 2 | CCF-A |
| EMNLP(Main + Findings) | 3 | CCF-B/A |
| CIKM / ICDM | 各2 | CCF-B |
| Commun. ACM (CACM) | 1 | 计算机领域最高影响力综述型刊物 |
| ICLR | 1(DBLP收录)+2(主页列2026) | 顶会 |
| 其他(VAST、TKDD、ACM MM、NAACL、PacificVis、DASFAA、NLPCC、Vis. Informatics、TKDE) | 各1 |
结论:CCF-A 类论文占比极高,几乎全部产出集中在 A 类会议/期刊,是"少而精"型的高质量输出者。此外个人主页还列出了 DBLP 尚未收录的 Nature NPJ Artificial Intelligence(2025)与 Thinking Skills and Creativity(2025)两篇跨学科论文。
2.4 合作者规模
- 合作者总数:278 人(消歧后全部记录);仅出现1次的一次性合作者 123 人(占44%)
- 合作 ≥3 次的核心合作者约 66 人
- 合作 ≥5 次的紧密合作者约 33 人
第一作者论文 8 篇(TopicPanorama TVCG 2016、VAST 2016、KDD 2013、ICDM 2018、KDD 2021、WWW 2022、CACM 2026 等);末位作者(通讯位)论文 12 篇,且全部集中在 2024--2026 年(2024:3、2025:3、2026:6)——这一分布极为清晰地标记了她从"MSRA 执行型研究员"到"高校独立 PI"的角色转换时点,正好在 2024 年。
三、博士教育背景
3.1 清华大学求学经历
- 本科(2007--2011):清华大学电子工程系,电子信息科学与技术专业。
- 博士(2011--2017):清华大学高等研究院(Institute for Interdisciplinary Information Sciences, IIIS,姚班所在院系),计算机科学与技术学科。
注意:她本科为电子工程系而非计算机系,博士挂靠在高等研究院(交叉信息研究院)而非计算机系或软件学院,这一点比较特殊。清华IIIS由姚期智院士创立,以交叉学科培养见长,这可能与她后期热衷跨学科合作(心理学、社会学)的取向有一定渊源。
博士期间共发表 13 篇论文(2013--2017),全部集中在可视分析(Visual Analytics)与文本挖掘的交叉方向,代表作:
| 年份 | 场所 | 标题 | 作者位次 |
|---|---|---|---|
| 2013 | KDD | Mining evolutionary multi-branch trees from text streams | 第一作者 |
| 2015 | IEEE TKDE | Evolutionary Bayesian Rose Trees | 第二作者 |
| 2016 | IEEE TVCG | TopicPanorama: A Full Picture of Relevant Topics | 第一作者(TVCG封面论文之一) |
| 2016 | IEEE VAST | How ideas flow across multiple social groups | 第一作者 |
| 2016 | AAAI | Tracking Idea Flows between Social Groups | 第三作者 |
| 2016 | IEEE TVCG | Online Visual Analytics of Text Streams | 第三作者 |
| 2017 | IJCAI | Improving Learning-from-Crowds through Expert Validation | 第四作者 |
| 2017 | Vis. Informatics | Towards better analysis of machine learning models: A visual analytics perspective | 第二作者(高被引综述) |
| 2014 | PacificVis | Let It Flow: A Static Method for Exploring Dynamic Graphs | 第二作者 |
四、导师 / 师承分析
4.1 博士导师:刘世霞(Shixia Liu)
王希廷的博士导师为刘世霞(清华大学软件学院教授、IEEE Fellow、IEEE Visualization Academy 成员、IEEE VGTC 可视化技术成就奖得主)。二人合作22次(2013--2026),博士期13篇论文中13篇全部有刘世霞署名,且王希廷第一作者论文中刘世霞均为通讯作者。刘世霞的研究方向(可解释机器学习、文本可视分析)与王希廷现研究方向(可解释、负责任的人工智能)高度同源。王希廷简历中"两篇TVCG封面论文"与刘世霞简历中的同一成果互为佐证。需说明的是,官方主页未明文写出导师姓名,上述判定基于合作模式与方向传承。
刘世霞本人的履历(IBM中国研究院资深研究员/经理 → MSRA主任研究员 → 清华教授)与王希廷的履历(清华博士 → MSRA首席研究员 → 人大副教授)呈现出高度镜像的"工业界研究院 ↔ 顶尖高校"双向流动模式,师承的不只是研究方向,也包括职业路径的范式。
4.2 博士阶段其他重要合作者(同门 / 联合指导)
| 姓名 | 合作次数 | 合作年份 | 身份与关系 |
|---|---|---|---|
| 郭百宁(Baining Guo) | 6 | 2013--2016 | 微软研究院杰出科学家(Distinguished Scientist)、时任 MSRA 常务副院长,ACM/IEEE Fellow。在王希廷博士期的4篇论文(KDD'13、TKDE'15、TVCG'16、VAST'16、PacificVis'14)中署名末位,是刘世霞在MSRA的上级,属于联合指导/资源背书角色。这一关系直接为王希廷 2017 年毕业后进入 MSRA 铺平了道路 |
| 朱军(Jun Zhu 0001) | 5 | 2016--2018 | 清华大学计算机系教授,TSAIL 组负责人,贝叶斯深度学习权威。合作论文集中在 TopicPanorama(TVCG'16)、Visual Diagnosis of Tree Boosting(TVCG'18)、IJCAI'17、Vis. Informatics'17,提供概率图模型与贝叶斯方法的理论支撑,属于跨组的方法论合作导师 |
| 宋阳秋(Yangqiu Song) | 4 | 2013--2016 | 现香港科技大学副教授,当时为刘世霞组的合作者/博士后。参与 KDD'13、TKDE'15、AAAI'16 |
| 崔为炜(Weiwei Cui) | 3 | 2014--2016 | MSRA 研究员,可视化方向 |
| 刘梦尘(Mengchen Liu) | 3 | 2017 | 刘世霞组同门师兄弟,后加入微软 |
| 刘俊霖(Junlin Liu)、肖建楠(Jiannan Xiao)、陈建飞(Jianfei Chen 0001)、殷嘉伦(Jialun Yin)、曹科垒(Kelei Cao)、钟阳新(Yangxin Zhong) | 2--3 次 | 2014--2018 | 清华同门(刘世霞组 / 朱军组)成员,构成博士期实验室同期梯队。其中陈建飞现为清华大学计算机系副教授,曹科垒获2020年清华大学优秀硕士论文(刘世霞指导) |
| 裴健(Jian Pei 0001)、Kwan-Liu Ma、Nathalie Henry Riche、Daniel A. Keim、Christopher Collins | 各1--2 次 | 2014--2019 | 可视化/数据挖掘领域国际知名学者,通过刘世霞的国际网络接入的合作机会(含 TVCG'19 的文本可视化综述) |
4.3 师承脉络小结
王希廷的师承是一条清晰的"可视分析 → 可解释机器学习 → 大模型可解释性"演进链:
姚期智(清华IIIS体制创建者,非直接导师)
│
清华IIIS 培养体制
│
刘世霞(IBM→MSRA→清华,可解释ML+可视分析)——郭百宁(MSRA常务副院长,资源背书)
│ │
└────────── 王希廷(2011-2017 博士)──────────┘
│
朱军(清华,贝叶斯方法论支撑)
│
MSRA 社会计算组(2017-2023)
│
谢幸(MSRA,第二学术引路人)
│
中国人民大学高瓴(2023至今,独立PI)
五、现单位团队与核心合作者
5.1 全网络高频合作者总表(消歧后,合作 ≥4 次)
| 排名 | 合作者 | 合作次数 | 合作年份 | 所属机构 | 关系性质 |
|---|---|---|---|---|---|
| 1 | Xing Xie 0001(谢幸) | 49 | 2018--2026 | 微软亚洲研究院,高级首席研究经理 | MSRA 组长/学术引路人,最强绑定 |
| 2 | Shixia Liu(刘世霞) | 22 | 2013--2026 | 清华大学教授,IEEE Fellow | 博士导师 |
| 3 | Ruihua Song(宋睿华) | 15 | 2019--2026 | 中国人民大学高瓴长聘副教授 | 人大最紧密校内同事,且同为 MSRA 前同事 |
| 4 | Xiaoyuan Yi(衣晓远) | 13 | 2022--2026 | MSRA 研究员 | MSRA 同事,价值观对齐方向搭档 |
| 5 | Jing Yao 0003(姚菁) | 10 | 2023--2026 | MSRA 研究员 | MSRA 同事,价值观对齐/推荐推理 |
| 6 | Defu Lian(连德富) | 9 | 2022--2026 | 中国科学技术大学教授 | 跨校长期合作者 |
| 7 | Changyu Chen(陈昌宇) | 9 | 2022--2026 | 新加坡管理大学(SMU)博士生 | 学生辈合作者,MSRA实习起步 |
| 8 | Yiqiao Jin(金奕乔) | 9 | 2021--2024 | 佐治亚理工博士生(导师 Srijan Kumar) | MSRA 实习生出身,假新闻检测/原型微调 |
| 9 | Le Wu(吴乐) | 9 | 2018--2022 | 合肥工业大学教授 | 推荐系统公平性合作 |
| 10 | Meng Li(李萌) | 8 | 2024--2026 | 人大高瓴(推测博士生) | 现团队核心,概念解释/偏好优化/Agent RL |
| 11 | Kunpeng Liu 0001(刘鲲鹏) | 8 | 2022--2025 | 波特兰州立大学助理教授 | 跨国合作者,RATT/思维结构方向 |
| 12 | Fangzhao Wu(吴方照) | 8 | 2020--2024 | MSRA 首席研究员 | MSRA 同事,联邦学习/公平性 |
| 13 | Qian Cao 0001(曹乾) | 7 | 2024--2026 | 人大高瓴(宋睿华/王希廷共同指导) | 现团队核心,创意写作/多模态 |
| 14 | Xiang Ao(敖翔) | 7 | 2020--2025 | 中科院计算所研究员 | 长期合作者,新闻个性化/概念激活向量 |
| 15 | Jinghan Zhang 0002(张景涵) | 7 | 2024--2025 | 波特兰州立大学(刘鲲鹏组) | 跨国联合指导学生,RATT/原型奖励网络 |
| 16 | Zhihao Xu(许智昊,含 Zhihao Xu 0003) | 6+6=12 | 2024--2026 | 人大高瓴(推测博士生) | 现团队第一梯队,安全风险/多目标对齐/工具调用 |
| 17 | Rui Yan 0001(严睿) | 6 | 2022--2026 | 中国人民大学高瓴教授 | 校内同事 |
| 18 | Jianxun Lian(练建勋) | 6 | 2021--2025 | MSRA 研究员 | MSRA 同事,推荐系统 |
| 19 | Enhong Chen(陈恩红) | 6 | 2019--2023 | 中国科学技术大学教授 | 跨校长期合作 |
| 20 | Chuhan Wu(吴楚翰) | 6 | 2020--2023 | 清华电子系(现华为诺亚) | 新闻推荐公平性 |
| 21 | Yasha Wang(王亚沙) | 6 | 2019--2021 | 北京大学教授 | 可解释推荐/医疗预测合作 |
| 22 | Baining Guo(郭百宁) | 6 | 2013--2016 | 微软杰出科学家 | 博士期联合指导 |
| 23 | Hanyu Zhang(张涵宇) | 5 | 2024--2026 | 中科院计算所/人大 | 概念激活向量控制、SAE安全解释 |
| 24 | Haoran Jin(金浩然) | 5 | 2024--2026 | 人大高瓴(推测博士生) | 内部价值对齐、C2R(ICML 2026) |
| 25 | Chuhao Jin(金楚皓) | 5 | 2024--2025 | 人大高瓴(宋睿华组) | 说服对话、动作生成 |
| 26 | Weikai Yang(杨维铠) | 5 | 2020--2026 | 清华刘世霞组博士(2024届,清华优博) | 同门师弟 |
| 27 | Qing He 0003(何清) | 5 | 2021--2025 | 中科院计算所研究员 | 敖翔组合作 |
| 28 | Jingyue Gao(高竞跃) | 5 | 2019--2021 | 北大王亚沙组 | MSRA实习生,可解释推荐系列 |
| 29 | Jun Zhu 0001(朱军) | 5 | 2016--2018 | 清华大学教授 | 博士期方法论合作 |
| 30 | Richang Hong / Meng Wang 0001 | 各5 | 2018--2021 | 合肥工业大学教授 | 吴乐组合作 |
| 31 | Shijie Ren(任世杰) | 4 | 2025--2026 | 人大高瓴(推测博士生) | 时序可解释/扩散语言模型 |
| 32 | Xu Chen 0017(陈旭) | 4 | 2024--2025 | 中国人民大学高瓴教授 | 校内同事 |
| 33 | Ruixuan Huang(黄睿轩) | 4 | 2024 | 人大高瓴 | 概念激活向量安全风险 |
| 34 | Yizhou Sun(孙怡舟) | 4 | 2021--2023 | UCLA 教授 | 金奕乔的合作导师 |
| 35 | Meeyoung Cha / Sungwon Han | 各4 | 2022--2023 | KAIST / MPI | 国际合作(自解释逻辑规则、公平表征) |
| 36 | Zheng Liu 0011(刘政) | 4 | 2020--2023 | MSRA(现 BAAI) | 推荐检索 |
| 37 | Yongfeng Huang / Yanjie Fu / Jing Wu 0004 | 各4 | 2018--2022 | 清华 / UCF / 卡迪夫大学 | 跨机构合作 |
5.2 现单位(人大高瓴)团队与学生梯队
王希廷 2023 年入职人大,2024 年起进入独立指导阶段(12 篇末位通讯作者论文全部出现在 2024 年之后)。据 DBLP 高频合作者数据与论文署名模式(学生一作 + 王希廷末位通讯),可识别出以下核心学生梯队:
第一梯队(在读博士生,合作 5 次以上,多篇一作):
| 姓名 | 合作次数 | 年份 | 研究方向与代表作 |
|---|---|---|---|
| 许智昊(Zhihao Xu) | 12(两个 DBLP ID 合计) | 2024--2026 | 团队最高产学生。NeurIPS 2024《Uncovering Safety Risks of LLMs through Concept Activation Vector》一作;ACL 2026 三篇一作(PAM 优先级感知元认知、工具调用轨迹合成、多目标对齐奖励一致性)。方向为大模型安全对齐 |
| 李萌(Meng Li) | 8 | 2024--2026 | EMNLP 2024《Evaluating Readability and Faithfulness of Concept-based Explanations》一作;ACL 2025 最优传输 Token 加权(与 Shopee 合作);ACL 2026 SOAR(Agentic RL)。方向为概念解释与偏好优化 |
| 曹乾(Qian Cao) | 7 | 2024--2026 | ACM MM 2024《See or Guess》一作;ICLR 2026《Evaluating Text Creativity》一作;ACL 2026 DPWriter 一作(通讯:宋睿华、王希廷)。方向为创意写作与多模态,由宋睿华与王希廷共同指导 |
| 金浩然(Haoran Jin) | 5 | 2024--2026 | ACL 2025《Internal Value Alignment through Controlled Value Vector Activation》一作;ICML 2026《C2R: Cross-sample Consistency Regularization ... in Sparse Autoencoders》一作。方向为稀疏自编码器与内部价值对齐 |
| 张涵宇(Hanyu Zhang) | 5 | 2024--2026 | AAAI 2025《Controlling LLMs Through Concept Activation Vectors》一作;COLING 2024《Distillation with Explanations from LLMs》一作;ACL Findings 2026 Safe-SAIL。方向为概念激活向量与安全景观 |
| 金楚皓(Chuhao Jin) | 5 | 2024--2025 | ACL 2024《Persuading across Diverse Domains》一作;ICLR 2025 Think-Then-React;PlanMoGPT。宋睿华组学生,与王希廷交叉合作 |
| 任世杰(Shijie Ren) | 4 | 2025--2026 | ICLR 2026 ProtoTS(可解释时序预测,与阿里达摩院合作);扩散语言模型 TAD。方向为可解释时序与高效推理 |
| 黄睿轩(Ruixuan Huang) | 4 | 2024 | NeurIPS 2024 CAV 安全风险共同作者;概念解释评估 |
| 彭子恒(Ziheng Peng) | 3 | 2025--2026 | ProtoTS、极端天气预测目标概念微调、Agent 过度调用诊断偏差 |
| 翁佳琪(Jiaqi Weng)、郑晗(Han Zheng) | 各1--2 | 2025--2026 | Safe-SAIL 稀疏自编码器安全解释框架 |
| 刘祥(Jiawei Liu)、周浩阳(Haoyang Zhou)、邓丁(Ding Deng) | 1--2 | 2026 | 扩散语言模型 RL、TAD、PanoramaRAG |
第二梯队(跨机构联合指导 / MSRA 时期带教的学生):
| 姓名 | 合作次数 | 年份 | 现状与去向 |
|---|---|---|---|
| 陈昌宇(Changyu Chen) | 9 | 2022--2026 | MSRA 实习起步(KDD 2022 个性化闲聊生成一作),ICML 2023《Semi-Offline RL for Optimized Text Generation》一作,ACL 2024 Masked Thought 一作(与阿里通义合作)。现为新加坡管理大学(SMU)博士生 |
| 金奕乔(Yiqiao Jin) | 9 | 2021--2024 | MSRA 实习生,AAAI 2022 假新闻细粒度推理一作、AAAI 2023 Prototypical Fine-Tuning 一作。现为佐治亚理工学院(Georgia Tech)计算机博士生(导师 Srijan Kumar) |
| 张景涵(Jinghan Zhang) | 7 | 2024--2025 | 波特兰州立大学(刘鲲鹏组)博士生,ACL 2024 Oral《Prototypical Reward Network》一作、AAAI 2025 RATT 一作。属跨国联合指导 |
| 高竞跃(Jingyue Gao) | 5 | 2019--2021 | 北大王亚沙组,MSRA 实习生,AAAI 2019 可解释推荐、IJCAI 2021 群组解释一作 |
| 李震(Zhen Li 0044) | 1 | 2022 | 清华刘世霞组,TVCG 2022《A Unified Understanding of Deep NLP Models》一作(封面论文) |
| 陈仲夏(Zhongxia Chen) | 3 | 2019--2020 | 中科大陈恩红组,MSRA 实习生,IJCAI 2019/2020 可解释推荐一作 |
| 李承澳(Chengao Li)、杨叶阳(Yeyang Zhou)、袁雨卓(Yuzhuo Yuan) | 1--2 | 2024--2026 | 参与 CAV 控制、创造力评估等工作 |
5.3 人大高瓴校内同事网络
| 姓名 | 合作次数 | 关系说明 |
|---|---|---|
| 宋睿华(Ruihua Song) | 15 | 人大高瓴长聘副教授。双重关系:既是人大同事,也是 MSRA 前同事(宋睿华 2000-2020 在 MSRA 工作近20年,曾任主管研究员)。二人在人大形成了紧密的联合指导小组(曹乾、金楚皓、刘晓川等学生由两人共同指导),涉及创意写作、多模态、说服对话、相关工作生成等方向。这是王希廷在人大最重要的校内学术伙伴 |
| 严睿(Rui Yan 0001) | 6 | 人大高瓴教授。合作始于 MSRA 时期(KDD 2022),延续至人大(ACL 2024 Masked Thought、Extreme Region Policy Distillation) |
| 陈旭(Xu Chen 0017) | 4 | 人大高瓴教授,推荐系统方向。ACM MM 2024、ACL Findings 2025 |
| 文继荣(Ji-Rong Wen) | 2 | 人大高瓴执行院长。ACL 2024 Masked Thought 与 2026 极端天气预测。合作次数很少(仅2次),与赵鑫(373次)形成极端反差 |
| 黄文炳(Wenbing Huang 0001) | 3 | 人大高瓴,动作生成方向(ICLR 2025、PlanMoGPT) |
| 沈蔚然(Weiran Shen) | 1 | 人大高瓴,2026 嵌入空间分离安全增强 |
重要洞察: 王希廷与人大高瓴"本土派"核心(文继荣、赵鑫等)的合作极少,其人大内部的连接几乎完全通过宋睿华(MSRA 老同事)这一条通路建立。这说明她在人大的学术定位不是嵌入既有的信息检索/大模型大团队,而是依托 MSRA 关系网独立开辟"可解释性与对齐"这一新方向,是学院引进人才实现方向补位的典型案例。
六、【重点】业界合作关系深度分析
王希廷是本系列报告中业界属性最强的学者,其学术网络的"重心"长期不在高校而在企业研究院。以下分五个层面展开。
6.1 与微软亚洲研究院(MSRA):六年任职 + 持续至今的深度绑定
(1)任职轨迹的完整性
王希廷在 MSRA 工作了整整六年(2017--2023),完成了从 Researcher → Senior Researcher → Principal Researcher(首席研究员) 的三级晋升。在 MSRA 的职级体系中,Principal Researcher 是研究员序列的高阶职级(其上仅有 Partner Research Manager / Distinguished Scientist 等少数管理与院士级职位),通常意味着已具备独立设定研究议程、带领子方向团队的能力。她所在的社会计算组(Social Computing Group)由谢幸(Xing Xie)领衔,是 MSRA 面向搜索、推荐、新闻、用户建模等产品线的核心研究单元。
(2)谢幸(Xing Xie):全网络第一合作者,49 次共著
| 指标 | 数值 |
|---|---|
| 合作总次数 | 49 次(占其消歧后 135 条记录的 36%) |
| 合作年份 | 2018--2026(跨 9 年,至今未断) |
| 峰值年份 | 2022 年 14 篇、2023 年 13 篇(MSRA 后期,二人合作最密集) |
| 离职后 | 2024 年 4 篇、2025 年 1 篇、2026 年 2 篇(离职三年后仍在持续) |
谢幸现任 MSRA 高级首席研究经理(Senior Principal Research Manager),是社会计算组的负责人,IEEE Fellow、ACM 杰出科学家,在推荐系统、用户画像、负责任AI领域享有国际声誉。二人的 49 次合作构成了王希廷学术产出的骨架:从 2018 年的可解释推荐(ICDM 2018 一作)、2019--2021 年的深度模型理解(ICML 2019 Deep and Unified Understanding of NLP)、公平性推荐(AAAI 2021、WWW 2021、SIGIR 2022)、假新闻检测(AAAI 2022、KDD 2022),到 2022--2023 年的价值观对齐(NeurIPS 2022 自解释逻辑规则、Value FULCRA、Unpacking Ethical Value Alignment)、直至 2026 年的 CACM 论文和 ACL 2026 RLHF 经验选择。
谢幸是王希廷职业生涯中的第二位、也是影响时长最久的学术引路人——如果说刘世霞塑造了她的"可解释性"底色,那么谢幸则将她引入了"负责任AI + 大规模产品落地"的赛道。
(3)MSRA 社会计算组核心同事群
| 姓名 | 合作次数 | 年份 | MSRA 身份与合作主题 |
|---|---|---|---|
| Xing Xie(谢幸) | 49 | 2018--2026 | 高级首席研究经理,组长 |
| Xiaoyuan Yi(衣晓远) | 13 | 2022--2026 | 研究员,价值观对齐/可控文本生成(Value FULCRA、Unpacking Ethical Value Alignment、Clickbait Detection IJCAI'22) |
| Jing Yao(姚菁) | 10 | 2023--2026 | 研究员,推荐逻辑规则推理(TOIS 2025)、文化价值观对齐、对齐目标综述 |
| Fangzhao Wu(吴方照) | 8 | 2020--2024 | 首席研究员,新闻推荐公平性/联邦学习(AAAI'21、SIGIR'22、WWW'23 DualFair) |
| Jianxun Lian(练建勋) | 6 | 2021--2025 | 研究员,推荐系统(KDD'21、KDD'22、WWW'23、TOIS'25) |
| Zheng Liu(刘政) | 4 | 2020--2023 | 前 MSRA(现 BAAI),检索与推荐(SIGIR'20、KDD'21、TOIS'22) |
| Baining Guo(郭百宁) | 6 | 2013--2016 | 微软杰出科学家、时任 MSRA 常务副院长(博士期合作) |
| Li Dong(董力) | 2 | 2023 | MSRA NLP 组首席研究员(ICML 2023 半离线RL) |
| Yaru Hao(郝雅茹) | 2 | 2022--2023 | MSRA 研究员(AAAI 2023 原型微调) |
| Chaozhuo Li(李朝卓) | 1 | 2022 | MSRA(现北邮),KDD 2022 假新闻子图推理 |
| Weiwei Cui(崔为炜) | 3 | 2014--2016 | MSRA 可视化研究员 |
| Jie Cao(曹杰) | 3 | 2021--2023 | MSRA/Bing 团队 |
| Mingqi Wu | 2 | 2023 | 微软,WWW 2023 可解释协同过滤 |
MSRA 关联人员合计贡献了她 100+ 篇论文的署名,可以说她 2018--2023 年的全部产出都发生在 MSRA 的组织框架内。
6.2 必应(Bing)搜索引擎的实际落地:从论文到产品
官方简介中"相关科研成果落地全球占有量第二的必应搜索引擎"这一表述,在 DBLP 论文记录中可以找到明确的对应证据链:
(1)直接的 Bing 广告产品落地论文(最强证据)
Xiting Wang(一作), Xinwei Gu, Jie Cao, Zihua Zhao, Yulan Yan, Bhuvan Middha, Xing Xie. Reinforcing Pretrained Models for Generating Attractive Text Advertisements. KDD 2021 — Applied Data Science Track
这篇论文的三重特征共同证明其为真实产品落地成果: - 发表在 KDD 应用数据科学赛道(ADS Track),该赛道专门收录已在真实工业系统中部署并验证的工作,是工业界落地的公认标志; - 王希廷为第一作者,说明她是该项目的核心主导者; - 合作者 Bhuvan Middha 为微软(美国总部)Bing Ads 团队成员,Yulan Yan、Xinwei Gu、Zihua Zhao、Jie Cao 均为微软产品/工程侧人员——这是一个典型的"MSRA 研究员 + Bing 产品团队工程师"的混编项目组配置。
该工作的内容是用强化学习增强预训练模型来生成吸引人的文本广告,直接服务于 Bing 的广告文案自动生成场景。
(2)微软总部(Redmond)Bing 团队的跨洋合作论文
Zhongxia Chen, Xiting Wang, Xing Xie, Mehul Parsana, Akshay Soni, Xiang Ao, Enhong Chen. Towards Explainable Conversational Recommendation. IJCAI 2020
Mehul Parsana 与 Akshay Soni 均为微软美国总部(Bing / Microsoft Advertising)的应用科学家/研究经理。这篇论文标志着王希廷的可解释推荐研究不仅停留在 MSRA 北京,而是接入了微软全球产品线。
(3)新闻/头条个性化生成的产品链路(Microsoft News / MSN)
Xiang Ao, Xiting Wang, Ling Luo, Ying Qiao, Qing He, Xing Xie. PENS: A Dataset and Generic Framework for Personalized News Headline Generation. ACL 2021
Xiang Ao, Ling Luo, Xiting Wang, Zhao Yang, Jiun-Hung Chen, Ying Qiao, Qing He, Xing Xie. Put Your Voice on Stage: Personalized Headline Generation for News Articles. ACM TKDD 2023/2024
Ying Qiao、Jiun-Hung Chen 为微软产品团队(Microsoft News / MSN)人员。PENS 是基于微软新闻真实用户数据构建的个性化标题生成数据集,已成为该子领域的标准 benchmark,广泛被后续研究引用——这是"研究成果反哺学术社区 + 服务微软产品"的双赢案例。
(4)推荐系统公平性的产品级验证链路
一系列与吴方照、吴楚翰合作的公平性新闻推荐论文(AAAI 2021 Fairness-aware News Recommendation、SIGIR 2022 ProFairRec、WWW 2023 DualFair)均使用微软新闻真实数据集(MIND),是微软"负责任AI"工程实践在推荐产品线的直接体现。
(5)负责任AI 的跨学科机制化推动
MSRA 于任职期间举办了 "Responsible AI: An Interdisciplinary Approach" 研讨会,参会名单显示王希廷(时任 Principal Researcher)与吴方照(Principal Researcher)、谢幸(Senior Principal Research Manager)、周礼栋(微软全球资深副总裁、MSRA 院长)同列 speaker,同场的还有芝加哥大学 James A. Evans、剑桥大学 David Stillwell、香港科大 Pascale Fung、Rutgers 张永锋等。这表明她在 MSRA 时期已是负责任AI 议题在中国的代表性发声者之一,而非仅仅是执行研究员。
(6)离职后的持续合作
尤为值得注意的是,王希廷 2023 年离开 MSRA 后与微软的合作并未中断:
| 年份 | 论文 | 微软方合作者 |
|---|---|---|
| 2024 | NAACL《Value FULCRA: Mapping LLMs to the Multidimensional Spectrum of Basic Human Value》 | 姚菁、衣晓远、龚一凡、谢幸 |
| 2024 | CoRR《Uncovering Safety Risks in Open-source LLMs through CAV》 | 吴方照、姚菁、谢幸 |
| 2024 | 《LLMs show both individual and collective creativity comparable to humans》 | 谢幸 |
| 2025 | TOIS《Neural Recommendation Reasoning with Logic Rules》 | 姚菁、练建勋、衣晓远、谢幸 |
| 2025 | Nature NPJ AI《Toward faithful and human-aligned self-explanation of deep models》 | 姚菁、衣晓远、谢幸 |
| 2026 | CACM《Evaluating General-Purpose AI with Psychometrics》 | 谢幸 |
| 2026 | ACL《Influence-based Online Experience Selection for Effective RLHF》 | 姚菁、衣晓远、谢幸 |
其中 CACM 2026 论文由王希廷担任第一作者、谢幸担任末位作者,发表在计算机领域最具影响力的旗舰刊物 Communications of the ACM 上,是她"学术独立后仍与老东家保持顶级共同产出"的最强证明。这种离职后三年内仍保持 7 篇高水平共著(含 CACM、Nature NPJ AI、TOIS)的关系强度,在国内产学转型学者中相当罕见。
6.3 与其他企业的合作:转入高校后的多元化产学研布局
离开微软后,王希廷并未退回纯学术,而是迅速在人大搭建起面向多家中国头部科技企业的合作网络。以下按企业分组梳理(合作年份均在 2024 年之后,即其独立 PI 阶段):
| 企业 | 对接人员(DBLP 名) | 合作论文数 | 年份 | 合作主题 |
|---|---|---|---|---|
| 阿里巴巴(安全部 / 达摩院 / 通义) | Jialing Tao(陶稽玲)、Hui Xue 0001(薛晖)、Zhixuan Chu(褚知萱);Liang Sun(孙亮)、Linxiao Yang(杨林潇)、Xinyue Gu;Ting-En Lin、Yuchuan Wu、Yongbin Li(李永彬) | 3+2+2+3 = 约 8 篇 | 2024--2026 | ① 大模型安全:Safe-SAIL 稀疏自编码器安全景观框架(ACL Findings 2026)、视觉语言模型越狱攻击检测(与阿里安全部 薛晖团队);② 可解释时序预测 ProtoTS(ICLR 2026,与达摩院决策智能实验室 孙亮团队)、极端天气预测;③ 数学推理 Masked Thought(ACL 2024,与通义实验室 李永彬团队) |
| 快手(Kuaishou) | Ruiming Tang(唐睿明)、Guorui Zhou(周国睿)、Han Li(李晗);Fuzheng Zhang(张富峥)、Di Zhang(张迪)、Zijia Lin(林子甲)、Ying Qin | 约 5 篇 | 2024--2026 | 创意写作强化学习 DPWriter(ACL 2026,快手大模型团队三位负责人级人物署名)、PlanMoGPT 动作生成、概念解释评估 |
| 美团(Meituan) | Rumei Li、Jiahuan Li、Rongxiang Weng(翁荣祥)、Jingang Wang(王金刚)、Xunliang Cai(蔡勋梁,美团 LongCat 大模型负责人) | 2 篇 | 2026 | 工具调用轨迹合成(ACL 2026 主会,一作为其博士生许智昊) |
| Shopee / 虾皮(新加坡) | Guangda Huzhang、Haibo Zhang、Anxiang Zeng(曾安祥,前阿里,Shopee 首席科学家);Zang Li、Lei Li、Yi Yuan | 约 4 篇 | 2025--2026 | 最优传输 Token 加权偏好优化(ACL 2025)、SOAR 观察监督的智能体强化学习(ACL 2026) |
| 腾讯(Tencent AI Lab) | Wei Bi(闭玮)、Xinting Huang(黄新庭) | 4 篇 | 2024--2026 | DPWriter 创意写作、See or Guess 反事实图像描述 |
| 华为 | Yantao Jia(贾岩涛) | 2 | 2025 | 内部价值对齐 ACL 2025 |
| 百度/其他 | — | — | — | 未见显著合作 |
产业合作的三个结构性特征:
-
紧扣"安全与可解释"这一差异化定位。 与阿里安全部(薛晖、陶稽玲)的合作聚焦大模型安全景观刻画与越狱检测,与其他学者常见的"帮企业提点"式合作不同,她输出的是企业自身缺乏的可解释性方法论。这使得她在产学合作中处于技术供给方而非算力/数据索取方的位置。
-
企业方对接人层级很高。 快手 DPWriter 论文的合作者包含唐睿明、周国睿、李晗三位快手推荐/大模型体系的核心负责人;美团论文合作者包含 LongCat 大模型负责人蔡勋梁;Shopee 论文合作者包含首席科学家曾安祥。这种高层级对接通常只出现在企业有战略性合作意愿的场景。
-
合作密度在离开微软后不降反升。 2024--2026 年三年内涉及 6+ 家不同企业、约 25 篇合作论文,远超其在 MSRA 时期与外部企业的合作量(MSRA 时期合作对象主要是微软内部)。这反映了她将 MSRA 六年积累的"工业界研究方法论"转化为了高校 PI 的产学资源整合能力。
6.4 跨学科合作:心理测量学与社会科学
一个不容忽视的合作维度是她与心理学/行为科学界的深度合作,这一网络同样源自 MSRA 的负责任AI 议程:
| 合作者 | 机构 | 合作次数 | 说明 |
|---|---|---|---|
| David Stillwell | 剑桥大学 Judge 商学院教授 | 3 | 心理测量学与计算社会科学权威(myPersonality 数据集创建者) |
| Luning Sun(孙鲁宁) | 剑桥大学心理测量中心 | 3 | 心理测量学 |
| Fang Luo(骆方) | 北京师范大学教授 | 4 | 心理测量学,中国心理测量领域代表学者 |
| José Hernández-Orallo | 西班牙瓦伦西亚理工大学教授 | 2 | AI 评测理论权威(The Measure of All Minds 作者) |
| Liming Jiang | — | 2 | |
| Meeyoung Cha | 韩国 KAIST / Max Planck Institute | 4 | 计算社会科学 |
| Sungwon Han / SeungEon Lee | KAIST | 4/3 | 公平表征学习、自解释逻辑规则 |
这一网络的旗舰成果是 CACM 2026《Evaluating General-Purpose AI with Psychometrics》(王希廷第一作者)与 Thinking Skills and Creativity 2025《Large language models show both individual and collective creativity comparable to humans》。她在访谈中明确指出:"我们自己最近在进行的一个工作是结合心理测评,对大模型进行跨任务通用能力的严谨评估。"这条路线本质上是把 MSRA 负责任AI 研讨会(Stillwell、骆方、万小红等心理学家均为该会 speaker)搭建的跨学科关系,转化为了长期的合作产出。
6.5 学生毕业去向与工业界流动统计
由于王希廷 2023 年才入职人大、2024 年才开始独立带博士生,其人大本土培养的博士生尚无毕业生(按 4 年学制,最早毕业时间约为 2027--2028 年)。但可以从她 MSRA 时期带教的实习生/合作学生的去向,以及现团队学生的实习分布来观察人才流动格局:
(1)MSRA 时期带教学生的去向(学术界为主)
| 姓名 | MSRA 实习期 | 去向 |
|---|---|---|
| 金奕乔(Yiqiao Jin) | 2021--2024 | 佐治亚理工学院(Georgia Tech)计算机科学博士生(导师 Srijan Kumar) |
| 陈昌宇(Changyu Chen) | 2022--2023 | 新加坡管理大学(SMU)博士生 |
| 陈仲夏(Zhongxia Chen) | 2019--2020 | 中科大陈恩红组毕业 |
| 高竞跃(Jingyue Gao) | 2019--2021 | 北大王亚沙组 |
| 李震(Zhen Li) | 2022 | 清华刘世霞组,TVCG 封面论文一作 |
| 杨维铠(Weikai Yang) | 2020--2026 | 清华刘世霞组 2024 届博士,清华大学优秀博士学位论文、北京市优秀毕业生 |
| 赵康志(Kangzhi Zhao) | 2020 | 清华,SIGIR 2020 一作 |
| 关朝宇(Chaoyu Guan) | 2019 | ICML 2019 一作 |
观察:MSRA 时期带教的学生去向以顶尖高校博士项目为主(Georgia Tech、SMU、清华),而非直接进入工业界。 这与 MSRA 联合培养项目的定位(发掘并培养学术苗子)一致。
(2)现团队学生的产业实习分布(从合作论文的企业署名推断)
现团队学生在读期间已高度嵌入企业实习网络: - 许智昊 → 美团(LongCat 团队,ACL 2026 工具调用)、蚂蚁/阿里方向(多目标对齐论文合作者含 Jun Zhou) - 李萌 → Shopee(ACL 2025、ACL 2026 SOAR) - 曹乾 → 快手(DPWriter,ACL 2026)、腾讯 AI Lab - 任世杰、彭子恒 → 阿里达摩院决策智能实验室(ProtoTS、极端天气预测) - 张涵宇、翁佳琪、郑晗 → 阿里安全部(Safe-SAIL) - 金浩然 → 华为(ACL 2025 内部价值对齐合作者含贾岩涛)
这种"每位核心博士生都对接一家头部企业"的配置,是王希廷 MSRA 工业界基因在高校团队组织形式上的直接延续。可以预期其首批博士生(2027--2028 届)毕业时,工业界去向占比会显著高于纯学术背景导师培养的学生。
6.6 业界关系总评
用一句话概括:王希廷是一位"从工业界研究院走向高校、但把工业界的合作范式完整带入高校"的学者。
- 她的第一大合作者(谢幸,49次)是企业研究员,不是任何一位高校教授;
- 她的成名成果(Bing 广告生成、PENS 个性化标题、公平新闻推荐)都有明确的微软产品落地场景;
- 她转入高校后,不仅未与工业界脱钩,反而将合作面从"单一微软"扩展为"阿里+快手+美团+Shopee+腾讯+华为"的多元矩阵;
- 她的差异化竞争力(可解释性、安全对齐)恰好是企业最缺、最难自建的能力,使其在产学合作中掌握定价权。
七、Connection 圈层总结
第一圈层(学术引路人,双核结构):
不同于本系列其他学者的"单一导师主导"模式,王希廷呈现罕见的双核引路人结构:
- 刘世霞(22次,2013--2026) —— 清华博士导师,IEEE Fellow,赋予其"可解释机器学习 + 可视分析"的方法论底色,并通过 IEEE VIS 社区(王希廷后来担任 IEEE VIS 组委会档案主席、Visual Informatics 编委)为其铺设了学术共同体入口。二人共著的 TVCG 封面论文构成王希廷简历中最醒目的荣誉之一。
- 谢幸(49次,2018--2026) —— MSRA 社会计算组组长,是合作频次绝对第一(占其全部产出 36%)的合作者。他把王希廷从"可视分析研究者"推向"负责任AI + 产品落地"的更大舞台,并在她离开微软三年后仍保持 CACM、Nature NPJ AI 级别的共同产出。
若以合作绝对量论,谢幸(49次)远超刘世霞(22次),这在国内学者中极为特殊——她学术网络的引力中心长期位于企业研究院而非高校。
第二圈层(MSRA 同事集群,产业能力供给方):
衣晓远(13次)、姚菁(10次)、吴方照(8次)、练建勋(6次)、刘政(4次)、董力(2次)、郝雅茹(2次)等构成的 MSRA 社会计算组同事群,加上郭百宁(6次,博士期)、崔为炜(3次)等更早的 MSRA 关系。这一集群贡献了她 2018--2023 年的绝大部分产出,且在她离职后仍持续输出高水平合作(Value FULCRA、Nature NPJ AI、TOIS 2025、CACM 2026)。该圈层是她学术网络中最稳定、最高质量的部分。
第三圈层(人大高瓴现单位网络,以宋睿华为唯一枢纽):
宋睿华(15次)、严睿(6次)、陈旭(4次)、黄文炳(3次)、文继荣(2次)、沈蔚然(1次)。
这一圈层的结构特征极为鲜明:宋睿华一人贡献了她校内合作的绝大部分(15/31 ≈ 48%),而其余人加起来仅16次。且宋睿华本人也是 MSRA 出身(在 MSRA 工作近 20 年),二人在人大的联合指导小组(曹乾、金楚皓等)实质上是"MSRA 关系在人大的移植与再生产"。
与本系列中赵鑫(文继荣 373 次,占比 65%)的极端院内绑定形成鲜明对照:王希廷与院长文继荣仅合作 2 次,是院内相对独立、自成体系的一极。这既反映了她被引进的定位是"补齐可解释性/安全对齐这一学院短板方向",也意味着她的学术资源自主性更强、对学院既有体系的依赖度更低。
第四圈层(自主培养的学生梯队,2024年后爆发):
许智昊(12次)、李萌(8次)、曹乾(7次)、金浩然(5次)、张涵宇(5次)、金楚皓(5次)、任世杰(4次)、黄睿轩(4次)、彭子恒(3次)等。
该梯队的形成时间极为集中——几乎全部始于 2024 年,与她 12 篇末位通讯作者论文的时间分布完全吻合。仅两三年时间就已在 ACL(多篇主会一作)、NeurIPS、ICML、ICLR、AAAI 等顶会形成稳定输出,且许智昊单人在 ACL 2026 就有 3 篇一作(含主会 2 篇),说明团队的科研效率极高。这是本报告中"团队建立最快、单位时间产出密度最高"的新晋 PI 之一。
跨国联合指导也值得注意:张景涵(7次,波特兰州立大学刘鲲鹏组)、陈昌宇(9次,SMU)、金奕乔(9次,Georgia Tech)构成了海外学生的合作分支。
第五圈层(跨机构学术合作网络):
- 中科院计算所:敖翔(7次)、何清(5次)——个性化新闻生成、概念激活向量方向的稳定合作
- 中国科学技术大学:连德富(9次)、陈恩红(6次)——推荐检索与因果解释
- 合肥工业大学:吴乐(9次)、洪日昌(5次)、汪萌(5次)——推荐系统公平性
- 北京大学:王亚沙(6次)、褚旭(3次)——可解释推荐与医疗预测
- 清华大学(母校延续):杨维铠(5次)、吴静(4次)、刘知远、孙茂松、黄民烈(1次)
- 国际:Meeyoung Cha(KAIST/MPI,4次)、Yizhou Sun(UCLA,4次)、Kunpeng Liu(波特兰州立,8次)、David Stillwell(剑桥,3次)、José Hernández-Orallo(瓦伦西亚理工,2次)、Laks V.S. Lakshmanan(UBC)、Hwanjo Yu(POSTECH)
第六圈层(产业合作矩阵,独立章节已详述):
微软/Bing(核心,100+ 篇署名关联)→ 阿里巴巴(安全部 + 达摩院 + 通义,约8篇)→ 快手(约5篇)→ Shopee(约4篇)→ 腾讯 AI Lab(4篇)→ 美团(2篇)→ 华为(2篇)。
产出规模与趋势总评:
消歧后 135 条 DBLP 记录(78 篇同行评审正式论文 + 57 篇 arXiv 预印本),278 位合作者。产出呈现三段跃迁:博士期(2013--2017,13条,可视分析顶刊)→ MSRA 期(2018--2023,61条,可解释推荐 + 负责任AI)→ 人大期(2024--2026,61条,大模型解释与对齐)。
最值得注意的结构性事实是:她用在人大的 3 年时间,完成了在 MSRA 6 年的产出总量,且论文的通讯作者位次从"无"跃升到 12 篇。 这是一位处于学术生涯上升期最陡峭斜率上的学者——2025 年获吴文俊人工智能青年科技奖、入选北京市人才计划青年项目,正是这一阶段成果的集中兑现。
从研究方向看,她的三阶段演进(可视分析 → 可解释推荐 → 大模型可解释与对齐)具有极强的内在一致性——始终围绕"让人理解和掌控机器学习模型"这一根本问题,只是随着技术浪潮把对象从主题模型换成了推荐系统、又换成了大语言模型。这种"方向定力 + 载体迭代"的组合,是其能在 LLM 时代迅速占据可解释性与安全对齐这一细分高地的根本原因。
八、数据来源与局限性说明
8.1 数据来源
- DBLP 官方 XML 记录(pid: 134/4020,144 条原始记录,消歧后135条)
- 个人主页:https://gsai.ruc.edu.cn/wangxt
- 人大高瓴学院官网新闻与访谈(吴文俊青年科技奖报道、ACL 2026 论文录用公告等)
- 清华大学软件学院官网(刘世霞教授页面)
- 微软研究院官网(Responsible AI 研讨会信息)
8.2 局限性
- DBLP 同名合并问题。 DBLP 的 pid 134/4020 未做作者消歧,至少混入了 5 个不同领域的同名"Xiting Wang"(航空发动机、药物化学、大气遥感、生物信息学、材料化学),本报告已人工剔除9条异质记录。消歧后统计数字(135条记录、78篇正式论文、278位合作者)为最佳估计。
- 博士导师判定。 刘世霞为博士导师系基于合作模式与方向传承的推断,官方主页未明文写出导师姓名。王希廷博士就读于清华IIIS,而刘世霞任职于清华软件学院,可能存在跨院系联合指导或MSRA联合培养安排。
- 团队成员身份。 未获取独立课题组主页,"人大高瓴博士生"的身份判定基于论文署名模式推断。
- 企业合作者机构归属。 DBLP不包含机构字段,部分企业合作者的归属基于公开身份推断,实际发表时的 affiliation 可能与当前不同。
- 本报告以DBLP为主数据源,未使用OpenAlex。Google Scholar引用数据因反爬限制未能获取。