北京大学 穗志方 教授
报告生成时间:2026年8月20日
个人主页:穗志方
所属团队:北京大学计算语言学研究所 / 计算语言学教育部重点实验室
一、学者基本信息
| 字段 | 内容 |
|---|---|
| 姓名 | 穗志方(Zhifang Sui) |
| 性别 | 女 |
| 出生年份 | (待核实) |
| 职称 | 教授、博士生导师 |
| 所属单位 | 北京大学计算机学院 |
| 实验室职务 | 计算语言学教育部重点实验室主任;多媒体信息处理全国重点实验室副主任 |
| 学术头衔 | 中国中文信息学会理事(2025年郑州大学报告介绍记为常务理事,百度百科作理事,待核实);北京智源人工智能研究院(BAAI)NLP方向智源学者 |
| 国家级人才 | (待核实具体人才称号) |
| 其他任职 | 曾任北京大学计算语言学研究所副所长 |
| 邮箱 | szf@pku.edu.cn |
| 研究方向 | 自然语言处理、文本挖掘与知识工程、计算语言学、医疗NLP、知识图谱构建及应用 |
二、教育背景与职业履历
穗志方于1992年获得山东大学学士学位,随后进入北京大学计算机科学技术系攻读博士学位。1998年6月,穗志方在北京大学计算机系获博士学位,其博士导师极可能为俞士汶教授(1938—2021)——俞士汶自1990年起担任计算语言学研究所负责人/副所长,长期主持"现代汉语词语语法信息库"等国家科技攻关项目,穗志方作为其学术传承者的角色在此后的科研合作中体现得尤为明显(待核实确切师承关系)。
博士毕业后,穗志方留校任教,长期在北京大学计算语言学研究所从事教学与科研工作。她逐步从讲师晋升为教授、博士生导师,并先后担任计算语言学研究所副所长、计算语言学教育部重点实验室主任等职务。2008年,北京大学在计算语言学研究所基础上成立计算语言学教育部重点实验室,穗志方在此后成为该实验室主任。此外,她还担任多媒体信息处理全国重点实验室副主任,这一职务表明其研究领域已从传统计算语言学扩展至多媒体信息处理。
在科研项目层面,穗志方主持了科技部"科技创新2030——新一代人工智能重大项目"(聚焦以自然语言为核心的语义理解理论、模型与方法)、国家973计划课题、国家自然科学基金、国家社会科学基金等多项国家级重要项目。她主导构建了综合型语言知识库(CLKB)及中文医学知识图谱(CMeKG),这两项成果分别代表了基础语言资源建设与领域知识工程两个方向的标志性贡献。
近年来,穗志方的研究重心向大语言模型方向延伸。2024年3月,她在人工智能女性菁英论坛上作题为《大语言模型的知识能力探究》的报告;2025年5月,在郑州大学主讲"知识驱动的大模型复杂推理能力评测研究"学术报告,提出通过知识驱动与数据合成相结合的方法构建细粒度评测体系。2025年,其团队发表了《Language Models Encode the Value of Numbers Linearly》等研究成果。她亦制定了国家标准2项(具体标准名称待核实)。
穗志方是北京智源人工智能研究院(BAAI)NLP方向的智源学者之一,该方向首席科学家为清华大学孙茂松教授,智源学者群体还包括李涓子、刘洋、万小军、何晓冬等知名学者。
三、学生培养情况
穗志方长期指导硕士和博士研究生,其培养的学生中多人进入国内顶尖大模型公司,成为核心技术骨干。以下列出已公开确认的学生信息。
1. 罗福莉(DeepSeek/小米,硕士毕业生)
罗福莉硕士毕业于北京大学计算语言学研究所(计算语言学专业),师从穗志方教授(北京大学官方公众号曾发布罗福莉与导师穗志方教授的合影;需要说明的是,本系列报告中亦有将其归入研究所培养网络而非特定导师名下的审慎记载,具体导师归属以官方信息为准)。在校期间,她最初的研究方向为词义消歧,后敏锐转向文本生成领域。硕士毕业后,罗福莉先后在阿里巴巴达摩院和DeepSeek任职。在阿里达摩院期间,她参与开发多语言预训练模型VECO;在DeepSeek期间,她作为关键开发者参与了DeepSeek-V2的研发。2024年底至2025年初,罗福莉以据报道的千万年薪被雷军挖至小米,领导小米大模型团队(MiMo系列)。2025年9月,她以通讯作者身份出现在小米与北京大学联合发布的MoE与强化学习论文中。同年,她亦以"北京独立研究者"身份出现在DeepSeek发表于《Nature》的R1论文作者名单中。北京大学官方公众号曾发布罗福莉与导师穗志方教授的合影,确认了师生关系。
2. 代达劢(DeepSeek,2024届博士毕业生)
代达劢于2024年博士毕业于北京大学计算机学院计算语言学研究所,师从穗志方教授,现为DeepSeek研究员,从事大模型研究相关工作。代达劢是穗志方指导的优秀博士之一,在ACL、EMNLP、NeurIPS、NAACL、CIKM、AAAI、IJCAI等国际会议上发表了二十余篇学术论文。截至2024年底,其Google Scholar总被引数超过3500次。代达劢曾获EMNLP 2023最佳长论文奖(中国大陆首篇),获奖论文为"Label Words are Anchors"——该论文研究利用标签词作为锚点以提升文本分类性能,这一思路与穗志方课题组长期关注的少样本事件分类方向一脉相承。此外,代达劢还获得了微软学者提名奖、中国中文信息学会优秀博士毕业论文、CCL 2021最佳中文论文奖、北京大学校长奖学金等多项荣誉,并入选2024年"CIPS博士学位论文激励计划"(中国中文信息学会优博)。其代表作还包括《DeepSeekMoE》《Why Can GPT Learn In-Context?》《Knowledge Neurons in Pretrained Transformers》等,这些工作在DeepSeek的MoE架构设计和知识机制研究中发挥了重要作用。
3. 许润昕(DeepSeek,2020级硕士)
许润昕为北京大学计算语言学研究所2020级硕士生,师从穗志方与常宝宝。2023年8月,许润昕加入DeepSeek,是最早加入DeepSeek的PKU-ICL学生之一。此后,他的名字几乎贯穿了DeepSeek早期最重要的一批技术工作,从DeepSeek-MoE、DeepSeekMath、DeepSeek-Coder,到V2、V3、R1,均有参与。2021年,许润昕与王培懿、代达劢共同发表论文"Behind the Scenes",三人名字首次并排出现——彼时DeepSeek尚未创立,他们在穗志方与常宝宝的课题组共同研究少样本事件分类,处于BERT范式时代。许润昕还参与了Math-Shepherd论文,该工作研究如何在缺少人工逐步标注的情况下为数学推理提供step-by-step verification,后被DeepSeek-R1论文讨论Process Reward Model时引用为前序工作之一。
4. 王培懿(DeepSeek,直博生)
王培懿本科就读于天津大学,随后进入北京大学计算语言学研究所攻读直博,师从穗志方。2023年9月DeepSeek初创时,在师兄(许润昕)推荐下申请加入。王培懿此前研究文本分类、LLM evaluation和alignment,在DeepSeek之前已与许润昕、代达劢等人多次合作。他参与了Math-Shepherd论文,后成为DeepSeek核心成员,参与了从DeepSeek-MoE到R1的全过程工作。王培懿留在DeepSeek的原因之一是公司对AGI的长期目标。
5. 马文晗(北京大学在读博士,2025级)
马文晗自2025年9月起在北京大学计算机科学学院攻读博士学位,由穗志方教授指导。他的研究方向为大语言模型,近期主要关注提升大语言模型的推理能力。马文晗本科毕业于北京大学电子工程与计算机科学学院,专业为计算机科学与技术。他是罗福莉的同门师弟,并在小米MiMo团队的论文作者中现身——这表明穗志方课题组与产业界的联系仍在持续延伸。
6. 昝红英(郑州大学教师,合作培养/合作研究者)
昝红英为郑州大学信息工程学院教师,与穗志方在中文医学知识图谱CMeKG的构建中深度合作。CMeKG的构建论文中,昝红英为第一作者,穗志方为通讯作者/合作者,表明二人存在紧密的合作指导关系。昝红英长期在郑州大学从事NLP研究,其团队与穗志方课题组在国家社会科学基金(18ZDA315)等项目中保持合作。虽然昝红英并非穗志方的直接学生,但二人的合作模式体现了穗志方学术网络向兄弟院校延伸的特点。
7. 其他学生
穗志方自1998年博士毕业留校任教至今已近三十年,培养的硕士和博士研究生远不止上述几人。除已公开确认的学生外,其课题组还有多位在读硕博研究生从事自然语言处理、知识图谱、医疗NLP等方向的研究。由于公开信息有限,此处不一一列举(待核实更多信息)。
四、学术合作网络
4.1 实验室内部合作
北京大学计算语言学研究所(ICL)成立于1986年,由中文系朱德熙教授与计算机系马希文教授联合创建,是中国计算语言学研究的发源地之一。2008年在此基础上成立计算语言学教育部重点实验室。穗志方在该实验室内部拥有紧密的合作者网络:
-
俞士汶(1938—2021):北京大学教授,计算语言学研究所原副所长,中国中文信息处理领域主要开创者之一。俞士汶主导研制《现代汉语语法信息词典》,在此基础上构建的"综合型语言知识库"(CLKB)获2011年国家科技进步二等奖,穗志方为该项目第二完成人。穗志方与俞士汶长期合作,并继承发展了CLKB的建设与转化工作。俞士汶于2021年11月逝世,穗志方在此后承担了实验室学术传承的核心角色。
-
常宝宝(1971年生):北京大学计算机学院副教授,1999年获北京大学博士学位(计算机软件与理论方向),本科与硕士毕业于山西大学。常宝宝是穗志方在课题组运营中最紧密的合作者——两人共同指导了许润昕、王培懿、代达劢等多名学生,共同研究方向包括少样本事件分类、句法语义分析等。常宝宝曾代表北大计算语言学研究所参加首届Sighan汉语词语切分国际评测,取得一项开放测试第一名、一项封闭测试第二名的成绩,亦是CLKB项目(2011年国家科技进步二等奖)的第三完成人。
-
王厚峰:北京大学教授,计算语言学研究所所长。王厚峰的研究方向为问答系统、对话系统、阅读理解、情感分析、信息抽取等,与穗志方的知识工程方向形成互补。二人共同支撑起ICL的学术领导架构。
-
李素建:北京大学长聘副教授,研究方向为自然语言处理、自动文摘、篇章分析。李素建亦参与了CMeKG的构建工作,与穗志方在医疗NLP方向有合作。
-
詹卫东:北京大学中文系教授,计算语言学研究所副所长(中文系方向),研究方向为计算语言学、语言知识工程、中文信息处理。詹卫东与穗志方在"科技创新2030"重大项目"以自然语言为核心的语义理解理论、模型与方法"中为课题组成员,共同参与了国家973项目"面向三元空间的互联网中文信息处理理论与方法"。
-
潘亮铭:北京大学计算机学院助理教授,计算语言学教育部重点实验室研究员,国家级青年人才计划获得者。2022年博士毕业于新加坡国立大学,研究方向为大语言模型、大模型推理与可解释性。潘亮铭作为ICL近年引进的青年学者,为实验室注入了大模型前沿研究的新力量。
4.2 跨机构合作
穗志方的跨机构合作网络涵盖学术界与产业界:
-
郑州大学:穗志方与郑州大学信息工程学院昝红英团队建立了长期合作关系,双方共同构建了中文医学知识图谱CMeKG 1.0版。CMeKG覆盖6310种疾病、19853种药物、1237种诊疗技术及设备,关联医学实体达20余万,概念关系实例及属性三元组达100余万。该项目获国家社会科学基金(18ZDA315)等资助。2025年5月,穗志方与中科院赵军教授一同受邀在郑州大学作学术报告,体现了这一合作关系的延续。
-
中国科学院自动化研究所/中国科学院大学:穗志方与赵军研究员(中科院自动化所二级研究员)在科技创新2030新一代人工智能重大项目等领域有平行合作关系。二人于2025年5月同在郑州大学就大模型知识机制与推理能力评测主题作报告,学术交流密切。
-
北京智源人工智能研究院(BAAI):穗志方为BAAI NLP方向智源学者,该方向首席科学家为清华大学孙茂松教授,智源学者群体包括李涓子、刘洋、万小军、何晓冬等。这一网络连接了国内NLP领域的核心力量。
-
鹏城实验室:CMeKG的构建中涉及鹏城实验室(广东深圳),表明穗志方的合作网络延伸至新型研究机构。
4.3 国际合作
穗志方在ACL 2000、COLING 2008、CoNLL 2008、ACL 2009、EMNLP 2009、AIRS 2008等国际顶级会议和学术会议上发表多篇学术论文,与计算语言学国际学术界保持长期交流。她的研究参与了国际计算语言学共同体的前沿对话,尤其在语言知识库构建、知识图谱、文本挖掘等方向具有国际影响力。CLKB的综合型语言知识库成果被国际学术界广泛引用。关于具体的国际合作伙伴机构和个人,公开信息有限(待核实更多国际合作细节)。
五、业界合作关系深度分析
5.1 产业技术转化与CLKB商业应用
穗志方参与构建的综合型语言知识库(CLKB)是中国计算语言学领域技术转化的典范案例。CLKB包含现代汉语语法信息词典、多语言概念词典等系列资源,自1996年起实现技术转化。截至公开资料记载,该知识库累计对外签署转让协议超过200份,使用者包括微软(Microsoft)、IBM、百度、腾讯等国际和国内企业。这一大规模技术转化在中国高校NLP研究领域极为罕见,体现了穗志方及其团队在基础研究与应用落地之间搭建桥梁的能力。
CLKB的转化模式以使用权转让为主,即将语言知识资源授权给企业用于其产品研发。2011年,CLKB项目获国家科技进步二等奖,穗志方为第二完成人(第一完成人为俞士汶,第三完成人为常宝宝),标志着这一产学研合作模式的国家级认可。
在医疗NLP应用层面,CMeKG的构建为智能辅助诊疗、医疗问答系统等应用场景奠定了专业知识基础。CMeKG参考了ICD-10、ATC、MeSH等国际医学标准术语集,覆盖疾病、药物和诊疗技术等核心领域,具备直接应用于智慧医疗场景的产业价值。
5.2 创业孵化与DeepSeek人才输送
穗志方课题组对DeepSeek的人才输送是其产业关联中最引人注目的方面。2026年8月,腾讯新闻发表《草蛇灰线,终成汇流,DeepSeek 技术谱系与那群提前出发的人》深度报道,明确追溯了DeepSeek创始团队部分成员的学术谱系。
报道揭示了一个关键的学术网络:穗志方与常宝宝联合指导的课题组中,王培懿、许润昕和代达劢三位同门最早于2021年在论文"Behind the Scenes"中共同署名,当时研究的是少样本事件分类——尚处于BERT范式时代。此后三人分别于2023年8月、9月加入DeepSeek初创团队,成为DeepSeek从MoE到R1全系列核心技术的关键贡献者:
- 许润昕(2020级硕士,2023年8月加入DeepSeek):参与了从DeepSeek-MoE、DeepSeekMath、DeepSeek-Coder到V2、V3、R1的全过程。
- 王培懿(直博生,2023年9月加入DeepSeek):参与了Math-Shepherd、DeepSeek-V2及后续核心工作。
- 代达劢(2024届博士,加入DeepSeek):代表作包括DeepSeekMoE、Knowledge Neurons in Pretrained Transformers等,Google Scholar被引超3500次。
此外,穗志方的另一位硕士毕业生罗福莉先后在阿里巴巴达摩院(参与VECO多语言预训练模型)和DeepSeek(DeepSeek-V2关键开发者)工作,后转投小米领导大模型团队,成为2024—2025年最受关注的AI人才之一。
这一人才输送链条的意义在于:穗志方与常宝宝的课题组在BERT时代的少样本事件分类研究,为后来DeepSeek在推理、对齐和模型架构方面的突破埋下了"草蛇灰线"般的伏笔。学生们从同一课题组出发,带着不同的技术方言(事件分类、alignment、verifier),最终在DeepSeek汇合成一支覆盖reasoning全链条的团队。穗志方课题组因此成为中国大模型产业人才谱系中的重要源头之一。
在小米方向,穗志方的在读博士生马文晗亦出现在小米MiMo团队论文作者名单中,表明穗志方课题组与小米大模型团队之间已建立直接的人才输送与科研合作关系。
六、重要奖项与学术兼职
| 类别 | 内容 |
|---|---|
| 国家科技进步二等奖 | 2011年度,"综合型语言知识库"项目第二完成人(第一完成人:俞士汶) |
| 国家级教学成果二等奖 | 2022年度(具体项目名称待核实) |
| 学术兼职 | 中国中文信息学会理事(2025年郑州大学报告介绍记为常务理事;百度百科记为理事,待核实) |
| 智源学者 | 北京智源人工智能研究院(BAAI)NLP方向智源学者(2019年起) |
| 国家标准 | 制订国家标准2项(具体标准名称待核实) |
| 特邀报告 | 2025年5月郑州大学"知识驱动的大模型复杂推理能力评测研究"学术报告;2024年3月人工智能女性菁英论坛《大语言模型的知识能力探究》主题报告;第十八届全国少数民族语言文字信息处理学术研讨会特邀报告人 |
七、Connection圈层总结
穗志方的学术关系网络可从以下圈层加以总结:
第一圈层——实验室内核(PKU-ICL同门层):以俞士汶(已故学术前辈)—穗志方—常宝宝—王厚峰—李素建—詹卫东为核心,构成北京大学计算语言学研究所的学术共同体。穗志方处于这一共同体的枢纽位置,既是俞士汶学术遗产的继承者,又是常宝宝的联合导师伙伴,同时与王厚峰在实验室管理上协同。新引进的青年学者潘亮铭进一步拓展了实验室在大模型方向的研究前沿。
第二圈层——学生培养网络(产业输送层):穗志方与常宝宝联合培养的学生群体形成了中国大模型产业中一条清晰的人才谱系。罗福莉(小米/前DeepSeek/前阿里)、代达劢(DeepSeek,EMNLP 2023最佳长论文奖)、许润昕(DeepSeek核心成员)、王培懿(DeepSeek核心成员)、马文晗(在读博士,小米MiMo团队)构成了一条从BERT时代少样本事件分类到大模型reasoning时代的技术演化链条。这一圈层使穗志方课题组成为DeepSeek人才网络的重要源头节点。
第三圈层——跨机构学术合作层:与郑州大学昝红英团队(CMeKG共建)、中科院自动化所赵军研究员(重大项目平行合作)、北京智源研究院NLP学者群体(孙茂松、李涓子、刘洋、万小军、何晓冬等)形成跨机构学术网络。鹏城实验室等新型研究机构亦在此网络中。
第四圈层——产业转化与商业应用层:CLKB知识库超200份转让协议覆盖微软、IBM、百度、腾讯等企业;CMeKG面向智慧医疗应用场景;通过学生网络与DeepSeek、阿里巴巴达摩院、小米等大模型公司建立深度连接。穗志方课题组的基础研究—技术转化—人才输送三位一体的模式,使其在学术界与产业界的交汇处形成了独特的"知识枢纽"角色。
第五圈层——国际学术共同体层:通过ACL、COLING、CoNLL、EMNLP等国际顶级会议的持续发表,以及CLKB的国际引用与使用,穗志方与计算语言学国际学术界保持长期对话。其在大模型知识能力评测、知识神经元等方向的研究,正在国际前沿议题中发出中国学者的声音。
总体而言,穗志方的网络结构以PKU-ICL为核心枢纽,向上承接俞士汶开创的学术传统,向下通过学生培养连接DeepSeek、小米等中国大模型产业核心力量,横向辐射郑州大学、中科院、BAAI等学术机构,纵向贯穿从基础语言资源建设到大模型推理评测的完整技术谱系。她是少数几位其学生群体直接参与并影响了中国大模型产业格局的高校教授之一,这一地位使其学术网络具有超越纯学术范畴的产业意义。