跳转至

北大PKU-DAIR实验室 学者关系网络报告集

报告生成时间:2026年8月4日
调研范围:北京大学计算机学院数据科学与工程研究所下属PKU-DAIR实验室(Data and Intelligence Research Lab,数据与智能实验室)核心教研团队


一、实验室教师一览

PKU-DAIR实验室由崔斌教授于加入北京大学后创立并长期担任负责人,实验室聚焦数据库系统、大数据管理与分析、AI系统(深度学习/大模型训练推理系统)等方向,是一个以单一PI为核心、配备专职科研骨干的紧密型课题组,而非多PI并列的大型实验室(区别于此前调研过的浙大ARClab、上海交大IPADS等团队结构)。实验室代表性开源系统包括Hetu(河图)、HET、OpenBox、Galvatron等,托管于github.com/PKU-DAIR。经调研确认,实验室核心教研序列成员共2人:

姓名 职位 在团队中的角色 报告文件
崔斌 博雅特聘教授 实验室创始人与负责人(PI);计算机学院副院长、数据科学与工程研究所所长 pku_dair_cuibin_network.md
杨智 副研究员 团队核心骨干,长期与崔斌共同担任论文通讯作者,承担系统研发与工程化落地的核心分工 pku_dair_yangzhi_network.md

需要说明的是,PKU-DAIR实验室规模庞大的博士生、硕士生及博士后团队(据崔斌个人主页公开信息,历年培养博士23人、硕士33人,现有在读博士生11人、硕士生21人、博士后5人)均不属于教研系列编制人员,故未单独立档,但其中的代表性成员(如张文涛、苗旭鹏、马凌霄等)已在崔斌、杨智两份报告的"学生培养情况"章节中详细覆盖。

二、两位教师的角色定位

崔斌是这个实验室当之无愧的核心与灵魂人物。他1996年本科毕业于西安交通大学少年班,2004年获新加坡国立大学博士学位(导师Beng Chin Ooi,现浙江大学求是特聘教授),此后加入北京大学并创立PKU-DAIR实验室。作为IEEE Fellow、CCF会士、教育部长江学者特聘教授,他在数据库系统领域深耕二十余年,近年来敏锐地将团队研究方向拓展至AI系统(深度学习训练推理系统)领域,主导研发的Hetu分布式深度学习框架已成为国内高校自主研发AI系统的代表性成果之一。他培养的博士生梯队规模庞大且质量突出,多人已成长为高校教师(如姜佳君现任同济大学教授、殷弘志现任昆士兰大学教授)或活跃于腾讯、字节跳动、小米等头部企业,形成了"导师-学生"关系持续终身化的典型学术家族模式——张文涛博士毕业后与崔斌的合作论文数仍高达165篇,为全网络最高频合作记录。

杨智则是这个团队日常科研运作不可或缺的支柱型人物。作为副研究员、博士生导师,他与崔斌在HET(VLDB 2022最佳可扩展数据科学论文)等代表性成果中长期共同担任通讯作者,形成了一种"双核共治"的团队运作模式——崔斌更多承担学术方向把控、资源整合与对外学术影响力建设,杨智则在系统研发的工程化落地、团队日常科研组织方面发挥关键作用。他本人培养的学生(如马凌霄)也已在深度学习编译优化方向产出了具有影响力的系统性成果,显示出这一"双核"结构正在向更深层次的独立培养能力延伸。

三、团队关系网络的整体观察

其一,"单PI+核心骨干"的紧凑结构是团队高效运转的关键。 与清华KEG、上海交大IPADS等多PI并列的大型实验室不同,PKU-DAIR实验室的教研序列编制人员仅有崔斌、杨智两人,团队的实际运作在很大程度上依赖于庞大的博士生、硕士生梯队承担具体科研任务,这种"精干指挥层+庞大执行层"的结构使得团队能够在保持决策效率的同时,实现研究方向的快速扩张(如从传统数据库系统迅速拓展至AI Infra领域)。

其二,"自主培养、终身合作"的学术家族模式贡献了团队的持续产出能力。 崔斌培养的多位博士生毕业后仍与其保持高频次学术合作(张文涛165次、付方城74次、苗旭鹏73次等),这种现象在国内计算机学科团队中较为突出,一方面得益于团队研究方向本身具有较强的延续性和技术积累价值,另一方面也反映出崔斌在团队文化建设和长期学术关系维系上的投入。

其三,产学研合作网络覆盖面广,且随大模型技术浪潮持续深化。 团队先后与腾讯(2017年北大-腾讯协同创新实验室)、百川智能(2024年联合实验室)建立正式合作机制,同时与阿里巴巴、华为、字节跳动、苹果、快手、中兴通讯等企业在系统落地层面保持广泛的技术合作与人才输送关系,Hetu、OpenBox等开源系统已在多家企业的生产环境或研发流程中得到实际应用。

其四,团队人才培养呈现"回流反哺"的新趋势。 值得关注的是,团队培养的部分优秀学生在海外或其他高校经历短暂历练后,出现回流北大任教或与母团队重新建立合作关系的现象(如苗旭鹏在卡内基梅隆大学、普渡大学任职后回流北京大学),这一趋势如果持续,将进一步强化PKU-DAIR实验室在国内数据库与AI系统领域的人才集聚效应。

其五,交叉验证过程中修正了多处人名与身份表述错误,提示同类调研需谨慎甄别。 在报告撰写过程中,交叉验证环节发现并修正了包括"苗旭鹏"(原误写为"缪煦鹏")、"戴亚飞"(原误写为"戴亚非")、"杨仝"(原误写为"杨形")等人名拼写错误,以及杨智一度被崔斌报告错误重复列为另一位不存在的"杨植教授"的身份混淆问题。这提示在利用网络公开资料进行学术关系网络调研时,同音字、形近字导致的人名讹误是较为常见且需要格外警惕的数据质量风险。

数据来源与说明

本报告集所有内容均基于公开网络信息独立调研整理,主要信源包括北京大学计算机学院官方网站及教师主页、崔斌与杨智的个人学术主页、PKU-DAIR实验室GitHub开源主页、DBLP学术数据库、VLDB/KDD等学术会议官方公告、北京大学新闻网及相关企业合作新闻报道等。此外,本次调研还参考并重新整理了此前独立撰写的《北京大学崔斌教授学术关系网络报告》(存档于上级目录pku_cuibin_scholar_network.md)中的一手调研数据,在新格式下进行了扩展与核实。

由于同名学者数据库合并等问题,部分学者的公开引用数据可能存在偏差;报告撰写与交叉验证过程中已尽量通过官方主页、DBLP消歧记录、机构公告等信息进行核实,对无法完全确证的信息(如个别奖项的具体获奖项目、人才计划的具体类别)已如实标注证据强度,不做主观臆测。

本报告集共包含2位核心教师的独立报告及本索引文件,合计约5万字符。如需了解某位教师的详细学术履历、师承关系、学生培养情况或产业合作细节,请查阅对应的独立报告文件。