跳转至

北大智能学院 曲天书 副教授

报告生成时间:2026年9月15日
个人主页:曲天书 - 北京大学智能学院(另见 北京大学人工智能研究院师资页Scholar@PKU 个人主页
所属团队:北京大学智能学院"听觉、言语与音乐"学科方向(负责人:吴玺宏;成员:曲天书、陈婧、金鑫、许多);北京大学言语听觉研究中心;跨媒体通用人工智能全国重点实验室


一、学者基本信息

字段 内容
姓名 曲天书(Tianshu Qu)
职称 副教授、博士生导师(北京大学智能学院;官方页面明确其职称为副教授,非教授)
所属单位 北京大学智能学院;兼任北京大学国家生物医学成像科学中心;跨媒体通用人工智能全国重点实验室;北京大学言语听觉研究中心
所属学科方向 北京大学智能学院"听觉、言语与音乐"方向骨干成员(负责人吴玺宏)
研究方向 空间听觉、虚拟声音、三维音频场景分析、多通道音频编码;音频编码、声源定位与增强;近年聚焦基于球麦克风阵列的高阶声场(HOA)记录与重放技术
学术兼职 AVS(数字音视频编解码技术标准工作组)音频组联合组长;全国信息标准委员会委员;IEEE、ASA(美国声学学会)、AES(国际音频工程学会)会员
教学职务 北京大学智能学院"智班"科研导师(学院"智班培养—科研导师"名录在列)
邮箱/电话 qutianshu@pku.edu.cn;010-62756824
学术产出 在 IEEE TASLP、JASA、ICASSP、JAES 等期刊与顶级会议发表论文数十篇;累计申请国家发明专利 50 余项,获授权 10 余项
人才头衔 公开资料未见其入选国家级人才计划的记录

二、教育背景与职业履历

需要首先澄清一个常见误判:曲天书并非北京大学科班出身,其完整学历均在中国东北地区的高校完成。他 1993 年本科毕业于吉林工业大学自动化系,1999 年获吉林工业大学通信与信息系统专业硕士学位,2002 年获吉林大学通信与信息系统专业博士学位(吉林工业大学于 2000 年并入吉林大学,故其硕士母校与博士母校实为同一机构体系的前后身)。此后他南下进京,2002 年至 2004 年在北京大学从事博士后研究工作,2004 年出站后留校,进入北京大学信息科学技术学院智能科学系承担教学科研工作至今(2021 年智能学院成立后,随原智能科学系建制整体进入智能学院,现职称为副教授、博士生导师)。

其学术履历中有两段关键经历深刻塑造了其研究方向。其一,2002 年他入站北大做博士后时,恰逢北京大学言语听觉研究中心成立(该中心于 2002 年 2 月由听觉/言语领域的跨学科力量组建,是国内重要的言语听觉科学综合研究机构),此后他的研究始终锚定在北大"机器听觉"这一学派脉络之内。其二,2011 年 3 月至 2012 年 3 月,他赴美国密歇根州立大学(Michigan State University)作访问学者一年,其间与国际心理声学权威 William M. Hartmann 教授合作,完成了关于双耳时间差(ITD)阈值、旋转声像感知仰角等系列研究,这段经历使其空间听觉研究与北美经典心理声学派建立了直接连接。其研究主线大致可概括为"心理声学机理 + 音频信号处理"两条腿:前者以双耳线索、距离感知、听觉老化为主,发表在 JASA、Ear and Hearing、PsyCh Journal 等;后者以声源定位、麦克风阵列、高阶高保真立体声(HOA)采集与双耳重放、音频编码为主,发表在 IEEE TASLP、JAES、ICASSP 等。

职业履历要点(时间线):

时间 事件
1989–1993 吉林工业大学自动化系,学士
1996前后–1999 吉林工业大学通信与信息系统专业,硕士
1999–2002 吉林大学通信与信息系统专业,博士
2002–2004 北京大学博士后研究(合作导师公开资料未披露)
2004.6 参加浙江(宁波)科技成果交易会并达成科技转化合作意向(据百度百科)
2004 至今 北京大学信息科学技术学院智能科学系(现北京大学智能学院)任教,现任副教授、博士生导师
2011.3–2012.3 美国密歇根州立大学访问学者(与 William M. Hartmann 合作)
2021 起 随智能科学系并入北京大学智能学院;兼任北京大学国家生物医学成像科学中心;现为跨媒体通用人工智能全国重点实验室副教授

从师承谱系看,其博士导师身份公开资料未披露,博士后合作导师亦未公开;但从其 2002 年入站即与吴玺宏、迟惠生、李量等北大人长期合著论文(最早的合著记录始于 2005 年前后,如 2008 年 JASA 普通话语音频率重要性函数论文)的事实看,其学术共同体自博士后阶段起即嵌入以言语听觉研究中心为核心的北大机器听觉学派,是吴玺宏所主持方向的资深骨干。

三、学生培养情况

3.1 招生与培养总体情况

曲天书为北京大学智能学院博士生导师,招生方向覆盖智能学院"听觉、言语与音乐"学科方向(空间听觉、音频信号处理、声源定位与增强等);同时他列入学院"智班"(智能科学拔尖人才培养项目)科研导师名录,承担本科生科研指导工作(据北京大学智能学院官网"人才培养—智班培养—科研导师"页面)。其所在学科方向官网称,该方向研究获国家重点研发计划、国家自然科学基金重大项目或重点项目、国家社会科学基金重大项目、科技创新2030重大项目等多项资助,方向团队共计发表论文 70 余篇、申请国家发明专利 50 余项——这一产出规模覆盖了方向全部成员(吴玺宏、曲天书、陈婧、金鑫、许多)。

3.2 可查证的学生相关成果

  • AES 第 144 届大会(2018 年,米兰)最佳学生论文奖:据 AES 学会期刊(JAES)相关二手学术转载报道,北京大学研究团队(学生第一作者,据该报道为 Qingbo Huang,与吴玺宏、曲天书合作;AES/JAES 官方获奖名单公开渠道未见披露)获该届大会最佳学生论文奖;吴玺宏官方简介亦记载"指导博士生获 ISCSLP2014、AES2018 最佳学生论文奖"。相关论文工作(参数立体声编码去相关、基于卷积/GAN 的带宽扩展等,2016–2019 年发表于 JAES/ICASSP 等)出自曲天书深度参与的空间音频编码研究线。此为该团队学生培养最明确的公开可证成果。
  • 近年论文第一作者群体:其近年(2023–2026)论文的第一作者多为北大学生署名(如声音事件定位检测、通用声音分离、盲源计数与定位、文本辅助视频到音频生成 TA-V2A 等工作)。依据本报告的证据纪律(不由论文合著推断师生关系),此处仅记录"论文第一作者"事实,不将其中的具体个人认定为曲门弟子。

3.3 无法确认事项

曲天书个人及其实验室的在读学生名单、历年毕业研究生名单及其去向(高校教职或企业任职),在北大智能学院、言语听觉研究中心等官方渠道均未公开披露,公开网络亦未检索到以其为指导教师的学位论文记录。故本节"学生培养与去向"部分以"公开资料未披露"如实处理。

四、学术合作网络

以下合作网络基于 OpenAlex 学术数据库(其署名论文约 80 篇,活跃年份 2005–2026)与官方资料交叉整理;已剔除数据库中因同名混淆而错误合并的论文(如建筑信息模型、企业高管人格、神经元识别等与音频研究无关的条目)。

4.1 学院/实验室内部合作(北大听觉学派核心圈)

  • 吴玺宏(智能学院教授,"听觉、言语与音乐"方向负责人、智能学院党委书记):曲天书学术网络中绝对的第一合作者,二人合著论文超过 50 篇(2005–2025 年持续不断),覆盖 JASA、IEEE TASLP、Ear and Hearing、ICASSP、JAES 等几乎全部团队成果阵地。吴玺宏为言语听觉研究中心主任、曾任机器感知与智能教育部重点实验室副主任,二人构成"吴玺宏—曲天书"长达二十年的稳定学术轴心:吴玺宏侧重听感知机理与建模,曲天书侧重音频信号处理与空间音频技术,形成"机理—技术"互补结构。2025 年二人合作在《现代电影技术》发表球麦克风阵列 HOA 电影音频制作论文,是其合作延续至今的明证。
  • 学科方向同事(陈婧、金鑫、许多):智能学院"听觉、言语与音乐"方向的正式成员(据学院官网学科方向页)。陈婧早年与曲天书、吴玺宏、迟惠生等合著 JASA 2008 年普通话语音频率重要性函数等论文;金鑫、许多为该方向较新的骨干力量(其具体分工公开资料着墨有限)。
  • 李量(北京大学心理与认知科学学院,现亦署名北京脑科学与类脑研究中心):曲天书网络中仅次于吴玺宏的长期合作者,二人合著约 20 篇论文(2005–2021),集中在听觉感知的心理物理研究(双耳相关、频谱变化检测、知觉性分离、情绪语音、阿尔茨海默病听觉加工衰退等),发表于 JASA、Hearing Research、Ear and Hearing、PsyCh Journal 等。这条合作线使曲天书的空间听觉研究始终保持坚实的心理声学实证基础。
  • 迟惠生(北京大学教授,言语听觉研究传统开创者之一):在 2008 年 JASA 普通话语音可懂度论文等早期成果中与曲天书合著,代表了北大机器听觉学派的老一辈学术背书(言语听觉研究中心亦以其团队为基础组建)。
  • 北京大学临床医学机构:通过李量主导的老年听觉认知研究,与北京大学第六医院、首都医科大学等临床机构形成合作(2021 年前后多篇阿尔茨海默病听觉加工论文)。

4.2 国内跨机构合作

  • 中国科学院声学研究所:2008–2009 年,曲天书与声学所李晓东、巩梅等合著 KEMAR 仿真头距离相关 HRTF 数据库论文(ICALIP 2008 / IEEE TASLP 2009),该数据库是国际空间听觉研究广泛使用的公共资源,也是北大—中科院声学所在空间听觉领域的标志性合作。
  • 哈尔滨工业大学(Haifeng Li):2014 年 PsyCh Journal 语音信息掩蔽释放研究合作者。
  • 广电系统(原国家新闻出版广电总局署名研究者):2012–2014 年间,合作者曹书阳(Shuyang Cao)以"国家新闻出版广电总局"为署名单位之一与曲天书、吴玺宏、李量合著多篇听觉老化与信息掩蔽论文,显示其研究网络曾延伸至广电技术系统(该系统恰为三维声广播标准的主管领域,与其后 AVS 音频标准化职务存在业务呼应)。
  • 中国电影科学技术研究所(中央宣传部电影技术质量检测所):2025 年,其与吴玺宏合作的 HOA 电影音频制作论文刊于该所主办的《现代电影技术》,并由该所副所长(正高级工程师)撰写专家点评,构成其与电影技术检测与研究体系的直接学术接口。
  • 北京大学校内跨学科:与王平(Guoping Wang,北大图形/可视化方向)团队及学生金旭彤、李晟合作 ACM Multimedia 2020 论文 Deep-Modal(任意形状物体实时碰撞声合成),显示其声学技术与图形学方向的跨学科协作。

4.3 国际合作

  • 密歇根州立大学(William M. Hartmann):2011–2012 年访问学者的接收方与合作者,合著 4 篇论文(低频双耳时间差阈值、旋转水平面声像的感知仰角等,发表于 JASA 与 Springer 会议文集)。Hartmann 是国际心理声学/空间听觉领域的权威学者,这段经历是曲天书国际学术网络的锚点。
  • 多伦多大学(Bruce A. Schneider):老年听觉研究的长期合作者,共同完成听觉老化与频谱变化检测系列论文(JASA 2012、Ear and Hearing 2012),Schneider 是听觉老化研究的国际代表人物。
  • 韦恩州立大学(Jinsheng Zhang):2014 年 PsyCh Journal 语音信息掩蔽研究的合作者。
  • 马里兰大学(Dinesh Manocha):2020 年 ACM Multimedia 论文 Deep-Modal 的合作者;Manocha 为计算机图形学与声学仿真领域国际知名学者,该合作将曲天书团队带入虚拟现实声音合成的前沿。
  • 瓦伦西亚理工大学(Larisa Dunai,西班牙):2013 年双耳时间差阈值研究的合作者(其研究方向为面向视障者的声学信号处理)。
  • 北京通用人工智能研究院/跨媒体通用人工智能全国重点实验室:曲天书近年论文署名单位包含跨媒体通用人工智能全国重点实验室,与该实验室(朱松纯院士体系)存在机构层面的归属联系。

五、业界合作关系深度分析

5.1 标准化主线:AVS 音频组联合组长

曲天书产业连接的第一支柱是音视频技术标准化。他现任 AVS(数字音视频编解码技术标准工作组)音频组联合组长、全国信息标准委员会委员(据百度百科词条及官方页转述)。AVS 工作组是中国多媒体领域最重要的标准化组织,成员单位涵盖腾讯、华为等头部企业——例如 AVS3-P10(面向实时语音通信的新一代语音编码标准)即由腾讯提议推动,并由华为进行主观质量交叉验证。作为音频组联合组长,曲天书实质性地处于"高校—企业"标准共研的枢纽位置,其音频编码、三维声/空间音频研究(多通道音频编码、HOA、参数立体声等)与该标准体系的议题高度同构。需要说明:AVS 组内协同属于工作组成员共同参与标准制定的一般机制,曲天书与华为、小米、科大讯飞等具体公司的双边合作,公开资料未披露。

5.2 影视音频应用主线:球麦克风阵列 HOA 技术

曲天书近年研究聚焦于基于球麦克风阵列的高阶声场记录与重放(HOA)技术及其在电影音频制作中的应用。据百度百科及期刊报道,其团队参与设计了基于球麦克风阵列的三维声场录制及双耳重放技术,提出高阶高保真立体声采集方案,研究成果应用于电影沉浸式音频制作;2025 年与吴玺宏在《现代电影技术》发表的论文,系统提出了面向电影制作场景的球谐域采集与虚拟扬声器双耳重放方案,并获得中国电影科学技术研究所专家的高度评价。这构成其与电影工业技术体系(摄制、还音、检测环节)的深度对接,是国内高校中少见的"实验室技术—电影工艺流程"直接贯通的案例。

5.3 消费音频与空间声学技术

其空间听觉技术储备(KEMAR 距离相关 HRTF 数据库、个性化 HRTF 建模、HOA 双耳渲染)天然面向耳机虚拟环绕声、VR/AR 沉浸式音频等消费场景:2021 年发表于 JAES 的个性化 HRTF 双耳渲染器论文,合作者包括多位署名机构未公开披露的产业界研究者(其具体所属企业公开资料未披露,本报告不作推断)。此外,2004 年其博士后出站当年即参加浙江(宁波)科技成果交易会并达成科技转化合作意向,是其早期技术转化尝试的公开记录。

5.4 转化形态小结

综合来看,曲天书的产业合作以"标准化(AVS)+ 行业应用(电影音频)+ 专利储备(申请 50 余项、授权 10 余项)"三种形态为主,未发现以本人或其学生为核心创始人的创业公司及融资记录,属于"深度嵌入标准与行业工艺体系"而非"自立门户"的学院派产学研路线。

六、重要奖项与学术兼职

类别 名称/内容
学术兼职(标准化) AVS 音频组联合组长;全国信息标准委员会委员
学术兼职(学会) IEEE 会员;美国声学学会(ASA)会员;国际音频工程学会(AES)会员
兼职机构职务 兼任北京大学国家生物医学成像科学中心;跨媒体通用人工智能全国重点实验室副教授
教学职务 北京大学智能学院"智班"科研导师
团队奖项 AES 第 144 届大会(2018 年,米兰)最佳学生论文奖(北京大学团队,学生第一作者与吴玺宏、曲天书合作,姓名官方渠道未见披露、二手报道称 Qingbo Huang);(同方向相关:ISCSLP 2014 最佳学生论文奖,出自吴玺宏团队)
知识产权 累计申请国家发明专利 50 余项,获授权 10 余项(据百度百科及学科方向官网)
个人荣誉 公开资料未披露其个人获得重要奖项的记录

七、Connection 圈层总结

曲天书的学术关系网络呈现"一轴心、双圈层、一通道"的结构:

  • 核心圈(北大听觉学派):以"吴玺宏—曲天书"二十余年合著轴心为骨架,叠加李量(心理与认知科学学院)的心理声学实证线、迟惠生所代表的学派历史渊源,以及陈婧、金鑫、许多等"听觉、言语与音乐"方向正式成员,构成北京大学机器听觉学派"机理—感知—技术"三位一体的完整闭环。其网络资本的根基在于该学派内部不可替代的"空间音频技术支柱"角色。
  • 学术圈(国内外同行网络):国内以中科院声学所(HRTF 数据库)、哈工大、广电系统研究机构、中国电影科学技术研究所及北大校内临床机构为主;国际以密歇根州立大学 Hartmann(访学接收与合作)、多伦多大学 Schneider(听觉老化)、韦恩州立大学 Zhang、马里兰大学 Manocha(声音合成)、瓦伦西亚理工大学 Dunai 为节点,整体嵌入国际心理声学与空间声学共同体。
  • 产业圈(标准化 + 影视音频双通道):以 AVS 音频组联合组长身份接入腾讯、华为等企业成员共同参与的国家音视频标准体系,以 HOA 球麦克风阵列技术对接电影沉浸式音频制作工业,辅以 50 余项专利储备。其产业连接的独特点是"以标准制定和行业工艺为载体",而非横向项目或创业孵化。
  • 学生圈(有限披露):其指导学生中的公开可证亮点是 2018 年 AES 最佳学生论文奖(团队成果);学生名单与去向整体公开披露有限,构成其网络中透明度最低的一环。

总体而言,曲天书是一位"东北高校培养、北大学派定型"的本土成长型学者:教育履历全部完成于吉林工业大学/吉林大学,2002 年经博士后通道进入北大后从未离开,其全部学术资本高度集中于北大听觉学派这一单一建制之内。与典型"多点跳槽"型学者相比,他的网络结构呈"厚内核、专外围"特征——内核(吴玺宏轴心 + 方向团队)极厚,外围沿心理声学学术共同体与 AVS/电影音频两个产业通道定向延伸,在空间听觉与三维音频这一细分领域内具备稀缺的标准话语权与行业工艺对接能力。


主要资料来源

  1. 北京大学智能学院师资/科研导师页(曲天书):https://sai.pku.edu.cn/info/1479/2528.htm
  2. 北京大学人工智能研究院师资页(曲天书):https://www.ai.pku.edu.cn/info/1326/2868.htm
  3. 北京大学智能学院专职教师列表(含曲天书条目):https://sai.pku.edu.cn/szdw/zzjs/3.htm
  4. 北京大学智能学院学科方向页"听觉、言语与音乐"(负责人吴玺宏,成员曲天书、陈婧、金鑫、许多):https://www.cis.pku.edu.cn/info/1087/2307.htm
  5. 北京大学信息科学技术学院学科方向页(确认"听觉、言语与音乐"负责人为吴玺宏):https://sist.pku.edu.cn/xkjs/xkfx.htm
  6. 曲天书百度百科词条(教育履历、AVS 音频组联合组长、全国信息标准委员会委员、专利数据等):https://baike.baidu.com/item/曲天书/49787724
  7. 吴玺宏官方简介(北京大学人工智能研究院):https://www.ai.pku.edu.cn/info/1326/3230.htm ;及其中央音乐学院音乐人工智能系兼职页(含 ISCSLP2014、AES2018 最佳学生论文奖记录):https://www.ccom.edu.cn/info/15101/213691.htm
  8. 《现代电影技术》2025 年第 2 期论文《基于球麦克风阵列的高阶声场记录与重放在电影音频制作中的应用》(曲天书、吴玺宏)及其官方微信公众号转载:https://mp.weixin.qq.com/s?__biz=MzAwNzI5NDc3NA==&mid=2657562026&idx=1&sn=e343eb14651506b88fcc300348a3850b
  9. AES 学会期刊(JAES)关于北京大学团队获 AES 第 144 届大会(米兰,2018)最佳学生论文奖及 AES 北京分会活动的报道(经 zhangqiaokeyan 学术转载)。
  10. 北京大学言语听觉中心简介(成立时间 2002 年 2 月):https://baike.baidu.com/item/北京大学言语听觉中心/3831161
  11. OpenAlex 学术数据库(Tianshu Qu, A5103080532,约 80 篇论文及合作者网络;同名混淆条目已人工剔除)。
  12. AVS 工作组与 AVS3-P10 标准相关公开报道(腾讯提议、华为验证等行业参与情况):https://zhuanlan.zhihu.com/p/707697789

说明:本报告全部关键事实均以上述来源核实;其中学生培养与去向、博士后合作导师、与具体企业的双边合作等信息因公开资料未披露而如实标注,未作任何基于论文合著关系的师承推断。经检索,AcademiConnection 站内(pages/docs)此前无"曲天书"相关条目,本报告为首个条目,暂无需维护的站内交叉引用。