跳转至

上海交通大学 吴梦玥 副教授

报告生成时间:2026年8月21日
个人主页:吴梦玥
所属团队:上海交通大学 跨媒体语言智能实验室(X-LANCE)丰富音频研究组 / 仿脑计算与机器智能研究中心(BCMI)成员


一、学者基本信息

字段 内容
姓名 吴梦玥(Mengyue Wu)
出生年份 未公开
职称 副教授(此前为副研究员),博士生导师
所属单位 上海交通大学计算机学院(网络空间安全学院)计算机科学与工程系,机器智能研究所
实验室职务 X-LANCE 跨媒体语言智能实验室成员、"丰富音频研究组"(Rich Audio Analysis Group)负责人;同时列为仿脑计算与机器智能研究中心(BCMI)成员
学术头衔 IEEE 会员、ACM 会员(2018 年起);ARR Rolling Review Area Chair;Interspeech Area Chair
国家级人才 未见国家级人才计划入选记录(省部级人才:上海市"浦江人才"计划获得者)
其他任职 中文信息学会(CIPS)情感计算专委会副秘书长;中国计算机学会(CCF)语音对话及听觉专委会执行委员;2019 年 ICMI 大会地方组织委员会主席
邮箱 mengyuewu@sjtu.edu.cn(早年页面另列 wumengyue@cs.sjtu.edu.cn)
研究方向 计算精神健康(音频信号与自然语言处理):大模型共情、主动对话系统、病理音频分析、医疗大模型安全与伦理、心理筛查与咨询系统落地;丰富音频分析(音频描述、声事件检测与生成、动物声学交流解码)

说明:用户线索中"吴梦玥可能是俞凯教授(思必驰/交大智能语音实验室)的学生"这一假设不成立——她并非在交大攻读博士学位,其博士学位由澳大利亚墨尔本大学授予。她与俞凯的关系是:博士毕业后加入俞凯领衔的智能语音实验室/X-LANCE,成为实验室青年研究负责人之一,其指导的学生在行政上多挂靠俞凯(博导资格早年未独立时),实际由她与俞凯共同指导。

二、教育背景与职业履历

吴梦玥的学术道路是一条罕见的"心理声学—实验语音学—语音 AI—计算精神医学"四重交叉路径。

本科(北京师范大学)。据其 2024 年接受 HyperAI 超神经的深度访谈自述,她本科就读于北京师范大学,方向为心理声学,自幼对"闻声识人"式的个体语音差异高度敏感;本科毕业设计即尝试用计算建模的方式分析声学数据,这为其后来的转向埋下伏笔。心理学的学科底色(而非典型工科计算机训练)深刻影响了她此后"以人为中心"的研究取向。

博士(澳大利亚墨尔本大学)。她随后赴墨尔本大学攻读博士学位,所属为语言与语言学学科方向(School of Languages and Linguistics 体系),博士论文题为《Perception and production of Cantonese tones by speakers with different tonal experience》(不同声调经验说话人的粤语声调感知与产出),2017—2018 年前后完成。从其博士期间论文(ICPhS 2015 及 2016 年系列论文)的作者构成看,其墨尔本阶段的核心合作者与指导团队包括墨尔本大学语音学教授 Janet Fletcher、语言学高级讲师 Brett Baker(澳籍原住民语言与语音学专家)、语音感知理论名家 Catherine Best(西悉尼大学 MARCS 研究所)以及 Rikke Bundgaard-Nielsen 等语音学学者(正式导师名单未见官方公开记录,此处据合作发表论文推断,采用谨慎表述)。读博期间,两位同学的研究经历——一位在田野调查中对街头流浪的精神分裂症患者做语音分析,一位临床心理学博士毕业后进入墨尔本监狱为犯人做精神疾病评估——直接启发了她"用语音做精神疾病客观评估"的研究志趣。

职业选择(Nuance 与俞凯)。博士毕业后,她曾获得语音识别巨头 Nuance Communications 的邀请,一度考虑在产业端从事车载人机交互方面的技术研究与落地(其早期交大论文中大量"汽车场景音频"主题与此呼应)。据访谈自述,后来在与上海交通大学俞凯教授的一次对话中,她看到了高校科研的优势与成果转化新思路,最终选择加入上海交大计算机系智能语音实验室(SpeechLab,后发展为 X-LANCE 跨媒体语言智能实验室)。她与俞凯的关系因此是"引路人+长期合作者"而非师生传承。

入职交大与职位变迁(约 2018/2019 至今)。以论文记录推断,她约于 2018 年底—2019 年加入交大:2019 年即与俞凯、Xuenan Xu、Heinrich Dinkel 联名发表 X-LANCE 首批论文(如 ICASSP 2019 "Audio Caption: Listen and Tell"),并担任 2019 年 ICMI(国际多模态交互大会,俞凯任程序委员会主席)的地方组织委员会主席。入职初期职位以博士后/研究系列为主(具体起聘职位未见公开记录),2022 年前后学校及会议通知中称其为"副研究员",2023 年起以"副教授"身份出现(如 2023 中国多媒体大会简介),现为计算机学院副教授、博导,主持国家自然科学基金青年项目与面上项目,并获上海市"浦江人才"计划(面向海外归国青年人才,具体入选年份未公开,约在其入职初期)。2018 年起即为 IEEE、ACM 会员。

关于海外经历的说明:曾有传闻称其曾在卡内基梅隆大学语言技术研究所(LTI)访问或联培。经多渠道检索,其官方主页、交大官方教师页、访谈及全部论文合作记录中均未发现 CMU/LTI 访问或联合培养的记录;其海外经历为墨尔本大学(博士,2014—2018 前后),2015—2016 年论文均署名墨尔本大学。该 CMU 传闻缺乏依据,本报告不予采信。

代表性论文(选择性列出):DEPA(自监督音频抑郁检测,ACM MM 2019);Voice Activity Detection in the Wild(T-ASLP 2021);D4(全球首个符合临床标准的开源抑郁症问诊对话数据集,EMNLP 2022);PsySym(可解释精神症状检测数据集与模型,EMNLP 2022);PsyEx(双流精神科专家模型多障碍检测,EMNLP 2023);PsyDial(医患模拟聊天机器人,2023);BLAT(ACM MM 2023);SemantiCodec(超低码率语义音频编码,JSTSP 2024);PicoAudio / AudioTime / FakeSound(音频生成与深度伪造音频检测,2024);Delusions of Large Language Models(ACL 2025 杰出论文奖)。累计在 ACL、EMNLP、ICLR、AAAI、ACM MM、ICASSP、Interspeech、T-ASLP 等发表论文 70 余篇。

三、学生培养情况

吴梦玥 2019 年前后才开始独立带学生,起步晚于资深教授,但其课题组(X-LANCE 丰富音频研究组)扩张迅速,据 2024 年访谈自述已有学生二十余人。其主页公开列出的在读学生包括:Xuenan Xu(博)、Kunyao Lan(博)、Xiujie Song(联合指导博)、Jiaming Luo(联合指导博)、Zeyu Xie、Siyuan Chen、Fei Yang、Xiaohang Xu、Minghao Lv、Haoan Jin、Hao Tang、Xingyuan Li、Chunhao Zhang、Yufei Wang、Zhige Huang(硕)及拟入学硕士生 Jiaxi Liu、Baihan Li。以下挑选已毕业及代表性学生详述(注:早年学生行政导师为俞凯,吴梦玥为实际共同指导人,她自称第一位联合指导博士生为 Heinrich Dinkel)。

1. Heinrich Dinkel(博士,联合指导第一位学生)

Heinrich Dinkel 是吴梦玥在交大指导的第一位(联合指导)博士生,2020 年博士毕业,现任小米公司高级算法研究员。他是 X-LANCE 音频方向的传奇性人物之一(GitHub 用户名 "richman" 即"丰富音频"一词的来源——吴梦玥主页笑称其研究组名称 Rich Audio Analysis 由此得名)。Dinkel 与吴梦玥合作论文 18 篇(2019—2022),涵盖音频描述(Audio Caption)、弱监督声事件检测(T-ASLP 2021 两篇)、语音活动检测(VAD in the Wild)、以及抑郁症音频/文本检测(DEPA、Text-based Depression Detection)。他毕业后入职小米,成为吴梦玥课题组与小米音频算法团队之间的天然纽带。

2. 徐煊南 Xuenan Xu(博士研究生,2025 年毕业,音频理解与生成)

Xuenan Xu 是与吴梦玥合作论文最多的学生(合作约 29 篇,2019—2024),从 DCASE 挑战赛时期的汽车场景音频描述做起,逐步成为课题组音频理解与生成方向的中坚:音频描述(CRNN-GRU 强化学习方法、多样性可控音频描述)、文本-音频 grounding、音频描述评测指标(Can Audio Captions Be Evaluated With Image Caption Metrics)、T-ASLP 音频描述综述(Beyond the Status Quo)、BLAT 预训练框架、Auto-ACD 大规模音频-语言数据集(与谢伟迪合作)、DiveSound(LLM 辅助自动分类构建)、SemantiCodec(与萨里大学合作)、病理语音提示调优统一框架等。2025 年博士毕业,毕业去向未见公开记录。他是把"丰富音频研究组"从零带到国际前沿的核心执行者。

3. 谢泽吾 Zeyu Xie(硕士研究生,2025 年毕业,音频生成)

Zeyu Xie 是课题组音频生成方向的代表学生(合作论文 11 篇,2021—2024):从音频描述中的时序关系增强(Interspeech 2023)起步,做出 PicoAudio(精确时间戳与频率可控的音频事件生成)、AudioTime(时间对齐的音频-文本基准)、FakeSound(通用音频深度伪造检测,ICASSP 2024)、DiveSound(LLM 辅助多样化音频生成,Interspeech 2024)等一系列开源影响力显著的工作。2025 年硕士毕业,去向未公开核实。

4. 张知临 Zhiling Zhang(硕士毕业,数字精神健康方向开创者)

Zhiling Zhang 是课题组"数字心理健康:文本与对话"方向的第一批学生(合作论文 7 篇,2021—2023),主导或深度参与了课题组最具影响力的精神健康系列工作:PsySym(EMNLP 2022 可解释精神症状检测数据集,与 Kenny Q. Zhu 老师合作)、PsyEx(EMNLP 2023 双流精神科专家模型)、PsyDial(医患模拟对话数据集)、IJCAI 2022 精神量表引导的抑郁风险帖子筛查、以及 EMNLP 2023 语义空间加权解码可控对话生成。他本科/硕士期间还参与了本体知识增强的低资源音频标注等音频-语言交叉工作(与 Kenny Zhu 组合作)。硕士毕业后赴海外继续攻读博士学位(具体院校未公开核实)。

5. 陈思远 Siyuan Chen(硕士研究生,数字精神健康)

Siyuan Chen 是精神健康 NLP 方向的另一名骨干学生(合作论文 3+ 篇,2022—2023):与 Zhiling Zhang 共同完成 PsySym、PsyEx 的核心实验,并在 PsyDial(LLM 驱动的精神科医生与患者模拟)中承担主要工作——该工作直接支撑了后来面向抑郁症初诊的"智能体心理诊所"(Agent Mental Clinic, AMC)系统。还合作完成面向早期抑郁检测的风险帖子筛查(IJCAI 2022)。

6. 蓝坤尧 Kunyao Lan(博士研究生在读,数字精神健康)

Kunyao Lan 是课题组现役博士生中的代表,研究方向为数字精神健康(合作论文 3 篇,2023—2026)。他参与了 PsyDial 系列工作,并作为核心作者加入 ACL 2025 杰出论文奖获奖论文《Delusions of Large Language Models》(大语言模型的"妄想",与 Hongshen Xu、Zichen Zhu、Zihan Wang、Ziwei Ji、Lu Chen、Pascale Fung、俞凯等合作),该论文揭示了区别于普通幻觉的"高置信度幻觉"现象。他也是课题组面向 2026 年的持续产出(如《中国科学:信息科学》版本的"大模型妄想"论文)的共同作者。

7. 李光伟 Guangwei Li(硕士 2023 年毕业,现蚂蚁集团算法研究员)

Guangwei Li(合作论文 4 篇,2021—2023)从事音频-视觉交叉与音频生成方向:跨模态失配下的视听事件检测(ICASSP 2022)、类别自适应声事件增强(ICASSP 2022)、文本描述驱动的生动声音生成(ICASSP 2023)。2023 年硕士毕业后入职蚂蚁集团任算法研究员,成为课题组与蚂蚁(医疗大模型伦理安全白皮书合作方)之间的产业联系之一。

8. 张平悦 Pingyue Zhang(硕士 2024 年毕业,赴海外攻读博士)

Pingyue Zhang 是课题组语音医学应用方向的重要学生(合作论文 5 篇,2019—2024):从抑郁症自监督音频嵌入 DEPA(ACM MM 2019/2021,与 Dinkel 合作)起步,后续完成 ReCLR(参考增强对比学习的抑郁检测音频表征,Interspeech 2023)、语义增强监督对比学习,以及抑郁症问诊小程序等落地系统。2024 年硕士毕业后赴海外攻读博士学位。

其他毕业生:姚斌威 Binwei Yao(本科 2022,D4 抑郁症问诊对话数据集核心作者,现为美国威斯康星大学麦迪逊分校博士生);黄登登 Dengdeng Huang(本科 2024,留交大攻读博士)。整体来看,吴梦玥课题组学生的毕业去向覆盖顶级海外博士项目(UW-Madison 等)、头部企业(小米、蚂蚁)与本校深造,培养质量在同年龄段 PI 中相当突出。

四、学术合作网络

4.1 实验室内部:X-LANCE 与交大计算机系

吴梦玥的合作网络以 X-LANCE 为绝对核心(其对俞凯的合作论文逾 40 篇)。

  • 俞凯(X-LANCE 实验室主任,IEEE Fellow):全时期最重要的高级合作者与学术引路人。两人合作横跨音频描述、声事件检测、语音活动检测、抑郁检测、对话系统直至 2025 年 ACL 杰出论文,并共同牵头《医疗健康大模型伦理与安全白皮书》。课题组学生在制度上与俞凯团队深度共享。
  • 陈露 Lu Chen(X-LANCE,对话系统方向):合作 7 篇(2021—2026),涵盖 D4 数据集、OPAL 本体感知对话预训练、DFM/DialogZoo 对话基础模型、以及《Delusions of LLMs》——精神健康对话与对话基础模型两个方向的交汇点。
  • Kenny Q. Zhu(朱其立/朱家桢,SJTU CS):合作约 11 篇(2021—2023),本体知识增强的音频标注、音频描述评测指标,以及 PsySym/PsyEx 精神健康系列——是其学生张知临、陈思远方向的重要共同指导力量。
  • 钱彦旻(X-LANCE,语音识别方向):参与 T-ASLP "Voice Activity Detection in the Wild"(与王帅、Dinkel、俞凯)等弱监督语音处理工作。
  • 谢伟迪 Weidi Xie(SJTU,CMIC/电院):合作 Auto-ACD 大规模音频-语言数据集(ACM MM 2023),连接了丰富音频组与交大多模态大模型力量。
  • 张拳石 Quanshi Zhang(SJTU):合作神经网络可解释性系列工作(AAAI 2021 "Building Interpretable Interaction Trees for Deep NLP Models" 等),是课题组早期与校内可解释性方向的合作。
  • 林洲、钱睿、胡迪等(SJTU 电院视觉方向):合作多声源定位(由粗到细两阶段框架)等视听交叉工作。
  • 苏姿、马大 Da Ma、刘云聪 Liu Yuncong 等 X-LANCE 早期学生:参与 OPAL、DialogZoo、D4 等对话基础模型工作。

4.2 跨机构(国内):精神医学临床网络与校内医学交叉

这是吴梦玥网络中最具特色的一层——一条从计算机系直达临床精神科的通道。

  • 上海市精神卫生中心(交大医学院附属):D4 数据集的构建即在精神卫生中心与医生、患者长时间深度沟通的基础上完成(问诊流程决策树化、医患对话模拟、专业医生筛选);2024 年 9 月与天桥脑科学研究院(TCCI)联合主办"心理健康领域的数据合成与新一代 AI 模型"专题研讨会(吴梦玥与精卫中心医务部陈剑华主任、TCCI 耿海洋博士共同主持);精卫中心还指导了 2025 年"合成数据大赛·灵溪 AI for Mental Health 主题赛"(TCCI 联合盛大集团、清华校友总会 AI 大数据专委会、上海交大计算机学院共同主办)。
  • 吕宝粮(BCMI 仿脑计算与机器智能研究中心主任):吴梦玥同时列入 BCMI 成员页,研究方向(语音情绪/抑郁评估)与吕宝粮团队的情感脑机接口、多模态抑郁评估形成互补。2025 年两人与俞凯、王烁(蚂蚁)共同牵头《医疗健康大模型伦理与安全白皮书》,是 BCMI 与 X-LANCE 在"AI+精神健康临床转化"上的标志性合作。
  • 瑞金医院、北京协和医学院、北京大学医学部、复旦中山医院/肿瘤医院等:作为白皮书专家委员会成员方参与医疗大模型伦理安全框架共建;复旦大学科技伦理研究院为白皮书联合编写单位。
  • 天桥脑科学研究院(TCCI,陈天桥/雒芊芊创立):AMC(Agent Mental Clinic,智能体心理诊所)系统的共同合作方(另含德克萨斯大学阿灵顿分校 UTA 与 ThetaAI 公司);TCCI"人工智能与精神健康前沿实验室"(与精卫中心共建)是其持续对接的临床转化平台。
  • 交大校内交叉:外国语学院丁红卫教授组织的"语音学与大脑神经机制高级研讨会"系列(2022、2023 年均邀请吴梦玥做主旨报告,同场专家含精卫中心李春波、范青,明尼苏达大学张扬、UT Austin 刘畅、华南师大秦鹏民、索诺瓦集团管晶晶等)——这是其语音学出身维持的学术社群;2024 年交大"科技论剑"心理学交叉论坛等亦体现其校内心理学交叉活跃度。
  • 病理语音/科技助残学术圈:在 CCF 秀湖会议"智能语音赋能医疗:病理语音处理与辅具技术探索"论坛上,与中科院心理所王甦菁、中科大凌震华、中科院深圳先进院燕楠、昆山杜克大学李明、港科大(广州)刘李、中科院心理所刘烨等同台报告——构成其在国内"语音+医疗"方向的同行圈层。

4.3 国际合作网络

  • 墨尔本大学(博士母校,语音学脉络):Janet Fletcher、Brett Baker、Catherine Best(西悉尼大学 MARCS)、Rikke Bundgaard-Nielsen。这段经历使其研究始终带有实验语音学与心理声学的底色,也是其与外国语学院、言语科学界保持联系的资本。
  • 香港科技大学 Pascale Fung(IEEE/ACM Fellow):ACL 2025 杰出论文《Delusions of Large Language Models》的资深合作者(连同港科大的 Ziwei Ji),开辟了大模型可靠性这一新战线,并延伸出 2026 年《中国科学:信息科学》版本工作。
  • 英国萨里大学 Wenwu Wang、Mark Plumbley 及 Haohe Liu:合作 SemantiCodec 超低码率语义音频编解码器(JSTSP 2024),连接了国际音频信号处理重镇。
  • 德克萨斯大学阿灵顿分校(UTA):AMC 智能体心理诊所的合作机构之一。
  • 微软亚洲研究院(楼建光 Jian-Guang Lou 等):合作 DialogZoo/DFM 大规模对话基础模型(2022),是课题组与工业界顶尖研究机构在对话系统方向的早期纽带。
  • 国际学术服务:Interspeech Area Chair、ARR Rolling Review Area Chair,深度嵌入国际语音与 NLP 学术共同体;DCASE 挑战赛(IEEE 主办)2022 年双赛道国际冠军使其在计算音频领域享有国际知名度。

五、业界合作关系深度分析

5.1 语音医疗应用与临床转化(核心产业方向)

吴梦玥的产业合作几乎全部围绕"做落地的研究"这一初心展开,形成了国内罕见的"音频 AI × 精神医学 × 伦理治理"三位一体转化路径。

(1)蚂蚁集团:医疗大模型伦理安全治理的旗舰合作。 2025 年 7 月 18 日,在昆明举行的中华医学会医学伦理分会 2025 年会上,《医疗健康大模型伦理与安全白皮书》正式发布。该白皮书由上海交通大学、复旦大学、上海交通大学医学院附属瑞金医院与蚂蚁集团联合编写,吴梦玥与吕宝粮、俞凯、王烁(蚂蚁方)为主要牵头人,专家委员会涵盖北京协和医学院、北大医学部、复旦中山/肿瘤医院、西安交大、厦门大学医学院、天津医科大学等十余所高校与医院。对吴梦玥而言,这一合作有三重意义:其一,将其"医疗大模型伦理安全对齐框架"研究成果直接转化为行业级参考标准;其二,将 X-LANCE(俞凯)与 BCMI(吕宝粮)两条交大 AI+医疗路线在其名下合流;其三,其毕业生李光伟已入职蚂蚁任算法研究员,形成人才输送闭环。

(2)临床机构网络:从数据集到智能体系统。 与上海市精神卫生中心的长期合作支撑了 D4(全球首个符合临床标准的开源抑郁症问诊对话数据集)、PsyDial、AMC(Agent Mental Clinic,智能体心理诊所——同时模拟精神科医生与患者角色,含三层记忆存储结构,可用于抑郁初筛与实习精神科医生培训)等转化成果;疫情期间开发的抑郁症问诊小程序已实际供学生使用。她因此获邀在 CHINC 2022(中国医院信息网络大会)等行业会议上演讲,"面向精神疾病的大模型研究与应用"获上海市数字医学技术及应用创新大赛二等奖。TCCI(天桥脑科学研究院)+ ThetaAI 公司 + UTA 的组合则代表其公益基金会-初创企业-海外高校的多元转化生态,2025 年更以上海交大计算机学院名义共同主办合成数据大赛,将其"对话数据合成"方法论推向行业。

(3)与吕宝粮团队抑郁症语音评估临床转化的关系定位。 吕宝粮团队的强项在 EEG/多模态情感脑机接口与抑郁客观评估(如"睿诊"等临床落地),吴梦玥课题组的强项在语音、文本与对话模态及精神科对话智能体;两者在 BCMI 框架下形成"脑电+语音文本"的模态互补,并在医疗大模型伦理安全白皮书中作为交大双牵头方共同输出治理框架。可以说,吕宝粮打开了"抑郁症客观评估"的临床之门,吴梦玥则在语音模态与问诊对话智能化上延伸了这条路线。

5.2 智能语音产业生态(X-LANCE 产学研体系的组成部分)

  • Nuance Communications:博士毕业时的职业选项(车载人机交互方向),虽最终选择学术界,但这段经历塑造了其早期研究议程(车内音频描述、车载场景声事件检测),也使其始终理解产业需求语言。
  • 小米:第一位联合指导博士生 Heinrich Dinkel 毕业后任小米高级算法研究员(音频算法),是课题组在消费电子音频方向的产业触角。
  • 微软亚洲研究院:DialogZoo/DFM 对话基础模型合作,将课题组对话技术接入 MSRA 生态。
  • DCASE 国际竞赛冠军(2022):IEEE DCASE 挑战赛音频描述(audio captioning)与基于语言的音频检索双赛道国际冠军,是音频理解技术产业化能力的直接背书(该系列技术可直接服务于内容审核、无障碍描述、音频检索等场景)。
  • 开源生态:课题组持续开源 PsySym/PsyEx/PsyEval/PsyDial/D4/CogBench 数据集与模型、PicoAudio/FakeSound/AudioTime 等音频生成与检测工具,以及"精神疾病症状检测模型""医疗大模型伦理安全对齐框架",为企业和医疗机构提供共情能力提升与安全防护资源——这是其自述的产业服务模式。
  • X-LANCE 整体生态的乘数效应:X-LANCE 与思必驰(AISpeech)等企业有深厚产学研传统,其开源的 SLAM-LLM 等语音大模型框架已支持十万小时级工业训练;吴梦玥作为实验室 PI 之一,天然分享这一产业生态资源。

六、重要奖项与学术兼职

年份 奖项/荣誉 说明
2025 ACL 杰出论文奖(Outstanding Paper Award) 《Delusions of Large Language Models》,NLP 顶会 ACL(CCF-A);她为共同作者(第一作者 Hongshen Xu 等,与 Pascale Fung、俞凯、陈露等合作)
2023 NCMMSC 最佳论文提名奖 全国媒体计算学术会议
2022 IEEE DCASE 挑战赛双赛道国际冠军 音频描述(audio captioning)与基于语言的音频检索两个任务
上海市数字医学技术及应用创新大赛二等奖 "面向精神疾病的大模型研究与应用"
上海市"浦江人才"计划 面向海外归国青年人才的省部级人才计划(具体年份未公开)

学术兼职:ARR(ACL Rolling Review)Area Chair;Interspeech Area Chair;中文信息学会(CIPS)情感计算专委会副秘书长(英文页面亦表述为 CCF 情感计算专委会 Deputy Secretary-General);CCF 语音对话及听觉专委会执行委员(早年为委员);IEEE 会员、ACM 会员(2018 年起);2019 年 ICMI(国际多模态交互大会)地方组织委员会主席;CCF 秀湖会议"智能语音赋能医疗"论坛主讲嘉宾/Panel 嘉宾(与王甦菁、凌震华等);历年"语音学与大脑神经机制高级研讨会"常邀专家。

七、Connection圈层总结

第一圈层(核心圈:X-LANCE 与自有课题组)。以俞凯(引路人/最高频合作者,40+ 篇)与陈露、钱彦旻、Kenny Zhu 等 X-LANCE/计算机系同事构成日常协作底盘;自有"丰富音频研究组"则有 Xuenan Xu、Zeyu Xie、Zhiling Zhang、Kunyao Lan、Siyuan Chen 等两代学生(第一位联合指导博士 Dinkel 2020 年即毕业),课题组规模二十余人且仍在扩张。此圈层决定了她的研究基础设施、学生来源与大方向(语音-语言-对话)。

第二圈层(校内交叉与临床圈)。BCMI/吕宝粮(脑电模态与白皮书共同牵头)、交大医学院体系(上海市精神卫生中心、瑞金医院)、谢伟迪等多模态力量、以及丁红卫等言语科学社群。这一圈层是其"计算精神健康"定位的物质基础——没有精卫中心的临床数据与医生参与,就没有 D4/PsyDial/AMC 这条最具辨识度的产品线。

第三圈层(国际学术圈)。三条支线:墨尔本语音学谱系(Fletcher/Baker/Best,赋予其学科底色与言语科学社群身份);音频信号处理圈(萨里大学 Wenwu Wang/Plumbley,DCASE 竞赛圈);NLP/大模型圈(HKUST 的 Pascale Fung 与 Ziwei Ji,微软亚洲研究院楼建光)。ACL 2025 杰出论文奖与 Interspeech/ARR Area Chair 职务标志其已被国际主流共同体接纳为独立学术带头人。

第四圈层(产业与转化圈)。蚂蚁集团(白皮书、人才输送)、小米(毕业生 Dinkel)、微软亚研、TCCI/ThetaAI/UTA(AMC 系统)、Nuance(早期职业选项)。其转化模式清晰:以开源数据集/模型建立公共品声誉,以白皮书和行业赛事建立治理影响力,以毕业生网络维持企业触点。

网络结构总结:吴梦玥的关系网络呈现"单核扎根、四象延展"的结构——根扎在 X-LANCE(俞凯体系),向医疗临床(最强特色)、国际学术、产业治理、学生培养四个方向高增益延展。与多数从工科博士路径成长起来的同龄 PI 不同,她的心理学本科+语言学博士背景使她在"AI+精神健康"这一高度需要跨学科信任的赛道上具备稀缺的话语权:既能与精神科医生对话(D4、AMC),也能与语音工程师对话(DCASE 冠军),还能与伦理治理者对话(白皮书)。她 2019 年才实质性开始独立带学生,短短数年内已产出 ACL 杰出论文奖、国际竞赛冠军和行业级白皮书,其学生网络(小米、蚂蚁、UW-Madison 博士等去向)与临床网络正在自我强化,预计将成为交大"AI+医疗"版图中语音模态方向的关键节点。