标签

生成式人工智能背景下的语料库语言学研讨会圆满召开

发布时间:2026-08-11 19:02阅读:3

承袭语料库学术脉络,回应智能化时代议题

生成式人工智能背景下的语料库语言学研讨会圆满召开

2026年8月9日至11日,生成式人工智能时代的语料库语言学研讨会(Symposium on Corpus Linguistics in the Age of Generative AI)顺利举行。本届会议由中国英汉语比较研究会语料库语言学专业委员会与北京外国语大学中国外语与教育研究中心联合主办,外语教学与研究出版社承办,《语料库语言学》杂志协办。来自海内外的190余位专家学者齐聚北京,以"生成式人工智能时代的语料库语言学"为核心议题,共同探讨大语言模型高速演进背景下语料库语言学的前沿理论走向与实践应用问题。8月9日晚,中国英汉语比较研究会语料库语言学专业委员会召开了理事会会议。

开幕致辞溯源学术传统,直面智能时代课题

8月10日上午,研讨会开幕式在北京外国语大学国际会议中心第一多功能厅隆重举行。开幕式由北京外国语大学许家金教授主持。

中国英汉语比较研究会语料库语言学专业委员会创会主任委员卫乃兴教授、名誉主任委员梁茂成教授作为特邀嘉宾先后致辞。

卫乃兴教授在致辞中回顾了中国语料库语言学的发展脉络,提到以杨惠中教授为代表的中国第一代语料库学人留下了宝贵的学术风范与精神财富,并从三个层面与参会学者共勉:一是求真务实的学术准则。早年JDEST语料库建设服务于国家新一代大学英语教学大纲研制,体现出面向真实问题的研究取向;二是迎难而进的攻坚意志。在当时技术条件有限的情况下,学界依然建成了具有国际影响力的语料库资源;三是百折不回的坚定毅力。卫教授回忆,1993年国内语料库语言学研讨会参会者不足15人,语料库研究曾长期处于边缘位置。正因如此,他勉励学者们在认定有价值的研究方向后,不盲从、不跟风、不炒作、不迎合,不做昙花一现的研究,而要沉心静气,坚持长期主义。

梁茂成教授在致辞中指出,语料库语言学的立身之基在于语言文本的真实性。在生成式人工智能大量产出文本的当下,研究者从网络等渠道获取的语料中,哪些真正源自人类交际,哪些可能已受到机器生成文本的沾染,已成为语料库语言学研究必须正视的重要议题。梁教授最后感谢会务团队的辛勤付出,并预祝会议圆满顺利。

开幕式后,大会进入主旨报告环节,围绕生成式人工智能与语料库语言学的交叉融合展开集中研讨。

主旨发言回应智能浪潮,前沿探索引领方向

8月10日上午的主旨发言分别由北京航空航天大学董敏教授、华中科技大学潘璠教授、河南师范大学娄宝翠教授和上海交通大学甄凤超教授主持。

北京航空航天大学卫乃兴教授梳理了人工智能与语料库语言学在研究理念、技术路径和方法论上的关联与分野。卫教授指出,当前语料库语言学研究仍应立足大规模的真实语言数据,并从最小化先验假设、强化跨领域验证等角度,探索人工智能辅助语料库驱动语言学的新路径。交流环节中,许家金教授围绕语言使用与语言系统的关系及自下而上的理论抽象等问题与卫教授展开讨论。

北京航空航天大学梁茂成教授指出任务与人设的契合程度是影响提示词质量的关键因素之一,并展示了团队研发的PromptMaster工具。该工具可根据任务所需知识结构自动推导人设,生成候选提示词,为提示词设计与优化提供支撑。与会学者围绕人设与大模型自身生成风格的关系向梁教授提问,并就翻译任务中提示词对译文风格的影响展开讨论。

大连外国语大学邓耀臣教授指出大语言模型具备出色的上下文语义捕获能力,在术语自动抽取任务中具有性能优势。报告系统考察了模型架构、参数规模和提示词设计对抽取效率的影响,并讨论了不同模型的领域适应性及幻觉问题的应对策略。交流环节中,与会学者围绕大语言模型快速迭代背景下术语自动抽取的时效性展开讨论。

上海外国语大学雷蕾教授探讨了人工智能对当下语料库语言学研究的重塑作用,指出人工智能可为研究全过程提供支持,但研究者的语言直觉与专业素养仍不可替代。随后,雷教授围绕复杂度权衡假设,以跨越2000年的汉语书面语词汇与句法变化为例,展示了相关研究成果。交流环节中,北京语言大学饶高琦副研究员就口语与书面语等不同媒介中的复杂度权衡差异与雷教授展开讨论。

8月11日上午的主旨发言分别由北京师范大学王德亮教授、浙江大学李文超教授、广东外语外贸大学胡春雨教授和扬州大学陆军教授主持。

国防科技大学原伟教授从多语种文体计量、大模型语用识别和网络失序信息标注等研究切入,探讨如何科学、合理、稳定地使用大语言模型解决具体研究问题,并提出应将大语言模型生成过程转化为可复现、可检验的标准化标注流程。交流环节中,与会代表围绕语料库建库代表性及其对虚假新闻研究结论的影响与原教授展开讨论。

上海外国语大学苏杭教授从局部语法路径出发,评估大语言模型的言语行为能力。报告以道歉言语行为为例,探讨大模型生成的道歉在多大程度上接近人类道歉,并推动相关研究从"能否实施"进一步走向"如何实施、是否得体实施"的机制层面。交流环节中,李文超教授就如何借助局部语法路径引导大语言模型输出更符合人类交际习惯的言语行为与苏教授展开讨论。

北京语言大学饶高琦副研究员关注数智时代语言生活的新变化,提出大语言模型在语言生活中兼具资源、主体和媒介三重角色,提示语料库研究者关注人机共生语境下不断涌现的新语言现象。交流环节中,许家金教授就如何理解语言生活的真实性与饶副研究员展开讨论。

北京外国语大学刘鼎甲副教授以药品包装正面为对象,介绍了大语言模型辅助下跨模态图文意义建构的量化研究。研究构建了涵盖中国、美国、欧洲和日本四个市场、四类非处方药的多模态语料库,分析图像与文字的协同构义。交流环节中,陆军教授和饶高琦副研究员分别就颜色意义及市场监管要求对包装图文配置的影响展开讨论。

分论坛展开多元讨论,会场内外共研新知

除主旨发言外,本次研讨会于8月10日下午设置十个分论坛,共安排124场分组发言。各分论坛既关注生成式人工智能在语料建设、标注、检索和分析流程中的应用,也回应语言教学、翻译研究、学术语篇、智能传播与数字人文等具体研究场景。各分论坛均有专家学者主持并点评,与会代表们讨论热烈,交流充分。

分论坛结束后,学术交流延续至会场之外。在酒店大堂,参会教师和学生围绕当天主旨发言与分论坛报告继续展开讨论,主旨发言及语料库语言学专业委员会多位专家也参与其中,就研究问题、方法路径和学科发展等话题深入交流,现场气氛热烈。

闭幕总结凝聚共识,学术交流持续拓展

研讨会闭幕式由北京外国语大学黄鼎博士主持,中国英汉语比较研究会语料库语言学专业委员会总干事刘国兵教授作大会总结发言。刘教授在总结中梳理了本次研讨会的核心议题与主要成果,肯定了本次研讨会在推动生成式人工智能与语料库语言学融合发展方面的积极作用。刘国兵教授特别指出,本次会议坚持学术本位,直奔主题,会议组织守时高效。本次会议为学界搭建了高水平、专业性的交流平台,使个体思考得以汇入集体对话,也为优化学术会议组织形式提供了实践思路。最后,刘国兵教授对会议组织者、全体专家、所有与会代表和志愿者表示诚挚感谢。

本次研讨会以"生成式人工智能时代"为共同语境,为语料库语言学研究者搭建了专题鲜明、议程紧凑的交流平台。会议围绕人工智能赋能语言研究的边界、方法与规范进行了集中交流,进一步推动语料库语言学在数据基础、理论问题和应用场景之间形成更紧密的互动,也为后续相关研究提供了可继续深化的议题和路径。与会代表纷纷表示,此次会议不仅促进了学术交流,更为未来研究指明了方向,期待我国语料库语言学研究不断取得更大成就。