LRCH2026语言资源与计算人文研讨会暨语言资源与计算人文专委会第四次全体会议顺利召开
2026-07-07 00:00 江苏
![]()
LRCH2026会议召开,交流民族语言资源与计算人文前沿并研讨发展规划。
![]()
2026年7月4日至5日,语言资源与计算人文研讨会(LRCH2026)暨语言资源与计算人文专委会第四次全体会议在中国社会科学院民族学与人类学研究所多功能厅召开。本次会议由中国民族语言学会主办,中国社会科学院民族学与人类学研究所、语言资源与计算人文专业委员会、民族语言文化行为实验研究室共同承办,南京师范大学语言大数据与计算人文研究中心协办。来自全国多所高校、科研机构、出版单位及企业的近40位专家学者齐聚一堂,围绕民族语言资源建设与发展规划、专委会学术共同体构建、语言智能与人文计算交叉创新等核心议题展开深入研讨。
开幕式
复盘成果,深耕民族语言智能研究
会议开幕式由中国社会科学院民族学与人类学研究所民族语言文化行为实验研究室主任龙从军研究员主持。会议系统回顾了专委会成立三年来的建设成果,持续搭建高质量学术交流平台,坚持每年举办学术年会,连续开设免费暑期培训班与系列学术讲座,吸引大批青年教师、硕博研究生积极参与;确立资源夯实基础,技术驱动创新的发展方向,推动语言资源建设与计算科学深度融合,主动拥抱人工智能时代的研究范式变革。
![]()
中国社会科学院龙从军研究员主持开幕式
致辞环节
直面挑战,共建民族语言数字资源平台
中国社会科学院民族学与人类学研究所丁赛书记强调,各民族语言资源是中华优秀传统文化的重要载体,是国家文化资源的核心组成部分,需以系统科学的方式整理利用多民族语言资源,通过会议机制连接分散研究力量,推动珍贵文献转化为可共享的学术资源。
![]()
中国社会科学院民族学与人类学研究所丁赛书记线上致辞
中国民族语言学会黄成龙秘书长指出,当前民族语言研究仍面临资源流失、自主知识体系建设滞后、专业人才缺口等挑战,呼吁学界打破学科壁垒,合力打造国家级民族语言资源公共平台。
![]()
中国民族语言学会黄成龙秘书长致辞
与会领导表示,推动语言资源与计算科学、人工智能交叉融合,既是新时代语言文字事业发展的内在要求,也是数字中国建设在人文社科领域的重要实践,希望专委会整合跨学科力量,做实学术成果,打造学术品牌。
随后参会代表观看了民族所的宣传片与民族语言文化行为实验室的宣传片,让与会代表了解了民族所的建设历程、人数规模、研究成果及目标等。
特邀报告
聚焦前沿交叉多领域研究亮点纷呈
本次会议共设8场特邀报告,覆盖民族语言类型学、智能技术应用、古籍数字化整理、评测体系建设、人文计算方法等多个前沿方向,集中呈现了语言资源与计算人文领域的最新研究进展。
中国社会科学院民族学与人类学研究所江荻研究员进行了题为《从量化比较考察蒙古语族及其方言的分类和分区》的主旨报告,以蒙古语族及其方言为研究对象,引入量化比较方法与主坐标分析降维思路,提出三大方言分区新方案,验证了“中部方言”的存在,并结合历史迁徙与语言接触现象解释西部方言内部复杂性,为民族语言谱系研究提供全新量化视角。
![]()
中国社会科学院民族学与人类学研究所江荻研究员
作特邀报告
暨南大学范俊军教授汇报了《推动语言学科领域的RAG普及》,聚焦检索增强生成(RAG)技术,针对大模型应用中的语料安全、结果幻觉等痛点,提出建库与分析分离的本地化解决方案,支持普通个人电脑离线处理语料,结合轻量级模型实现精准文献检索。
![]()
暨南大学范俊军教授作特邀报告
中国科学院自动化研究所张恒研究员汇报了《文本图像识别方法研究》,分享文本图像识别前沿技术,介绍端到端检测识别一体化、视觉-文本跨模态纠错等方案,并提出适配少数民族语言的增量学习框架,大幅降低小语种模型训练成本。
![]()
中国科学院自动化研究所张恒研究员作特邀报告
字节跳动张佳怡作《当古籍遇见AI,当整理遇见协同》主题分享,提出“识典古籍+飞书”双引擎模式,破解规模化协作瓶颈。目前识典古籍平台已上线近6万部古籍,月服务用户超240万人,全链路自动化使整理效率提升5倍以上。飞书依托统一数据权限体系,覆盖语料管理、协同点校等场景。该模式已延伸至藏文《中华大藏经》、蒙古文资源库等民族语言保护场景。
![]()
字节跳动张佳怡作特邀报告
邵鹏飞研究员作题为《智能体时代的语言研究新范式思考》的特邀报告。他围绕智能体技术对语言研究带来的变革,从研究流程、技术边界及研究者角色三个维度深入阐释。他提出,智能体技术可串联研究全流程、降低工程化门槛,为低资源语种研究带来新突破,但在语义解释、异常判断及学术责任上仍存在局限,需警惕幻觉风险,坚持人工校验的核心作用,研究者角色也将从工具执行者转向研究流程的设计者。
![]()
科大讯飞有限责任公司邵鹏飞研究员作特邀报告
陶扬研究员汇报了《汉字关系分层与汉语数据库的层位》。针对中文数据资源质量参差不齐、编码混乱的问题,他系统阐释了汉字关系分层理论,确立了从底层“流真层”(原始图像)到顶层“规范层”(通用规范字)的五层分级架构,通过异写字-异构字-代表字-规范字的逐级归集,实现不同场景下的字形与语义对齐,为汉语历史语言资源的结构化建设提供了完整理论框架。
![]()
中国电子技术标准化研究院陶扬研究员作特邀报告
南京师范大学李斌教授介绍了EvaHan古汉语技术评测体系和系列国际评测,以及五年来在古籍OCR识别、自动标点、词性标注、机器翻译等领域的最新进展。
![]()
南京师范大学李斌教授作特邀报告
唐旭日教授作题为《人文计算中的数学建模:以信息熵为例》的特邀报告。他从工程化视角提出数字人文的发展路径,主张将语言研究向“语言工程”转型,强调研究方案的确定性与可重复验证性,通过数学模型量化抽象的人文概念。他结合信息熵在语义演变、国家身份构建等研究中的应用案例,展示了量化方法在人文研究中的应用价值,为数字人文的工程化升级提供了新思路。
![]()
华中科技大学唐旭日教授作特邀报告
专题研讨与工作坊
凝聚共识,共话长效发展
特邀报告结束后,会议进入专题研讨环节,全体参会学者围绕专委会数据资源建设、评测赛事规划、协作模式创新等核心议题展开充分讨论。
7月5日上午,会议设置民族语言资源建设工作坊,由龙从军研究员主持。参会学者聚焦各民族语言语音资源的建设成果、现存问题与未来规划展开深度交流,进一步梳理了民族语言资源数字化建设的重点方向与跨机构协作机制。
![]()
民族语言资源建设工作坊
闭幕式
总结成果,展望未来
7月5日上午,会议举行闭幕式。龙从军研究员作总结发言,他表示,本次会议既系统复盘了专委会三年建设的经验与成果,也集中呈现了语言资源与计算人文领域的前沿技术与研究突破,进一步凝聚了跨学科、跨机构的研究共识。他指出,民族语言资源建设是兼具文化价值与时代意义的事业,希望专委会全体成员以本次会议为起点,持续深化合作,做实学术成果,共同推动我国民族语言资源数字化转型与计算人文领域的长效发展。
本次研讨会为全国语言资源与计算人文领域的学者搭建了高水平交流平台,进一步夯实了专委会的学术共同体建设,为推动我国民族语言资源保护、数字人文学科交叉融合注入了新的动力。
![]()
大会代表合影
![]()
比特人文
投稿邮箱:dhbase@126.com
扫码关注 获取更多资讯
![]()
