社科网首页|客户端|官方微博|报刊投稿|邮箱 中国社会科学网
LRCH2026语言资源与计算人文研讨会暨语言资源与计算人文专委会第四次全体会议在北京顺利召开
日期:2026-07-13

 2026年7月4日至5日,LRCH2026 语言资源与计算人文研讨会暨语言资源与计算人文专业委员会第四次全体会议,于中国社会科学院民族学与人类学研究所多功能报告厅隆重举办本次会议由中国民族语言学会主办,中国社会科学院民族学与人类学研究所、语言资源与计算人文专业委员会、民族语言文化行为实验研究室共同承办,南京师范大学语言大数据与计算人文研究中心协办。来自全国多所高校、科研机构、出版单位及企业的近40位专家学者齐聚一堂,围绕少数民族语言资源数字化建设、专委会学术共同体长效构建、语言智能与数字人文交叉创新落地路径三大核心议题展开深入研讨。

会议开幕式由中国社会科学院民族学与人类学研究所民族语言文化行为实验研究室主任龙从军研究员主持。会议系统回顾了专委会成立三年来的建设成果,持续搭建高质量学术交流平台,坚持每年举办学术年会,常态化开设免费公益暑期研修班与系列前沿学术讲座,持续吸纳青年教师、硕博研究生参与学术实践明确以资源筑基、以技术赋能的核心发展路线,推动传统语言资源研究与现代计算科学深度融合,主动适配人工智能时代人文社科全新研究范式变革。 

中国社会科学院民族学与人类学研究所丁赛书记线上发表开幕致辞。她强调,各民族语言文字资源是中华优秀传统文化不可或缺的核心载体,更是国家基础性文化战略资源。学界应当运用系统化、科学化手段完成多民族语言文献整理与活化利用,依托常态化学术会议联动全国分散研究力量,推动珍稀民族语言古籍、口述文献转化为可开放共享、可持续复用的标准化学术数字资源。 

  

中国社会科学院民族学与人类学研究所丁赛书记线上致辞 

  

中国民族语言学会黄成龙秘书长现场致辞。他指出,现阶段我国少数民族语言研究仍面临语言活态资源持续流失、自主语言学知识体系建设进度滞后、复合型专业研究人才缺口突出三大现实难题,呼吁打破文学、语言学、计算机科学等学科壁垒,多方协同共建国家级统一民族语言数字资源公共服务平台。 

  

中国民族语言学会黄成龙秘书长致辞 

参会领导共同提出,促进语言资源研究、计算科学与人工智能技术深度交叉融合,既是新时代国家语言文字事业高质量发展的内在需求,也是数字中国战略在人文社科领域的关键实践。期待专委会统筹整合跨学科、跨单位研究力量,产出高质量落地化学术成果,打造具有全国影响力的特色化学术品牌。 

  

中国社会科学院龙从军研究员主持开幕式 

开幕式后,全体参会代表集中观看中国社会科学院民族学与人类学研究所、民族语言文化行为实验室官方宣传片,全面了解研究所发展历程、科研队伍规模、标志性研究成果与中长期科研发展目标。 

特邀前沿报告:多领域交叉创新,科研成果亮点纷呈 

本次大会设置8场高水平特邀主旨报告,覆盖民族语言类型学、多语种智能技术落地、古籍数字化整理、语言技术评测体系搭建、数字人文计算方法等前沿研究赛道,集中展示语言资源与计算人文领域最新理论成果与工程实践进展。 

  

中国社会科学院民族学与人类学研究所江荻研究员作特邀报告 

中国社会科学院民族学与人类学研究所江荻研究员带来题为《从量化比较考察蒙古语族及其方言的分类和分区》的主旨报告。报告以蒙古语族及下属方言为研究对象,创新性引入量化对比分析与主坐标降维分析方法,提出全新三大方言分区框架,实证佐证 “中部方言” 独立分区的学术观点;同时结合历史族群迁徙、跨语言接触史实,解析西部方言内部复杂分化成因,为国内少数民族语言谱系划分研究提供全新量化研究范式。 

  

暨南大学范俊军教授作特邀报告 

暨南大学范俊军教授分享《推动语言学科领域的RAG技术规模化普及》。报告聚焦检索增强生成(RAG)技术,针对大模型应用普遍存在的语料安全隐患、文本生成幻觉等痛点,提出语料建库与智能分析分离的本地化落地方案,支持普通台式电脑离线完成全流程语料处理,搭配轻量化小型模型实现高精度古籍、民族文献智能检索,大幅降低中小科研团队使用门槛。 

  

中国科学院自动化研究所张恒研究员作特邀报告 

中国科学院自动化研究所张恒研究员作《多语种文本图像识别方法体系研究》主题报告。他分享文本图像识别领域前沿技术,详解端到端一体化检测识别、图文跨模态智能纠错等核心技术方案,专门搭建适配低资源少数民族语言的增量学习框架,有效缩减小语种AI模型训练数据需求与算力成本。 

  

字节跳动张佳怡作特邀报告 

字节跳动张佳怡带来《当古籍遇见AI,当文献整理遇见协同化平台》主题分享,创新性提出“识典古籍+飞书” 双引擎协同工作模式,有效解决古籍、民族文献规模化协同整理的效率瓶颈。目前识典古籍平台已上架近6万部古籍文献,月度服务用户突破240万人次,全链路AI自动化工具将文献整理综合效率提升5倍以上;依托飞书完善分级数据权限体系,完整覆盖原始语料存储、多人协同点校、成果归档等全流程场景。该模式现已落地应用于藏文《中华大藏经》数字化、蒙古文综合语言资源库等多个民族语言保护重点项目。 

  

科大讯飞有限责任公司邵鹏飞研究员作特邀报告 

  

科大讯飞邵鹏飞研究员带来《智能体时代语言研究全新范式思考》特邀报告。围绕通用智能体技术给传统语言学研究带来的颠覆性变革,从全流程研究链路、技术应用边界、科研人员角色转型三个维度展开深度剖析。他提出,智能体技术可打通语言研究完整工作流、降低技术工程落地门槛,为低资源少数民族语种研究提供全新突破口;但技术仍存在语义深度解读不足、异常文本判别失效、学术权责界定模糊等短板,必须警惕AI生成内容幻觉风险,坚守人工审核校验的核心底线,未来研究者将从技术工具操作者转变为整体科研流程设计者。 

  

中国电子技术标准化研究院陶扬研究员作特邀报告 

中国电子技术标准化研究院陶扬研究员汇报《汉字关系分层理论与汉语结构化数据库层位搭建》。针对当前中文语言资源数据质量参差不齐、字形编码标准不统一等行业痛点,系统阐释汉字关系分层完整理论,构建从底层原始图像 “流真层” 至顶层国家标准 “规范层” 的五级分层架构,通过异写字、异构字、代表字、通用规范字逐级归集映射,实现多场景下字形、语义统一对齐,为汉语历代语言资源标准化、结构化建设提供完整理论支撑与实施框架。 

  

南京师范大学李斌教授作特邀报告 

南京师范大学李斌教授详细介绍EvaHan古汉语全链路技术评测体系及配套国际评测赛事,梳理该体系五年间在古籍OCR文字识别、古文自动标点、古汉语词性标注、跨语种机器翻译等方向的迭代成果与实测数据。 

  

华中科技大学唐旭日教授作特邀报告 

华中科技大学唐旭日教授作《人文计算中的数学建模实践:以信息熵工具为例》特邀报告。他从工程落地视角规划数字人文长远发展路径,倡导传统语言研究向标准化 “语言工程” 转型,强调研究方案可量化、可复现的核心要求;以信息熵模型为案例,展示其在语义演变溯源、民族文化身份建构等人文课题中的落地应用,为数字人文工程化、标准化升级提供可行思路。 

专题研讨与工作坊:凝聚行业共识,谋划长效协同发展 

全部特邀报告结束后,大会进入分组专题研讨环节,全体参会专家围绕专委会数字资源共建共享、语言技术评测赛事规划、跨机构协同创新机制等关键议题充分交换意见、凝聚共识。 

7月 5日上午,大会开设民族语言资源数字化建设专项工作坊,由龙从军研究员主持。参会学者集中交流各民族语言语音、文本资源现有建设成果、现存短板与中长期建设规划,进一步明确民族语言数字化重点攻坚方向,敲定跨单位资源共建、成果共享长效协作机制。 

大会闭幕式:总结阶段成果,擘画未来发展蓝图 

7月5日上午,会议举办闭幕式,龙从军研究员作大会总结发言。他表示,本次研讨会全面复盘专委会成立三年以来的建设经验与阶段性成果,集中展示语言资源与计算人文领域前沿技术突破与创新研究成果,进一步凝聚跨学科、跨单位协同攻关的学术共识。他指出,少数民族语言资源数字化保护兼具深厚文化价值与鲜明时代意义,希望专委会全体成员以本次会议为全新起点,持续深化多方科研合作,深耕做实高质量学术成果,合力推动我国少数民族语言资源数字化转型,助力计算人文领域实现长期稳定高质量发展。 

本次 LRCH2026 研讨会搭建起全国语言资源与数字人文领域高水平学术交流平台,进一步夯实专委会学术共同体建设根基,为国内少数民族语言活态保护、语言学与人工智能交叉学科融合发展注入强劲新动能。 

大会代表合影

版权所有:中国社会科学院民族学与人类学研究所
网站技术支持:中国社会科学院民族学与人类学研究所网络信息中心
地址:北京市中关村南大街27号6号楼 邮编:100081