不被遗忘的声音:多民族语言与大模型的交汇之路
2026年08月02日(星期日) 08:00-12:15
论坛编号:CCF-Yo-26-024
地 点:西北民族大学文津楼802
主 办 方:中国计算机学会
组织机构:CCF YOCSEF兰州学术委员会
执行主席:索郎王青 CCF YOCSEF兰州 AC委员 西北民族大学
徐世鹏 CCF YOCSEF兰州 AC副主席 甘肃政法大学
面向对象:CCF会员、高校、科研机构以及相关政府、企业人员
论坛背景:在人工智能快速发展的背景下,大模型正在深刻改变人类获取、传播和创造知识的方式。然而,相较于主流语言,许多少数民族语言仍面临数字资源匮乏、数据规模有限、技术支撑不足等现实挑战,存在被边缘化甚至逐渐“失声”的风险。如何让多民族语言搭上大模型发展的快车,实现语言传承、文化保护与智能应用的协同发展,已成为学术界和产业界共同关注的重要课题。本论坛以“不被遗忘的声音:多民族语言与大模型的交汇之路”为主题,聚焦多民族语言大模型发展的关键技术问题与未来方向。通过汇聚学界、产业界和应用领域专家智慧,共同探索低资源语言智能化发展的可行路径,为构建安全可信、多元包容的多语言人工智能生态贡献新思路。
论坛议程:
时 间 | 内 容 |
08:00 - 08:30 | 签到及开场视频播放 |
08:30 - 08:35 | 论坛背景及嘉宾介绍 |
08:35 - 08:40 | 开场发言 |
第一阶段 引导发言 | |
08:40 - 08:55 | 引导发言1:冯岩松——大模型低资源语言能力增强技术 |
08:55 - 09:10 | 引导发言2:徐 童——面向复杂场景的多步链式推理 |
09:10 - 09:25 | 引导发言3:诺明花——蒙古文智能信息处理关键技术研究与应用 |
09:25 - 09:40 | 引导发言4:李亚超——多语言翻译大模型实践 |
第二阶段 思辨讨论 | |
09:40 – 10:25 | 思辨1:构建多民族语言大模型面临的主要技术挑战有哪些? |
10:25 – 10:40 | 茶歇、合影 |
10:40 - 11:25 | 思辨2:多民族语言大模型应该是通用大模型“微调”还是从头“预训练”? |
11:25 - 12:10 | 思辨3:多民族语言大模型的全流程评测、规模化部署与可持续演进路径是什么? |
12:10 - 12:15 | 论坛总结 |
引导嘉宾:
| 冯岩松,北京大学王选计算机研究所副教授。主要研究方向包括自然语言处理、法律与人工智能。担任国际计算语言学学会ACL Rolling Review 高级执行编委、自然语言处理领域重要期刊Computational Linguistics执行编委,法律人工智能领域期刊Artificial Intelligence and Law编委,中国计算机学会自然语言处理专委会副秘书长,中国中文信息学会语言与知识计算专委会委员,多次担任自然语言处理、人工智能领域重要国际会议 ACL、EMNLP、NAACL、EACL、IJCAI、AAAI等的(高级)领域主席。 | |
徐童,中国科学技术大学教授、博士生导师,中国中文信息学会青年工作委员会第六届执委会主任,国家优秀青年科学基金获得者。研究领域为多模态知识发现与人机交互。发表中国计算机学会推荐A类期刊/会议论文100余篇。获安徽省科技进步一、二等奖、安徽省教育成果特等奖及6项国际学术会议论文奖项,指导学生获国内外学术测评冠军10余项。 | |
| 诺明花,内蒙古大学教授,内蒙古自治区“英才兴蒙”人才。主要从事自然语言处理与智能信息处理研究,重点关注多模态语义表示学习、知识智能与信息抽取等方向。主持国家自然科学基金项目3项(含青年基金、地区基金),内蒙古自治区自然科学基金等省部级项目3项,参与国家级、省部级及校级科研项目10余项。获得内蒙古自治区科技进步一等奖。在ACL、COLING、NLPCC、《中文信息学报》、Data Intelligence 等国内外学术期刊和学术会议发表论文30余篇。以第一完成人获批软件著作权10余项,授权发明专利3项。 | |
| 李亚超,男,博士,西北民族大学中国民族信息技术研究院、人工智能学院教授。长期从事自然语言处理、人工智能方面的教学和科研工作,研究兴趣包括大语言模型、多模态大模型,机器翻译及多语种信息处理等。2022年毕业于苏州大学计算机科学与技术学院,获工学博士学位。入选2024年西北民族大学“兰山人才工程”、2025年国家民委“青年拔尖人才”和“甘肃省陇原青年英才”项目支持。现任CCF自然语言处理专委会委员、中国中文信息学会机器翻译与多语言信息处理专委会委员、大模型与智能生成专委会委员、民族语言信息处理专委会委员等。近年来主持国家自然科学基金项目、甘肃省科技计划项目,以及重要科研单位的委托项目。在COLING、TASLP、KBS等顶级会议和期刊发表高水平论文多篇,科研教学成果获得国家民委优秀信息一等奖2项,特等奖1项,在2025年全国机器翻译评测中获得藏汉翻译、蒙汉翻译和维汉翻译三项第一名。 |
思辨嘉宾:
冯骁骋,哈尔滨工业大学人工智能学院副院长、教授、博导,国家级青年人才。研究兴趣包括自然语言处理、大语言模型。在 ACL、AAAI 等 CCF A 类国际会议及期刊发表论文 70 余篇。兼任鹏城实验室双聘学者、中国中文信息学会青工委副主任等。主持国家自然科学青年基金 B 类、科技创新 2030—新一代人工智能重大项目子课题。入选中国科协第六届青年人才托举工程,曾获教育部科技创新一等奖、吴文俊人工智能一等奖、黑龙江省科技进步一等奖等。 | |
李冠宇,男,汉族。西北民族大学人工智能学院、中国民族信息技术研究院,教授,博士研究生导师。中国计算机学会(CCF)语音对话与听觉专业委员会执行委员,中国科学院自动化研究所、香港中文大学访问学者。长期从事语音识别、说话人识别及语音合成研究。 | |
艾孜尔古丽·玉素甫,工学博士,副教授,硕士生导师,中文信息委会民族语言文字信息专业委员会副秘书长,青工委委员。在低资源资源库构建、情感分析研究、网络舆情监测等自然语言处理相关领域具有丰富的研究经验和技术成果。在国际、国内报刊上公开发表学术论文60余篇,其中国内外核心期刊30余篇;获得软件著作权20余项;主持完成了国家自然科学基金项目,自治区自然科学面上基金,教育部人文社会科学青年项目等20余项。 | |
| 艾金勇,男,副研究馆员,主要研究方向为智能数据分析与藏文信息处理。近年来,围绕数据智能化采集、藏文文本处理、藏文文献智能分析及推荐等领域,结合研究现状与主流方向,系统开展了藏文网页文本挖掘、藏文文献关联分析与知识发现等研究工作;在此基础上,主持并完成自治区级项目2项、校内项目1项,主持在研国家档案局科技项目1项及校内项目1项,同时参与国家社科基金等省部级项目20余项。迄今已发表专业论文30余篇,其中核心期刊论文6篇;曾获西藏民族大学优秀共产党员、先进工作者、优秀党务工作者,西藏自治区优秀馆员,以及陕西省高等学校档案工作先进工作者等荣誉称号。 |











