# 【中国新闻网】 全国性语料创新生态联盟在北京启动集中发布系列重要成果 - 中国科学院

*Источник: 中国科学院*
*Дата: 2026-09-30*
*Язык: zh*

**Кратко:** 主要职责
办院方针
面向世界科技前沿，面向经济主战场，面向国家重大需求，面向人民生命健康，率先实现科学技术跨越发展，率先建成国家创新人才高地，率先建成国家高水平科技智库，率先建设国际一流科研机构，加快打造原始创新策源地，加快突破关键核心技术，努力抢占科技制高点。
科技奖励
科技期刊
科技专项
中国科学院学部
中国科学院院部
语音播报
语料创新生态联盟在北京启动。中新网记者 孙自法摄
语料创新生态联盟启动暨学术交流会在北京举行。中新网记者 孙自法摄
中国科学院牵头建设的国家级敖仓·科技语料库，继两个多月前在世界人工智能大会上发布后，9月29日迎来新进展——全国性语料创新生态联盟正式启动，并集中发布语料标准规范、敖仓·语料社区服务平台及国际化英文学术期刊《人工智能语料研究》（Data Express in AI Corpus）等系列重要成果。
打造语料生态协同平台
当天，由中国科学院文献情报中心发起、以“共建语料生态·共创智能未来”为主题的语料创新生态联盟启动暨学术交流会在北京举行。
中国科学院科技基础能力局局长卢方军致辞指出，科技语料连接原始科研资源与人工智能模型，是支撑模型训练、科学推理和知识发现的重要基础。建设高质量科技语料，已经成为发展科学智能、提升人工智能专业能力的重要基础性工作。
语料创新生态联盟发起人、中国工程院院士孙凝晖作题为《从数据到语料》主旨报告。他表示，该联盟要推动科技语料资源和加工能力的基础设施化，建设国家高质量科技语料资源的战略保障基地、国家智能就绪语料集成服务的协同枢纽。
在中国科学院文献情报中心党委书记李猛力看来，全球人工智能竞争正由单一技术和模型能力的比拼，向模型、算力、数据与应用生态协同发展的综合竞争深化。加快构建自主可控、开放协同、安全可信的语料创新生态，是夯实中国人工智能发展基础、支撑高水平科技自立自强的重要举措。
为此，该中心基于敖仓·科技语料库“底座”，发起全国性语料创新生态联盟，旨在以高标准、高质量科技语料建设为核心，打造跨机构、跨领域、跨产业链的语料生态协同平台，推动科技语料资源在更大范围内实现共建共享、协同开发和创新应用。
后续重点聚焦五大任务
依托中国科学院以及全国科研与产业体系优势，语料创新生态联盟首批50家共建单位覆盖国家实验室、科研院所与国家级科学数据与文献资源机构，地方政府以及人工智能、数据基础设施、出版与知识服务等领域骨干单位，语料运营企业以及人工智能领域知名投资机构，贯通科技语料资源供给、技术研发、平台建设、模型训练与行业应用全链条，推动资源供给、技术研发和行业应用等关键环节有效衔接。
语料创新生态联盟将以任务为牵引，探索“共建、共享、共赢”协同模式，联盟成员以资源、能力、专业、场景四类投入参与共建，将各自的资源、技术和应用需求汇聚为联盟公共能力，再通过开放共享和能力反哺，共享语料工具、平台服务、共建成果与发展机会，形成优势互补、协同创新、成果共享的良性生态。
中国科学院文献情报中心主任曲建升透露，下一步，语料创新生态联盟将重点聚焦以下五大任务：
一是联合共建高质量科技语料，持续打造具有示范意义的标杆语料资源。
二是推进智能就绪科技语料集成服务，探索建立开放、普惠的公共服务机制。
三是深化国家科技语料基础设施协同建设，推动基础设施、技术规范和服务能力协同演进。
四是强化标准、质量与可信治理，建立语料可信流通、安全使用和质量保障机制。
五是开展科学智能（AI for Science，AI4S）模型与应用场景联合验证，通过实际科研任务推动数据、模型和应用持续迭代，为新质生产力发展提供有力的数据支撑。
据悉，在语料创新生态联盟启动暨学术交流会上，围绕科技语料建设、工具平台、业务流程和运营管理等重点环节，集中发布的五类42项科技语料标准，按计划将率先依托联盟先行先用，并逐步将其上升为行业标准、国家标准。

主要职责
办院方针
面向世界科技前沿，面向经济主战场，面向国家重大需求，面向人民生命健康，率先实现科学技术跨越发展，率先建成国家创新人才高地，率先建成国家高水平科技智库，率先建设国际一流科研机构，加快打造原始创新策源地，加快突破关键核心技术，努力抢占科技制高点。
科技奖励
科技期刊
科技专项
中国科学院学部
中国科学院院部
语音播报
语料创新生态联盟在北京启动。中新网记者 孙自法摄
语料创新生态联盟启动暨学术交流会在北京举行。中新网记者 孙自法摄
中国科学院牵头建设的国家级敖仓·科技语料库，继两个多月前在世界人工智能大会上发布后，9月29日迎来新进展——全国性语料创新生态联盟正式启动，并集中发布语料标准规范、敖仓·语料社区服务平台及国际化英文学术期刊《人工智能语料研究》（Data Express in AI Corpus）等系列重要成果。
打造语料生态协同平台
当天，由中国科学院文献情报中心发起、以“共建语料生态·共创智能未来”为主题的语料创新生态联盟启动暨学术交流会在北京举行。
中国科学院科技基础能力局局长卢方军致辞指出，科技语料连接原始科研资源与人工智能模型，是支撑模型训练、科学推理和知识发现的重要基础。建设高质量科技语料，已经成为发展科学智能、提升人工智能专业能力的重要基础性工作。
语料创新生态联盟发起人、中国工程院院士孙凝晖作题为《从数据到语料》主旨报告。他表示，该联盟要推动科技语料资源和加工能力的基础设施化，建设国家高质量科技语料资源的战略保障基地、国家智能就绪语料集成服务的协同枢纽。
在中国科学院文献情报中心党委书记李猛力看来，全球人工智能竞争正由单一技术和模型能力的比拼，向模型、算力、数据与应用生态协同发展的综合竞争深化。加快构建自主可控、开放协同、安全可信的语料创新生态，是夯实中国人工智能发展基础、支撑高水平科技自立自强的重要举措。
为此，该中心基于敖仓·科技语料库“底座”，发起全国性语料创新生态联盟，旨在以高标准、高质量科技语料建设为核心，打造跨机构、跨领域、跨产业链的语料生态协同平台，推动科技语料资源在更大范围内实现共建共享、协同开发和创新应用。
后续重点聚焦五大任务
依托中国科学院以及全国科研与产业体系优势，语料创新生态联盟首批50家共建单位覆盖国家实验室、科研院所与国家级科学数据与文献资源机构，地方政府以及人工智能、数据基础设施、出版与知识服务等领域骨干单位，语料运营企业以及人工智能领域知名投资机构，贯通科技语料资源供给、技术研发、平台建设、模型训练与行业应用全链条，推动资源供给、技术研发和行业应用等关键环节有效衔接。
语料创新生态联盟将以任务为牵引，探索“共建、共享、共赢”协同模式，联盟成员以资源、能力、专业、场景四类投入参与共建，将各自的资源、技术和应用需求汇聚为联盟公共能力，再通过开放共享和能力反哺，共享语料工具、平台服务、共建成果与发展机会，形成优势互补、协同创新、成果共享的良性生态。
中国科学院文献情报中心主任曲建升透露，下一步，语料创新生态联盟将重点聚焦以下五大任务：
一是联合共建高质量科技语料，持续打造具有示范意义的标杆语料资源。
二是推进智能就绪科技语料集成服务，探索建立开放、普惠的公共服务机制。
三是深化国家科技语料基础设施协同建设，推动基础设施、技术规范和服务能力协同演进。
四是强化标准、质量与可信治理，建立语料可信流通、安全使用和质量保障机制。
五是开展科学智能（AI for Science，AI4S）模型与应用场景联合验证，通过实际科研任务推动数据、模型和应用持续迭代，为新质生产力发展提供有力的数据支撑。
据悉，在语料创新生态联盟启动暨学术交流会上，围绕科技语料建设、工具平台、业务流程和运营管理等重点环节，集中发布的五类42项科技语料标准，按计划将率先依托联盟先行先用，并逐步将其上升为行业标准、国家标准。

[Оригинал](https://www.cas.cn/cm/202609/t20260930_5121243.shtml)