9月15日-17日在昆明举办的网络安全周期间,国家互联网应急中心发布5项人工智能安全重要成果。15日下午的网络安全周高峰论坛上,《人工智能安全治理框架》2.0版和2025年人工智能技术赋能网络安全应用测试结果发布;16日上午的网络安全协同防御分论坛上,人工智能大模型产品漏洞众测结果发布;17日上午的人工智能安全治理分论坛上,中文互联网基础语料3.0和生成式人工智能安全测评基准数据集1.0发布。5项成果的发布,将推动行业进一步强化人工智能安全风险防范应对,促进人工智能创新发展,加快构建安全、可靠、可控的发展生态。成果1:《人工智能安全治理框架》2.0版,进一步推动人工智能安全治理共识《框架》2.0版在2024年发布的《框架》1.0版基础上,结合人工智能技术发展和应用实践,持续跟踪风险变化,完善优化风险分类,研究探索风险分级,动态调整更新防范治理措施。《框架》2.0版的发布,是顺应全球人工智能发展潮流,统筹技术创新与治理的又一重要实践,有助于推动在人工智能安全、伦理、治理等方面不断深化共识,促进形成安全、可信、可控的人工智能发展生态,构建跨国界、跨领域、跨行业的协同治理格局。成果2:2025年人工智能技术赋能网络安全应用测试结果,推动“人工智能+”在网安领域落地生根2025年人工智能技术赋能网络安全应用测试活动由中央网信办网络安全协调局等10个部门指导,由国家互联网应急中心联合4家单位共同主办,来自国内网络安全、信息通信、人工智能、金融等领域的企业、高校、科研院所等169家单位的224个团队参与,围绕7个场景开展测试。本次测试活动的举办和结果的发布,有效挖掘了高应用价值网络安全业务场景、遴选了优秀的人工智能技术产品,有力推动了人工智能技术在网络安全领域的赋能应用、提高重要行业领域网络安全防护水平、促进网络安全产业技术能力提升。成果3:中文互联网基础语料3.0,丰富大模型高质量中文语料供给中文互联网基础语料3.0是由国家互联网应急中心会同相关单位,依托网安协会人工智能安全治理专委会建立的语料共建共享机制构建。在前期发布的语料1.0和2.0的基础上,持续发挥企业、高校和科研单位协同优势,汇聚一批新的高质量可信数据,经过信源筛选、内容过滤、数据去重等系列严格细致的数据加工处理措施,形成语料3.0,数据量120GB,在中国网络空间安全协会“中文互联网语料资源平台” (https://www.cybersac.cn/newhome)发布。中文互联网基础语料3.0是各界协同共建高质量中文语料的又一重要成果,进一步丰富了高质量中文语料的供给,为人工智能技术创新和产业发展提供有力支撑和保障。成果4:生成式人工智能安全测评基准数据集1.0,支撑科学规范开展安全测评面向生成式人工智能应用场景多元化、风险演变复杂化等发展态势,国家互联网应急中心构建了生成式人工智能安全测评基准数据集1.0,在中国网络空间安全协会“中文互联网语料资源平台” (https://www.cybersac.cn/newhome)上线。数据集1.0包含3000个测试题,具有风险知识精细化、应用场景多元化、测试方法丰富三方面特点。覆盖5大类31小类风险,并细化成三级200余个子类,保障安全测评有效覆盖主要风险点;覆盖10个主流云端和移动端应用场景,多方位评估安全风险;模拟10种潜在的恶用滥用方式,多手段挖掘隐蔽安全风险。该数据集的发布有助于为生成式人工智能安全测评提供基准和指引,有效适应生成式人工智能应用场景的扩展,促进多领域可信应用。成果5:2025年人工智能大模型产品漏洞众测结果,推动构建更加安全可信的人工智能应用生态2025年人工智能大模型产品漏洞众测活动由中央网信办网络安全协调局指导,国家互联网应急中心主办,网络安全众测平台、国家网络安全人才与创新基地提供技术和环境支持。共动员559名白帽子,对国内15款大模型及应用产品进行了漏洞测试。本次众测活动深入挖掘了国内AI大模型产品中存在的漏洞风险,提升了系统开发者和运营者的安全意识,为AI漏洞治理提供了数据支撑和经验参考,有力推动了人工智能共治生态构建、促进“人工智能+”行业应用安全防护水平提升。在中央网信办指导下,国家互联网应急中心坚持发展和安全并重原则,持续跟踪人工智能发展演进,深入剖析风险挑战,积极构建安全保障和创新发展手段,推动人工智能健康有序发展。