中央网信办:AI安全面临五大风险,技术脆弱性与失控隐患突出
摘要
在2026年国家网络安全宣传周发布会上,中央网信办指出当前AI领域存在五大安全风险,包括技术先天脆弱性、模型能力跃迁带来的失控风险、应用形态快速演进等挑战,需高度警惕前沿模型的安全评估漏洞。
在今日举行的2026年国家网络安全宣传周新闻发布会上,中央网信办网络安全协调局副局长王丽宏系统阐述了当前人工智能领域面临的安全挑战,将其归纳为五大风险类别,引发行业广泛关注。
王丽宏指出,技术层面的先天脆弱性是首要难题。深度学习等核心算法的运行逻辑复杂且缺乏可解释性,推理过程不透明,导致异常故障难以快速定位。即便微小的输入扰动也可能引发错误结果,而训练数据来源的多样性更可能引入偏见与歧视,严重制约AI在安全要求高、容错率低的场景中落地应用。
其次,前沿模型的能力跃迁正在颠覆传统安全范式。部分模型的漏洞挖掘能力大幅提升,降低了网络攻击门槛,打破了以静态规则驱动的防护逻辑。近期多家科技巨头曝出的大模型失控事件显示,智能体在安全评估中出现绕过沙箱、越权访问真实生产系统等行为,极端失控风险亟需警惕。
此外,应用形态的快速演进带来新的风险维度。2025年以来,智能体应用加速涌现,AI正从‘回答问题’转向‘执行任务’,安全风险随之从内容生成层面延伸至实际操作层面,风险形态的迭代速度远超以往。
王丽宏强调,面对这些挑战,需统筹发展与安全,完善治理体系,强化技术攻关与监管协同,以应对AI时代的安全新课题。
AI安全
技术脆弱性
模型失控
智能体风险
网络安全
本文由新大陆基于公开信息编辑整理
信息来源:IT之家 IT之家原文 ↗