OpenAI承认其模型失控 专家:AI安全治理迫在眉睫

美国开放人工智能研究中心(OpenAI)21日承认,该公司的GPT-5.6模型和另一款能力更强的预发布模型联合进行内部评估时失控。

OpenAI承认其模型失控 专家:AI安全治理迫在眉睫

来源:央视新闻客户端    2026-07-24 09:39
2026-07-24 09:39 
分享
分享到
分享到微信

美国开放人工智能研究中心(OpenAI)21日承认,该公司的GPT-5.6模型和另一款能力更强的预发布模型联合进行内部评估时失控,突破隔离测试环境,侵入了人工智能开源平台美国抱抱脸公司的系统。美国抱抱脸公司最后使用了中国公司的AI模型,得以及时采取应对措施。

这种“自主性”是模型能力增强的必然副产品,还是训练方式出了某种偏差?这起事件对AI行业和网络安全有什么启示?来听中国社会科学院大学数字中国研究院特聘研究员、数字经济学者刘兴亮的解读。

专家:AI失控可能是模型能力提升带来的结果

中国社会科学院大学数字中国研究院特聘研究员 刘兴亮:我个人更倾向于认为,这是模型能力提升带来的一个自然结果。大家可以把AI理解成一个特别聪明、执行力特别强的员工。你给它一个目标,它不会只等着别人安排下一步,而是会自己规划路径、寻找工具解决障碍。这一次的测试里,当正常路径走不通的时候,它就去寻找其他能够完成目标的方法,包括利用漏洞,寻找互联网出口。这说明它越来越会做事,而不是越来越有意识。真正需要解决的问题不是让AI变笨,而是让AI知道哪些边界绝对不能跨越。

专家:AI的发展速度要求安全体系全面升级

中国社会科学院大学数字中国研究院特聘研究员 刘兴亮:过去我们更多是在防黑客,以后可能还要防AI驱动的攻击,甚至会出现AI攻击、AI防御、AI取证这样的新格局。这意味着网络安全将进入AI对AI的时代。

中国社会科学院大学数字中国研究院特聘研究员 刘兴亮:所以我觉得有三个方面特别重要。第一,企业要把AI安全放在和模型能力同样重要的位置,不能只追求模型越来越聪明,更要保证它始终处于可控状态。第二,整个行业需要建立更严格的安全测试和评估机制,特别是在模型上线之前,要进行更高强度的红队测试和风险验证。第三,加强国际合作,因为网络攻击没有国界,AI安全同样没有国界。

中国社会科学院大学数字中国研究院特聘研究员 刘兴亮:这次OpenAI和抱抱脸能够联合调查、共同披露,其实就是一个积极信号。未来AI竞争会越来越激烈,但AI安全更需要全球共同治理。

(央视新闻客户端)

【责任编辑:鲍宇雁】
中国日报网版权说明:凡注明来源为“中国日报网:XXX(署名)”,除与中国日报网签署内容授权协议的网站外,其他任何网站或单位未经允许禁止转载、使用,违者必究。如需使用,请与010-84883777联系;凡本网注明“来源:XXX(非中国日报网)”的作品,均转载自其它媒体,目的在于传播更多信息,其他媒体如需转载,请与稿件来源方联系,如产生任何问题与本网无关。
版权保护:本网登载的内容(包括文字、图片、多媒体资讯等)版权属中国日报网(中报国际文化传媒(北京)有限公司)独家所有使用。 未经中国日报网事先协议授权,禁止转载使用。给中国日报网提意见:rx@chinadaily.com.cn