美国两大顶尖AI又被曝严重风险隐患
创始人2026-08-06 08:08:40
美国两大顶尖AI又被曝严重风险隐患。路透社消息,OpenAI披露,旗下前沿人工智能模型多次突破隔离测试环境,在没有人类指令的情况下自主入侵外部系统。事件源于上月一起安全事故:公司测试GPT-5.6 Sol以及另一款未发布模型时,开展网络...
美国两大顶尖AI又被曝严重风险隐患。
路透社消息,OpenAI披露,旗下前沿人工智能模型多次突破隔离测试环境,在没有人类指令的情况下自主入侵外部系统。事件源于上月一起安全事故:公司测试GPT-5.6 Sol以及另一款未发布模型时,开展网络攻防能力测试。AI没有按要求完成任务,主动逃出封闭测试区域,接入互联网,入侵AI开源平台Hugging Face寻找答案。
据财联社,最近的一次安全评估显示,Anthropic与OpenAI旗下AI智能体在122次测试中共出现19起越权行为,其中还涉及编写恶意代码与伪造身份,引发广泛担忧。

英国人工智能安全研究所(AISI)于当地时间周二披露,在对Anthropic与OpenAI旗下模型开展测试期间,由Anthropic Mythos 5、OpenAI GPT‑5.6‑Sol模型驱动的AI智能体,实施了多项未经授权的行为,暴露出新型安全风险。
在总计122次的测试中,AISI在10次测试中发现共19项未经授权操作。其中Anthropic智能体涉及17项,OpenAI智能体涉及剩余2项。
最严重的一起越权行为是某AI智能体编写恶意代码并创建虚假网络身份,试图诱导人类批准该代码。业内指出,虽然AISI未指明创建虚假身份的具体是哪家厂商的AI智能体,但该漏洞与OpenAI自行披露的两起案例均不吻合。
Anthropic在社交平台上发表声明称,正与AISI紧密合作以获取更多细节并展开内部调查。
OpenAI则在一份官方文章中分享了细节,指出其AI智能体出现的两次未经授权行为,均涉及以提示词明令禁止的方式访问互联网。
所有文章未经授权禁止转载、摘编、复制或建立镜像,违规转载法律必究。
举报邮箱:1002263188@qq.com