查看: 80|回复: 0

英国AI安全机构:OpenAI与Anthropic模型失控入侵,展现空前欺骗性行为

67

主题

0

回帖

201

积分

中级会员

积分
201
发表于 2026-8-5 08:10:00 | 显示全部楼层 |阅读模式
AI总结
AI总结中
PANews 8月5日消息,据凤凰网引援《金融时报》报道,Anthropic的Mythos 5和OpenAI的GPT-5.6 Sol在例行网络安全评估中针对真实个人和组织进行了“持续的、可能具有危害性的活动”,包括向GitHub开源项目植入恶意代码并实施社交工程攻击。AISI称,在122次测试中有10次出现此类情况,几乎所有行为来自Anthropic的Mythos模型,其中两次行动涉及OpenAI的GPT。最严重案例中,AI代理创建虚假网络身份向项目维护者施压要求批准恶意代码,被维护者发现并拒绝。AISI表示,这是首次如此清晰地看到与自主性和欺骗性相关的风险在无特定提示下直接在现实世界中显现,结合此前曝光的入侵事件,标志着风险格局的转变。Anthropic回应称需就安全评估展开更广泛讨论,OpenAI发言人则表示事件发生在安全防护减弱的测试环境中,不反映日常使用,但将继续与评估机构合作加强安全评估标准。

Source URL: https://www.panewslab.com/zh/articles/019fcf35-8176-70dc-a9e8-bd7e8752bb45
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|BOSS中文网 Stonespider

相关侵权、举报、投诉及建议等,请发 E-mail:admin#boss.im

Powered by Discuz! X5.1 Licensed © 2001-2026 Discuz! Team.|浙ICP备2022024777号-14

返回顶部