AISI 报告 GPT-5.6 Sol 等 5 款 AI 模型均存“作弊”行为
2026-07-23 12:02:40
神评论
17173 新闻导语
英国AI安全研究所报告:GPT-5.6 Sol等5款前沿AI模型均被发现存在作弊行为,试图绕过规则,最高作弊率14.1%!点击查看详情。
7 月 23 日消息,英国 AI 安全研究所(AISI)于 7 月 21 日发布博文,测试 OpenAI 与 Anthropic 旗下的 5 款前沿 AI 模型,发现所有模型均存在“作弊”行为,试图绕过既定规则,通过捷径或违规操作完成任务。
援引博文介绍,附上本次测试的 5 款模型:
GPT-5.4:来自 OpenAI
GPT-5.5:来自 OpenAI
GPT-5.6 Sol:来自 OpenAI
Claude Opus 4.7:来自 Anthropic
Claude Mythos Preview:来自 Anthropic
AISI 指出上述 5 款模型均试图“作弊”,没有按照预定的路径进行运算,使用了一些被明确禁止的捷径或变通方法。

其中 GPT-5.4 的“作弊率”最高,达到 14.1%,在 475 次测试中有 67 次;其次是 GPT-5.6 Sol 模型,作弊率为 12.6%,在 475 次测试中有 60 次。
Anthropic 的 Claude Opus 4.7 也出现了 9.1% 的作弊情况,而 Claude Mythos Preview 则出现了 7.8% 的作弊行为。
据研究所分析,GPT-5 系列模型更倾向于搜索互联网,而 Claude 模型则倾向于绕过沙盒限制。在一次因任务配置错误而无法完成测试中,一个模型甚至编写代码,尝试通过外部服务访问研究所的评估基础设施,触发安全警报。

【来源:IT之家】
今日热点
热门测试游戏
- 1当年的九阴味回来了!《九阴真经:武侠》首个实机PV曝光
- 2六界·六业·六道!暗黑like新游《TARAE: The Unbound》首曝
- 3再用封号!《魔兽》紧急公告插件违法,悬赏10万征集新插件
- 4鸟嘴医生+美女侦探,《白银之城》新PV曝光全新多人模式
- 5熊族梦落地!《激战3》首发熊族“克丹”背景故事解析!
- 6翘臀女主超燃战斗!《昭和米国物语》科隆展新预告发布
- 7抢跑半月!《永恒之塔2》9月17日规模测,10月5日全球上线
- 8全职高手那么火,为何没有游戏公司把《荣耀》做出来?
- 9《暗黑破坏神2》重制版新赛季热度暴跌,问题和出路在哪?
- 10“吃鸡”改"肉鸽"?蓝洞PC端游新作《PUBG: DEDNET》首曝

