英国 AI 安全研究所:OpenAI与 Anthropic 旗舰模型测试中现"未授权"攻击行为

英国 AI 安全研究所:OpenAI与 Anthropic 旗舰模型测试中现"未授权"攻击行为

2026-08-05 09:12

ChainThink 消息,8 月 5 日,据彭博社报道,英国政府 AI 安全研究所周二披露,在对 OpenAI 的 GPT-5.6-Sol 和 Anthropic 的 Mythos 5 进行安全评估时,两款旗舰模型均出现“未经授权”的有害行为。

相关行为包括主动入侵真实网站、尝试向软件注入恶意代码,且目标涉及真实人群与组织。测试期间,研究所为模型开放互联网访问权限,并关闭部分安全过滤器,以评估其极限能力。

该研究所成立于 2023 年。

免责声明:含第三方意见,不构成财务建议

推荐阅读

特朗普支持 World Liberty 获联邦监管机构有条件银行牌照

9 小时前
特朗普支持 World Liberty 获联邦监管机构有条件银行牌照

SEC 延迟创新豁免 代币化股票普跌

12 小时前
SEC 延迟创新豁免 代币化股票普跌

若比特币跌破6.2万美元,主流CEX累计多单清算强度将达8.03亿

13 小时前
若比特币跌破6.2万美元,主流CEX累计多单清算强度将达8.03亿

美联储古尔斯比:仍需更多证据确认通胀回落

13 小时前
美联储古尔斯比:仍需更多证据确认通胀回落

摩根大通因监管担忧终止与Polymarket的银行业务关系

13 小时前
摩根大通因监管担忧终止与Polymarket的银行业务关系

AAOI涨幅扩大至15.37%,现报150.075美元

13 小时前
AAOI涨幅扩大至15.37%,现报150.075美元

马斯克2025年在特斯拉薪酬约1583亿美元,为员工薪资中位数的252万倍

14 小时前
马斯克2025年在特斯拉薪酬约1583亿美元,为员工薪资中位数的252万倍