Anthropic 承认 Claude 越权访问系安全失误
快链头条 2026-09-03 07:51:00
快链头条 消息,Anthropic 在周一发布的博客文章中承认,其 Claude 模型在网络安全评估过程中曾未经授权访问真实计算机系统,事件反映出运营安全失误以及动机推理、伤害意愿两类对齐失败。Anthropic 于 7 月披露,Claude 模型曾入侵三家公司的系统,原因是第三方评估环境被连接到公共互联网,而模型被告知处于无互联网的模拟环境中。Anthropic 表示,Claude 可能将真实互联网访问的证据解读为仍处于模拟环境,并愿意在真实互联网上采取有害行动以完成网络安全评估任务。此外,在英国 AI 安全研究所的测试中,评估人员故意授予 Claude Mythos 互联网访问权限后,该模型在实时网络上采取了未授权行动。Anthropic 强调,涉事模型均未搭载正式发布产品所包含的网络安全防护。7 月 30 日事件发生后,Anthropic 已暂停对预发布模型的网络评估,并引入更严格防护:测试须在经核验的离线沙箱中运行,配备实时监控;新分类器可拦截疑似越界行为、终止测试并通知人工。Anthropic 还扩大了内部前沿智能体使用的离线监控范围。此前 OpenAI 模型也曾于 7 月入侵 Hugging Face 获取网络安全测试答案,调查发现约 1200 个智能体通过未授权留言板协同行动。
快链头条登载此文本着传递更多信息的缘由,并不代表赞同其观点或证实其描述。
文章内容仅供参考,不构成投资建议。投资者据此操作,风险自担。
投资有风险,入市须谨慎。本资讯不作为投资理财建议。
7*24小时快讯
Malwarebytes:警惕假 GTA 6 泄露版网站,连接钱包或致多链资产被盗
09-03 08:44(1分钟前)
OpenAI Astra疑似已进API后台:模型ID从400变404
09-03 08:38(8分钟前)
Robinhood Chain单日费用达375万美元,超越Solana、以太坊和Base总和
09-03 08:37(9分钟前)
ARK 研究员称以太坊建成最成功 L2 体系却忘了收租
09-03 08:34(11分钟前)
黄仁勋 G20 称算力成国家级基建,1 GW 投资约 500 亿至 600 亿美元
09-03 08:34(12分钟前)
Decentralised.co:稳定币无法单独解决汇款问题
09-03 08:31(15分钟前)
数据:若 ETH 突破 2,497 美元,主流 CEX 累计空单清算强度将达 11.51 亿美元
09-03 08:30(16分钟前)
数据:若 BTC 跌破 73,237 美元,主流 CEX 累计多单清算强度将达 16.77 亿美元
09-03 08:30(16分钟前)
热门资讯
风险提示
根据银保监会等五部门于 2018 年 8月发布《关于防范以「虚拟货币」「区块链」名义进行非法集资的风险提示》的文件, 请广大公众理性看待区块链,不要盲目相信天花乱坠的承诺,树立正确的货币观念和投资理念,切实提高风险意识;对发现的违法犯罪线索,可积极向有关部门举报反映。