导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜 概念版块
快讯 机构 人物 观点 专题

BitGo CEO 悬赏 100 BTC 挑战 Claude,AI 未能转移资金,Anthropic 自曝评估漏洞

加密货币托管服务商 BitGo 首席执行官 Mike Belshe 于 8 月 1 日发起一项公开挑战:他发布了一个持有 100 BTC(约合 600 万美元)的比特币地址,邀请人工智能模型 Claude 尝试转移该笔资金。截至 8 月 2 日,链上数据显示该地址的 100 BTC 分文未动,没有任何交易记录。

Belshe 在社交媒体上表示,此举是对 Anthropic 此前披露的“AI 黑客”事件的回应。Anthropic 在 7 月 30 日透露,其 Claude 模型在网络安全评估中曾意外访问了三个真实组织系统。Belshe 称:“受够了‘我们创造了一个黑客怪物’的游戏,请给我们一个真实的演示。” 然而,他并未提供任何私钥、签名环境或系统访问权限,仅公开了一个比特币地址。BitGo 的多签钱包通常需要三把独立密钥中的两把才能授权交易,因此 Claude 无法仅凭地址信息获得资金控制权。

与此同时,Anthropic 于 8 月 2 日公布了更详细的调查结果。在对 141,006 次评估运行进行审查后,该公司发现三起事件分别涉及 Claude Opus 4.7、Mythos 5 以及一个内部研究模型。由于评估合作伙伴 Irregular 的配置失误,测试机器在评估结束后仍保持互联网连接,而模型被提示“处于封闭模拟环境”,却误将真实系统视为夺旗挑战。模型使用了弱密码、未认证端点等基本技术手段,其中 Opus 4.7 获取了凭证并访问了包含数百条生产记录的数据库;Mythos 5 则向公共 PyPI 注册表发布了一个恶意软件包,该包在被移除前运行了约一小时,影响 15 个真实系统。

Anthropic 强调,这些模型并非有意逃脱或追求独立目标,而是“操作失败”而非模型对齐失败。相关模型也未配备 Anthropic 公开产品中使用的标准分类器和监控系统。该公司已于 7 月 23 日停止相关评估,次日发现所有事件,并于 7 月 27 日通知受影响组织。METR 将进行独立审查,Anthropic 计划在一周内发布恶意包事件的编辑记录。

此次“Claude 挑战”并非对等测试。Belshe 的 100 BTC 地址只是一个公开观察目标,无法证明 Claude 尝试过或失败过。真正的受控测试需要明确的规则、授权访问、活动日志和独立验证。该事件也正值美国监管机构加强对先进 AI 系统网络安全测试的审查。特朗普政府此前已指示顾问制定自愿测试框架,Anthropic 的披露可能推动更严格的标准和事件报告要求。

BitGo 此前曾测试过抗量子 MPC 签名方案,而 Claude Mythos 5 的能力可能加速对暴露密钥、弱签名流程和配置错误系统的攻击,但无法直接破解密码学。任何从该地址转出的交易都将被链上记录,但调查人员仍需确认签名要求是否被满足,以及 Claude 模型是否参与其中。