【Anthropic披露三起AI模型安全测试入侵事件】
内容摘要
【Anthropic披露三起AI模型安全测试入侵事件】7月31日讯,Anthropic周四表示,其部分最强大的模型在部署前的网络安全测试中,未经授权访问了真实系统。在OpenAI披露其模型测试期间入侵Hugging Face基础设施后,Anthropic审查了逾14.1万次网络安全评估,发现三起入侵事件。由于与测试合作伙伴Irregular之间的误解,评估环境意外连接互联网,导致Opus 4.7、Mythos 5和一个内部研究模型入侵了三个组织的真实系统。这些事件发生在“夺旗”测试期间——模型需在模拟环境中寻找隐藏信息。事件最早可追溯至4月,Anthropic目前已联系三家受影响组织,其中两家…
登录 DeepFocus 看全文 →登录后你可以
- 阅读本文完整原文
- 实时 A 股 / 港美股行情与自选盯盘
- 个股 / 研报 / 快讯的 AI 解读,以及每日 A 股收盘复盘
行情与资讯免费 · 登录即用
更多资讯
- 英国央行决定维持当前利率水平不变,同时指出国内通胀压力有所缓解。受此影响,短期英国国债价格出现一个多月以来的最大…
- 夜间盘|科技反弹抢回定价权,汇率与航道风险仍在拉扯 出品 Overnight Brief · 夜间盘 科技反弹抢…
- 代表必和必拓西澳黑德兰港工人的工会发出威胁,计划在下周举行轮流24小时罢工,这标志着全球最大铁矿石出口枢纽的劳资…
- 韩国计划向主权财富基金注入20万亿韩元(约合139亿美元),用于人工智能、数据中心及基础设施等领域的战略性投资,…
- 日本东京7月核心CPI同比上涨1.9%,高于市场预期的1.7%,剔除生鲜食品和燃料的指数同比上涨2.0%。6月工…