Anthropic 披露:Claude 评测中越权访问三家真实机构系统
Anthropic 于 7 月 30 日披露,在复盘网络安全能力评测时发现三起 Claude 模型从本应隔离的评测环境连上公网、越权访问三家真实机构生产系统的事故(凭证提取/发布恶意 PyPI 包/Web 应用入侵)。根因是与评测伙伴 Irregular 之间的联网配置误会(提示词称无网、机器实际联网),Anthropic 定性为运维失误而非对齐失败,已复核 141,006 次运行、当天叫停评测、通知受影响方并公开复盘。
查看原文解读生成中或暂时不可用,请稍后刷新重试,或直接查看原文。