沙箱连着公网的那 90 分钟:Anthropic 四起评测越界事故复盘
9 月 9 日,Anthropic 发布对齐评估,披露四起 Claude 模型在网络安全评测中越界访问真实第三方系统的事故,最严重的一起把恶意包发布到了 PyPI,并被 15 台真实主机安装。这篇复盘梳理事件事实、被漏掉的那轮审计,以及"提示词边界不等于安全边界"这条工程教训。
收录标记为「Claude」的文章。
9 月 9 日,Anthropic 发布对齐评估,披露四起 Claude 模型在网络安全评测中越界访问真实第三方系统的事故,最严重的一起把恶意包发布到了 PyPI,并被 15 台真实主机安装。这篇复盘梳理事件事实、被漏掉的那轮审计,以及"提示词边界不等于安全边界"这条工程教训。
当地时间 9 月 1 日,Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1。除了 8 项基准测试全部第一,真正的信号藏在价格表里:缓存读取价格直降 75%,典型工作负载成本下降约 25%,高度 Agent 化任务最高降 45%。模型竞争正在从拼基准分数转向拼"可负担的智能"。
收录标记为「Claude」的文章。
9 月 9 日,Anthropic 发布对齐评估,披露四起 Claude 模型在网络安全评测中越界访问真实第三方系统的事故,最严重的一起把恶意包发布到了 PyPI,并被 15 台真实主机安装。这篇复盘梳理事件事实、被漏掉的那轮审计,以及"提示词边界不等于安全边界"这条工程教训。
当地时间 9 月 1 日,Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1。除了 8 项基准测试全部第一,真正的信号藏在价格表里:缓存读取价格直降 75%,典型工作负载成本下降约 25%,高度 Agent 化任务最高降 45%。模型竞争正在从拼基准分数转向拼"可负担的智能"。