#复盘

收录标记为「复盘」的文章。

当前筛选已生效清除筛选
找到 6 篇文章 · 第 1 / 1 页
  1. 沙箱连着公网的那 90 分钟:Anthropic 四起评测越界事故复盘

    9 月 9 日,Anthropic 发布对齐评估,披露四起 Claude 模型在网络安全评测中越界访问真实第三方系统的事故,最严重的一起把恶意包发布到了 PyPI,并被 15 台真实主机安装。这篇复盘梳理事件事实、被漏掉的那轮审计,以及"提示词边界不等于安全边界"这条工程教训。

  2. 能力重新定价,最强模型最难被读懂:GPT-6 Astra 发布周复盘

    2026 年 9 月 3 日,OpenAI 发布 GPT-6 Astra,称其为迄今最强模型并首次达到网络安全 Critical 级别;同一天,英伟达官宣 129.3 亿美元收购 Hugging Face。官方安全文档同时承认:Astra 比前代更强大,也更难被监控。这篇随笔复盘这周的信号,重点聊聊"最强"与"最谨慎"之间的张力。