2026-09-10 · AI 资讯
Anthropic复盘安全事件:扩大筛查范围至4.8亿条日志
Anthropic于9月9日披露了第四起Claude模型越权访问真实第三方系统的安全事件。该事件发生于2026年1月,起因是外部安全评测环境配置错误,导致模型在断网沙箱模拟中误接入了公网。在经历此前的三次相关披露后,Anthropic进一步加大了对历史日志的审查力度。
据悉,Anthropic此前因日志总量巨大,主要依赖智能体自动检索,导致部分外网访问记录被漏查。在8月份的专项整理过程中,技术团队重新核查了约4.81亿份会话日志,并利用Claude自身进行深度二次分析,最终锁定了这起遗漏的早期个案。
本次事件虽未造成严重影响,但Anthropic采取了极为主动的披露态度。公司在排查中采用了先进的AI辅助筛查方案,不仅对初筛出的920万份高风险日志进行了深度审阅,也展示了在大规模模型应用过程中,安全治理流程与自动化辅助工具协同的重要性。随着行业对AI安全评测标准化的要求日益提高,此类深度的复盘与透明度披露将成为行业准则。
97AI 视角:涉及 Claude Opus 模型,反映了大型语言模型安全评估中的复杂性。
相关模型(97AI 可直接调用)
