2026-09-12-星期六 · Anthropic

收录于 第 89 期(2026-09-12) · 本期共 14 条

❯ Anthropic披露Claude滥用案例,网络攻击、影响行动与监控成为重点

威胁报告Anthropic发布9月威胁情报报告,称已识别并中断多起滥用Claude的行动,覆盖网络攻击、影响行动、监控等场景。报告描述的是公司发现和处置的案例,不代表Claude独有这些风险,也不能据此推算全部AI滥用规模。

攻击方式根据Anthropic报告,作为背景,恶意行为者此前已经让模型辅助搜集信息、编写内容和分析目标,或串联多个攻击步骤,提高原本由人工完成的速度。平台能够封禁账号、改进检测并与外部机构分享指标,但攻击者也会更换账户和工具。模型提供商的滥用检测能力正在成为产品安全的一部分,处置后的复发情况也需要持续验证。

客户要求企业客户会追问日志和处置机制,包括日志保留、异常行为识别、账号处置和信息共享。安全团队需要评估的是模型接入后的监控覆盖,既要阻断恶意使用,也要避免把正常研究和自动化任务误判为攻击;下一步还要看Anthropic是否公开更多可验证的攻击指标。

▪ SIGNAL大模型安全竞争已经落到发现速度和处置能力,公开案例只是平台能看见并愿意披露的那部分。