英文关键原文与中文翻译
We disrupted every operation in the report, and used the lessons from them to strengthen our safeguards.
我们阻止了报告中涉及的每一项行动,并利用从中获得的经验来加强安全防护。
报告范围
Anthropic 表示,其威胁情报团队汇总了过去八个月识别并阻止的 Claude 滥用案例。报告覆盖 2025 年 12 月至 2026 年 8 月,涉及七类风险:网络行动、影响力行动、监控、诈骗与欺诈、生物滥用、常规武器开发和非法蒸馏。
报告涉及 Claude Haiku、Sonnet 和 Opus。Anthropic 称,除一宗非法蒸馏案例外,所披露的滥用案例没有使用 Claude Fable 或 Mythos 系列模型。
披露口径
Anthropic 明确说明,这些案例不是常见滥用的代表,而是其迄今发现的较突出和新颖的威胁活动。报告中的行动均已被阻止;团队据此更新了防护措施,并在适当情况下向主管机关和其他行业参与者分享情报。
报告所述参与者包括疑似国家支持团体、以经济利益为目的的犯罪者、商业间谍软件供应商、国家宣传机构和有政治动机的个人。
技术观察框架
报告用 speed、scale 和 depth 三个维度衡量 AI 带来的能力提升(uplift),即 AI 是否让恶意行为执行得更快、覆盖面更广或深入程度更高。
在网络安全部分,Anthropic 将近期变化概括为 AI 的角色从“助手”向“编排器”演进:部分案例中,模型不只是回答问题,而是参与串联多个阶段;人类仍负责设定目标并审查关键结果。报告据此认为,平台防护需要同时关注单次请求和围绕模型构建的自动化工作流。
发布目的与边界
Anthropic 表示,公开这些案例是为了帮助其他平台识别相似模式,让政府与公民社会更清楚地理解新兴威胁,并加强集体防御。本文仅整理官方公开报告的范围、方法和防御性观察,不复述攻击执行步骤或可直接用于滥用的操作细节。