AI 滥用
把 AI 系统用于欺骗、伤害他人或违反服务政策的活动的总称。
定义
AI 滥用是 Anthropic 威胁情报报告使用的总括概念:行为者利用模型能力,从事网络攻击、欺骗性影响操纵、监控、欺诈、武器相关开发等违反使用政策的活动。报告称,2025 年 12 月至 2026 年 8 月,其团队识别并处置了横跨七个危害领域的滥用活动。
滥用不等于「AI 自主作恶」。在报告描述的案例中,人类行为者设定目标、作出关键决策,AI 负责加速或扩大执行。滥用也不等于模型本身出了故障——许多手法(如凭据失窃、社会工程)在 AI 出现之前就已存在,变化的主要是执行成本与自动化程度。
还需要注意披露口径:报告发布的是平台观察到并处置的典型案例,而且是「最显著、最新颖」的那部分,不是全球 AI 滥用的完整统计。不能从案例数量推导某个国家、品牌或人群的整体风险。
{esc(t(CURRENT_LANG, "not_confused_with"))}
- 不等于 AI 正常使用中产生的无意伤害或「幻觉」;报告关注的是有意的恶意使用。
- 不等于所有涉及 AI 的争议行为;违反平台政策与违法是两个层面的判断,报告本身不作司法结论。
{esc(t(CURRENT_LANG, "example"))}
报告概述称,其团队识别并处置了七个危害领域的滥用活动,案例从交友应用中未披露的 AI 虚拟身份到 AI 辅助网络间谍活动,行为者包括疑似国家支持的团体、牟利型犯罪者、商业监控供应商等。