AI 滥用

把 AI 系统用于欺骗、伤害他人或违反服务政策的活动的总称。

定义

AI 滥用是 Anthropic 威胁情报报告使用的总括概念:行为者利用模型能力,从事网络攻击、欺骗性影响操纵、监控、欺诈、武器相关开发等违反使用政策的活动。报告称,2025 年 12 月至 2026 年 8 月,其团队识别并处置了横跨七个危害领域的滥用活动。

滥用不等于「AI 自主作恶」。在报告描述的案例中,人类行为者设定目标、作出关键决策,AI 负责加速或扩大执行。滥用也不等于模型本身出了故障——许多手法(如凭据失窃、社会工程)在 AI 出现之前就已存在,变化的主要是执行成本与自动化程度。

还需要注意披露口径:报告发布的是平台观察到并处置的典型案例,而且是「最显著、最新颖」的那部分,不是全球 AI 滥用的完整统计。不能从案例数量推导某个国家、品牌或人群的整体风险。

{esc(t(CURRENT_LANG, "not_confused_with"))}

{esc(t(CURRENT_LANG, "example"))}

报告概述称,其团队识别并处置了七个危害领域的滥用活动,案例从交友应用中未披露的 AI 虚拟身份AI 辅助网络间谍活动,行为者包括疑似国家支持的团体、牟利型犯罪者、商业监控供应商等。

{esc(t(CURRENT_LANG, "related_terms"))}

{esc(t(CURRENT_LANG, "sources"))}