公开威胁报告 · 独立解读

看懂 AI 被怎样滥用

我们把公开发布的 AI 威胁报告整理成普通人能读懂的案例。逐案说明发生了什么、AI 扮演什么角色、哪些有证据、哪些仍然未知。这是独立编辑项目,不是报告发布方的官方网站。

浏览全部案例

语言: 简体中文 · English · Español · Français · العربية · 日本語

七类滥用,七种真实危害

按危害机制阅读,而不是按国家或公司排名。

网络攻击活动

AI 让旧手法跑得更快:凭据失窃、未修补系统和钓鱼仍然是入口,变化主要在规模和成本。

8 个案例单元

影响操纵活动

关键不是观点,而是隐瞒身份、隐藏赞助和伪装来源。产量也不等于真正影响了多少人。

9 个案例单元

监控活动

资料公开,也不等于可以未经同意地关联、识别和追踪个人。

8 个案例单元

常规武器

文稿、仿真和测试需分开看:有软件或规格,不等于已经形成现实打击能力。

6 个案例单元

生物领域滥用

同一类知识可能有益也可能有害。本站只讲用途类别、阶段和治理,不讲任何实验细节。

4 个案例单元

骗局与欺诈

对方可能不是你以为的人:报告称有交友应用把未披露的 AI 身份混入“真人服务”并诱导付费。

1 个案例单元

未经授权的模型蒸馏

蒸馏是一种技术;未经授权的访问、转发和数据提取是另一层判断。报告指称不是司法结论。

6 个案例单元

编辑精选

三个典型案例:面向普通个人的欺诈、AI 服务供应链上的凭据窃取,以及有组织的影响操纵。

01骗局与欺诈

交友应用中未披露的 AI 身份:GTG-15001 案例

据 Anthropic 报告,一个中国应用工作室使用 Claude 构建了 20 多个交友应用,并为与用户对话的 AI 虚拟身份提供动力——尽管其服务宣传为完全真人。2026 年 4 月的两周内,报告发现超过 4,700 个不同的 AI 虚拟身份与至少 25,000 个独立个人互动。工作室还招募真人混入与机器人相同的匹配信息流,主要用于真实性检查。AI 与真人比例约为 3:1。

阅读案例

02网络攻击活动

假冒 AI 转售服务与凭据窃取:GTG-50021 案例

据 Anthropic 报告,AI 供应链已成为恶意行为者的目标、战利品和攻击算力来源。以被盗 API 密钥、会话令牌和设备形式存在的 AI 访问权限,日益成为多个犯罪集团的唯一目标。GTG-50021 是一个俄语与乌克兰语行为者运营的虚假 AI 转售服务。客户以为买到了折扣 Claude 接入,实际流量被静默转给其他模型;转售工具还会在设备上安装凭据收集程序,把账号凭据转卖给其他代理网络。

阅读案例

03影响操纵活动

跨地区的商业化舆论操纵服务:GTG-54002 案例

据 Anthropic 报告,一个伪装成「各地独立新闻编辑部」的网络用 Claude 批量生产和改写政治内容:约 70 个伪造新闻网站、至少 8,913 篇文章、约 20 种语言,另有 70 个配套 X 账号和 250 多个虚假评论账号放大。但报告同时强调:大部分内容几乎没有真实受众互动,未见突破其自有网络的传播证据——产量不等于影响力。报告将网络追溯到一家法国数字广告公司,未能确认委托客户,也未发现任何政府指使的证据。

阅读案例

每个案例怎么读

  1. 发生了什么。 用日常语言复述事件经过:什么时间、波及了谁,不推测报告没写的内容。
  2. AI 做了什么。 AI 出现在哪个环节——生成内容、写软件、分析数据,还是与人互动;不把 AI 的作用夸大为全部原因。
  3. 确知与未知。 分开列出报告确认的事实和仍然未知的事项;归因措辞和否定证据一律保留原文口径。
  4. 如何降低风险。 编辑补充的防护建议,只讲普通人能采取的防范动作,不复现任何攻击做法。

当前收录报告

当前收录一份报告:Anthropic 于 2026 年 9 月 10 日发布的 *Detecting and countering misuse of AI: September 2026*,全文 154 页,英文。

主要观察窗口为 2025 年 12 月至 2026 年 8 月,覆盖七类危害:网络攻击、影响操纵、监控、骗局与欺诈、生物领域滥用、常规武器、未经授权的模型蒸馏。

我们把报告拆成 42 个案例单元。42 是为便于阅读拆分的编辑单元数,不是 42 起独立事件;有的单元包含多个账号或行动。详见报告导读案例库

阅读报告导读

方法与更正

案例拆分、数字口径、报告事实与编辑建议的区分,见研究方法

发现错误或有更正线索,请通过联系与更正告知;涉及报告原文的事实,以原报告为准。