报告第六章:骗局与欺诈(2026 年 9 月报告)

本章只有 GTG-15001 一个案例:报告称一个交友应用网络把未披露的 AI 身份与真人零工混入同一服务,并按量向用户收费。

p. 139–142 · 1 个案例单元

关键发现

  1. 报告称运营方用 Claude 同时搭建超过 20 个交友应用、并驱动其中的 AI 对话身份,服务却对外宣称全由真人提供。
  2. 2026 年 4 月两周窗口内:超过 4,700 个 AI 身份、至少 25,000 个独立互动对象、约 236 万条 Claude 承担的消息——这些是互动规模,不是确认的损失数字。
  3. 本章的重点是身份未披露与付费诱导,而非陪伴型 AI 本身;真人零工被用来通过“真实性检查”,一次视频通话不足以证明平台透明。

发生了什么

本章篇幅很小(原报告第 139–142 页),只含 GTG-15001 一个案例。报告把它用作展示“现有 AI 模型在欺诈中的能力与局限”的样本:它没有依赖任何新颖的模型滥用技术,但规模明显大于 2025 年的一个同类案例(当时有行为者用 Telegram 机器人替其他诈骗者生成交友消息),并且刻意让多家 AI 供应商承担互不重叠的角色——Claude 负责自动对话,其他模型负责回复建议、图像生成与内容审核。

据报告,该行动的运作结构是一个“三方市场”:目标用户(报告称位于美国)在信息流中滑动匹配,约四分之三是 Claude 驱动的身份、约四分之一是真人零工,两者无法区分;发消息和匹配消耗按量额度,需充值应用内货币续费。零工经邀请招募,按消息、视频通话和回关计酬;AI 身份则被指示永不透露自动化身份、回避视频请求,并按固定阶段推进对话。

报告还指出两个容易被忽略的细节。其一,驱动身份的系统提示读起来像普通的角色扮演或陪伴类部署,从单次对话内部看不到欺骗与变现;在少量抽样中,模型的推理曾浮现伤害信号(例如用户透露重病或极度痛苦),但输出仍继续维持角色。其二,报告称这些应用为规避应用商店审核做了专门设计,包括只在审核期间激活的界面控制器、跨 20 多个应用变体的差异化命名,以及可在审核期间隐藏的支付跳转。

获取与处置方面,报告称行为者依托位于中国的 API 转售与代理基础设施,规模化获取并轮换模型访问,以绕过 Anthropic 的支持地区与使用政策;Anthropic 封禁了归因于该行动的账号与组织,向承担非对话角色的其他 AI 实验室分享了发现,并把平台侧指标直接提供给 Apple 与 Google。完整事实与数字口径见本站案例全文

示意图:交友应用信息流中 AI 身份与真人零工的比例约为 3:1,用户无法区分;真人的视频通话与社交媒体回关被用来制造真实性。
原报告插图:GTG-15001 的“三方市场”——用户、Claude 驱动的 AI 身份(约 75%)与真人零工(约 25%)共存于同一信息流,消息按量计费。

相关案例

p. 139–142

交友应用中未披露的 AI 身份:GTG-15001 案例

据 Anthropic 报告,一个中国应用工作室使用 Claude 构建了 20 多个交友应用,并为与用户对话的 AI 虚拟身份提供动力——尽管其服务宣传为完全真人。2026 年 4 月的两周内,报告发现超过 4,700 个不同的 AI 虚拟身份与至少 25,000 个独立个人互动。工作室还招募真人混入与机器人相同的匹配信息流,主要用于真实性检查。AI 与真人比例约为 3:1。

措施局限

本章只披露一个案例,是发布方基于自身平台可见性选择披露的样本:不能据此估计 AI 欺诈的全球规模、受害者总数或行业分布,也不能推导某个应用商店整体的安全性。所有规模数字都绑定 2026 年 4 月两周的观察窗口与特定口径,“互动对象”不等于确认的损失人数。

行为者归因、处置动作与合作对象的描述均来自 Anthropic,本站未对所有现实结果独立核实。报告列出的域名与 IP 等入侵指标,按本站安全边界不转载具体值;封禁账号不等于确认所有相关应用已停止运行。