术语表

这些词按中文阅读习惯解释,并链到报告中的例子。近义概念不合并,例如蒸馏和未经授权蒸馏是两个词条。

AI 辅助网络攻击

把 AI 写进侦察、工具开发和数据整理等环节的网络攻击活动,基础手法多半仍是旧的。

AI 滥用

把 AI 系统用于欺骗、伤害他人或违反服务政策的活动的总称。

API 密钥窃取

偷走调用 AI 服务所需的密钥或登录会话,把别人的额度、数据和身份变成自己的攻击资源。

归因置信度

报告对「这是谁做的」有多确定的一种措辞,例如高置信度、中等置信度。它不是本站的评分。

能力增益

AI 让同一名行为者在速度、规模或深度上超过其原有资源所能达到的水平。

协同虚假行为

多个账号配合发布高度一致的内容,表面却装成互不相识的普通人。

双重用途

同一类知识、物项或软件,既可以用于正当目的,也可能被用于伤害。

入侵指标

防御方用来识别相关活动的技术线索,例如域名、地址或文件特征。本站不转载具体值。

欺骗性影响操纵活动

用虚假身份、隐蔽赞助或伪装来源,大规模生产和分发内容,让受众误判「这是谁在说话」。

模型蒸馏

用一个模型的输出去训练或增强另一个模型的技术。技术本身不等于未经授权。

未经同意的人物画像

在当事人不知情或未同意的情况下,把分散信息拼成可识别个人的档案,并推断敏感属性。

未经授权的模型蒸馏

报告用来指未经权利方允许,通过转发、提取或购买对话来获取模型能力或训练数据的行为。