AIの濫用
AIシステムを欺瞞、他人への危害、サービスポリシー違反活動に用いる行為の総称。
定義
AIの濫用はAnthropicの脅威インテリジェンスレポートが使う包括的な概念です。行為者がモデルの能力を利用して、サイバー攻撃、欺瞞的な影響工作、監視、詐欺、兵器関連開発など、利用ポリシーに違反する活動を行うことを指します。レポートによると、2025年12月から2026年8月にかけて、同チームは7つの危害領域にわたる濫用活動を特定して対応しました。
濫用は「AIが自主的に悪事を働く」という意味ではありません。レポートが記述する事例では、人間の行為者が目標を設定し、重要な決定を行い、AIは実行を加速・拡大する役割を担っています。また、濫用はモデル自体の故障を意味するわけでもありません。認証情報の窃取やソーシャルエンジニアリングなど、多くの手口はAIが登場する前から存在しており、変化したのは主に実行コストと自動化の度合いです。
開示口径にも注意が必要です。レポートが公開しているのは、プラットフォームが観察して対応した典型的な事例であり、しかも「最も顕著で新規性の高い」部分です。世界全体のAI濫用の完全な統計ではありません。事例の数から、特定の国・ブランド・集団の全体的なリスクを推し量ることはできません。
{esc(t(CURRENT_LANG, "not_confused_with"))}
- AIの通常利用で生じる偶発的な危害や「幻覚」とは異なります。レポートが注目するのは意図的な悪意のある利用です。
- AIが関わるすべての物議を醸す行為を意味するわけではありません。プラットフォームポリシー違反と違法性は別のレベルの判断であり、レポート自体は司法的な結論を下しません。
{esc(t(CURRENT_LANG, "example"))}
レポートの概要によると、同チームは7つの危害領域の濫用活動を特定して対応しました。事例は出会い系アプリにおける開示されないAIアカウントからAI支援型サイバースパイ活動まで多岐にわたり、行為者には国家支援の疑いのあるグループ、営利目的の犯罪者、商業監視ベンダーなどが含まれます。