概要
コーネルテックの研究者らは、ディープリサーチAIエージェントが、公開されたユーザー生成ページへの短い編集によって操作される可能性があることを発見しました。わずか1つのReddit形式のコメントが、偽の製品、サービス、またはエンティティに対する引用された推奨になることがあります。
これらの改ざんされたページは、AIシステムが引用・繰り返す内容を誘導するようにテキストが追加されているため、「汚染されている」と呼ばれています。研究者らはこの攻撃を「WARP(Web Agent Retrieval Poisoning)」と名付け、Webを検索し、情報源を収集し、引用レポートを作成するシステムの弱点を特定しました。
この攻撃は、AIモデル、プロンプト、検索エンジン、または情報取得システムへのアクセスを必要としません。代わりに、攻撃者はAIエージェントが取得する傾向のあるページ(Redditスレッド、Wikipediaページ、フォーラム投稿など)にテキストを編集または追加します。その後、エージェントが関連トピックを検索する際にそのページを取り込み、引用し、攻撃者が選択したメッセージを繰り返す可能性があります。
Redditは、この脆弱性において最大の開口部でした。STORM、Co-STORM、OmniThinkの3つのオープンソースシステムが取得したURLのうち、17%から23%がユーザー生成プラットフォーム(Reddit、YouTube、Facebook、Wikipediaなど)からのものでした。Redditはこれらのページの中で最も大きな割合を占め、3つのシステムが取得したユーザー生成URLの54%から71%を占めました。
この攻撃は、約13語の短いスニペットでも機能することが判明しています。あるテストでは、15語の文章で、架空の暗号通貨「BananaCoin」がCo-STORMレポートに「新興の」長期投資オプションとして押し込まれました。改ざんされたページが取得された場合、偽のエンティティはシステムのレポートの38%から51%に現れ、複数のページを標的にするとその範囲は42%から62%に上昇しました。
防御策は効果的ではありませんでした。ユーザー生成ドメインをブロックすることで攻撃経路は阻止されましたが、一次情報としての製品体験や地域の推奨事項といった情報源も排除されました。テストされたテキストフィルターは、挿入された文章と通常のユーザーコンテンツを確実に分離できませんでした。改ざんされた文章はAIモデルによって書かれたため流暢であり、パープレキシティに基づくフィルターは注入されたテキストよりも通常のユーザーコンテンツを検出する可能性が高い傾向がありました。
公衆ページへのわずかな編集が、たとえその基礎となる情報源がユーザー生成のものであっても、引用されるAI回答の一部となる可能性があることは重要です。Redditやフォーラムのようなサイトに植え付けられた誤情報は、議論スレッドから、ユーザーにとって信頼できるように見えるAI回答の引用された推奨へと移行する可能性があります。
解説
この研究は、生成AIがウェブ上の情報をどのように収集し、利用するかに潜在的な脆弱性があることを示しています。特に、ユーザー生成コンテンツ(UGC)がAIの「情報源」として扱われる場合、悪意のある少数の情報が全体のAI推奨に影響を与えるリスクがあることは、SEO担当者やコンテンツ制作者にとって見過ごせない問題です。
Googleは長年にわたり、E-A-T(専門性、権威性、信頼性)の重要性を強調してきました。AIがUGCを含む広範な情報源から学習し、回答を生成するようになると、E-A-Tの概念はAIの引用元評価においても間接的に、かつより一層重要になると考えられます。信頼性の低い情報源、特に容易に改ざん可能なUGCからの情報がAIによって信頼性のあるものとして引用されることは、誤情報の拡散につながる可能性があります。
企業やブランドは、公式情報源(ウェブサイト、プレスリリースなど)の情報の正確性と網羅性を高めるだけでなく、RedditやWikipedia、その他のフォーラムなど、AIエージェントが参照する可能性のあるUGCプラットフォームでのブランド監視を強化する必要があります。悪意のある投稿や不正確な情報が、AIによるレポートや推奨に組み込まれることで、ブランドイメージや事業に潜在的な損害を与えるリスクがあります。
また、この研究は、AI検索時代におけるSEO戦略にも影響を与える可能性があります。AIが「信頼できる」情報源をどのように定義し、優先するかはまだ進化中ですが、自社のコンテンツが権威性のある情報として認識され、AIに引用されるよう、コンテンツの質とバックリンク戦略を引き続き重視することが重要です。単にアクセス数を増やすだけでなく、情報の正確性と信頼性を確保することが、AI時代におけるSEOの根幹をなすでしょう。防御策が不十分である現状を考えると、情報源の健全性を保つための積極的な取り組みが、今後ますます求められます。
- 掲載元: Search Engine Land
- 公開日: 2026-06-24T13:45:40+00:00

A 13-word edit can steer what deep-research AI agents recommend