AIが引用するページの5つの特徴
· PION
ChatGPT・Perplexity・Google AI Overviewsが回答本文に頻繁に引用するページの5つの特徴を、PIONの測定基準で整理します。定義文、見出し階層、スキーマ、権威ある出典、二層構造を扱います。
AI検索は結果ページを経由せず、回答画面の中でユーザーの判断が完結します。だからこそ、インデックスされたかどうかよりも「その回答に自社の文章が載ったか」が露出のすべてになりました。
AIが引用するページには5つの共通点があります。最初の一文がそのまま答えになっており、見出しが質問単位で分割されていて、schema.org構造化データが本文と食い違わず、権威ある出典を文章の中に溶け込ませて書き、短い答えと長い本文が一つのページに一緒に存在します。 ChatGPT・Perplexity・Google AI Overviews(AI概要)が答えを組み立てるとき、まず取り込むページは分量よりも構造で決まります。
以下の5つは当てずっぽうで選んだリストではありません。AIの回答にほぼそのまま載った韓国語・英語のページを逆から分解してみると、同じ骨格が繰り返し現れます。そのうち、PIONが代行業務においてAIの回答にページが出典として付く比率が実際に変動することを確認した項目だけを残しました。Search Engine LandやSemrushの2026年AEOガイドも同じ方向を指し示しています。
1. 最初の一文がそのまま答えになっているページ
導入部や各H2の最初の一文が質問に対する完結した答えであれば、AIはほぼその文章をそのまま持っていきます。 ユーザーが投げかけた質問と意味が重なる一文が画面の上部にあるとき、引用される確率が最も高くなります。Search Engine Landはこれを「結論から書く(answer-first)」と呼んでいます。
例えば「レチノールはいつ塗るべきか」を狙ったページなら、最初の一文はこうあるべきです。「レチノールは夜、洗顔後の乾いた肌に塗る。」背景説明はその下に回します。逆に「レチノールの歴史は1970年代までさかのぼる」と切り出すと、肝心の答えは三段落下に埋もれてしまい、AIはその箇所を見つけられません。
手直しのコツは簡単です。
- 各H2の最初の一文を「Xは〜である」という断定形で始める。
- 主語を「これ・それ」のような代名詞ではなく、概念の名称で明示する。
- 導入の200文字以内で、ユーザーが実際に入力しそうな質問をそのまま受けて答える。
もちろん、すべての記事がこの型に当てはまるわけではありません。インタビューやストーリーテリングのコンテンツに結論から突きつけると不自然です。そういったページはAEOのターゲットから外し、別の用途の資産として活用する方が賢明です。
2. 質問単位で分割した見出し
見出しがフラットで、質問形式で組まれたページはよく引用されます。 AIはページを最初から最後まで読みません。見出しで意味のかたまりを分けたうえで、ユーザーの質問に最も近い見出しの本文だけを切り取って持っていきます。Mozが以前から検索の基本として強調してきた情報構造の原則が、そのまま引用シグナルになりました。
良い見出しは、人々が検索窓に入力する言葉と語順が似ています。「韓国・江南(カンナム)で美白施術が上手な施設」を狙うなら、H2は「江南で美白施術が上手な施設を選ぶ方法」くらいが良いでしょう。「美白施術 江南 おすすめリスト」のようなキーワード羅列型は、AIのマッチングで次第に力を失っていきます。
確認すべきことはシンプルです。H1は一つにとどめ、H2は3〜4個程度で区切りつつ、一つの見出しでは一つの質問だけに答えます。一つの見出しの下に二つの質問を詰め込むと、引用単位が曖昧になり、AIはどこを切り取ればよいか分からず、その箇所を丸ごと飛ばしてしまいます。
3. 本文と一致するschema.org構造化データ
schema.org JSON-LDが正確に設置されたページは、出典としてより頻繁に呼び出されます。 構造化データは、同じ内容を機械が読める形でもう一度書き添える仕組みです。Mozはこの役割を「機械可読性」と表現しています。
韓国のサイトがよく見落とすポイントは次のとおりです。
- FAQマークアップと本文の不一致。 FAQPage内の質問・答えのテキストが画面に見える本文と異なると、Googleのスパムポリシー違反になります。
- 会社名のブレ。 Organizationスキーマのname・別名・urlがサイト・SNS・報道記事ごとにバラバラだと、AIが同じ会社としてまとめられません。
- 記事メタの欠落。 BlogPostingの著者・公開日が空になっている場合。
代行を引き受けてサイトを初めて開くとき、PIONが真っ先に点検するのもこの3項目です。ただし順序を勘違いしてはいけません。間違ったschemaは、付けない方がましです。Rich Results Testを通過していても、本文と実際に合っているかは人の目で別途確認します。
4. 文章の中に溶け込ませた権威ある出典
主張のそばに出典とリンクが付いたページは、より信頼できる根拠として引用されます。 LLMは「主張+出典+リンク」が一セットで付いていると、事実性のシグナルとして読み取ります。Semrushが強調する根拠のあるコンテンツの原則と同じ文脈です。
引用は文章の中に自然に溶け込ませます。「〇〇によると」「〇〇の2026年報告書は」「〇〇は〜を推奨する」といった具合です。1セクションに1〜2回で十分で、同じ出典をセクションごとに表現だけ変えて再度書いても構いません。リンクは媒体名はそのままにして、資料タイトルの部分だけを囲むと、人にもAIにも認識しやすくなります。
本当に重要なのは出典の格です。匿名ブログやコミュニティのリンクばかりがずらりと並んだページは、AIが信頼シグナルとしてカウントしません。業界の権威ある媒体、学術・公的機関のドメイン程度でなければシグナルは拾われません。カギはリンクの数ではありません。どこに付けるかで決まります。
5. 短い答えと詳しい本文が一緒にある2段構造
上に50〜300文字の圧縮された答え、下に1,500〜3,000文字の背景本文。この2段構造が引用において最も強力です。 SemrushのChatGPT応答パターン分析も、「短い答えを先に出し、深い文脈を後ろに付ける」形式を引用に適していると指摘しています。
その理由は、AIが答えを作るとき二つを同時に使うからです。短い答えは応答本文にそのまま載り、詳しい本文はユーザーが「なぜ?」と問い返したときに背景の根拠として呼び出されます。片方だけだと片方の用途にしか使われず、その分だけ呼び出される機会が減ります。
公開前には、短い答えと長い本文が互いに合っているかを次の3項目で確認します。
- 上部300文字以内に、質問に対する完結した答えがあるか。
- その下の本文が1,500文字以上で背景を説明しているか。
- 短い答えと長い本文が同じ数値・同じ用語で前後の辻褄が合っているか。
3つ目が最も頻繁に抜け落ちます。上では「3倍」と言っておきながら、下の本文では「2〜3倍」とブレると、AIはどちらを信じればよいか分からず、両方とも低く見積もってしまいます。
どこから手をつけるべきか
5つを一度に押し進めることはしません。ページの種類ごとに勝負どころが異なるからです。定義・FAQページは1番と3番が先で、ガイド・ハウツーは2番と5番が決定的です。比較・分析ページは4番の出典引用が信頼の関門になります。
| ページの種類 | 先に手をつける項目 |
|---|---|
| 定義・概念・FAQ | 1番 最初の一文の答え・3番 schema |
| ガイド・ハウツー | 2番 見出し階層・5番 2段構造 |
| 比較・分析・業界レポート | 4番 権威ある出典の引用 |
| 会社・サービス紹介 | 3番 Organization schema・4番 出典 |
代行を引き受けると、PIONはクライアントサイトの主要ページをこの5項目で洗い出して引用親和度を評価し、実際のAI応答でどれだけ呼び出されるかと突き合わせます。5つがすべて揃ったページは、韓国語カテゴリを基準に、そうでないページの2〜3倍の引用頻度を示します。順序を決めて一つずつ直す方が、一度にすべて作り直そうとして何も終わらないよりも、はるかに早く効果が現れます。
よくある質問
AIが引用するページの特徴は?
最初の一文がそのまま答えになっており、H2/H3の階層が明確な質問形式の見出しで組まれていて、schema.org構造化データが本文と一致し、権威ある出典を文章の中に溶け込ませて引用し外部リンクを付けるページが、AI応答に最も頻繁に引用されます。5つ目は、短い答えと詳しい本文が一つのページに一緒にある2段構造です。
ChatGPTはどんなコンテンツを回答に持っていきますか?
質問に対する直接の答えがページ上部300文字以内にあり、権威ある出典を自然な言葉で引用し、FAQPage・Article schemaが本文と一致するコンテンツです。ChatGPTはページを丸ごと読まず、見出し単位で意味のかたまりを分けたうえで、ユーザーの質問に最も近い見出しの本文だけを切り取って持っていきます。
AI検索に引用されるコンテンツの作り方は?
各H2の最初の一文を断定形の答えとして書き、見出しを検索質問の語順に近い質問形式で組み、FAQPage・Article・Organization schemaを本文と食い違わないようにマークアップします。これに加えて、権威あるドメインの出典を自然な言葉で引用し、インラインリンクを付けます。上部の50〜300文字の圧縮された答えと、1,500〜3,000文字の背景本文が一緒にあってこそ、引用頻度が最大になります。
schema markupさえきちんと付ければAIに引用されますか?
schema単独では不十分です。schemaは本文と一致するときにシグナルになり、本文自体が直接的な答えと明確な見出し階層を備えていなければ、AIは切り取る部分を見つけられません。むしろ間違ったschemaは付けない方がましで、Googleのスパムポリシー違反に分類される可能性があります。
韓国語のページにも同じ原則が適用されますか?
適用されます。PIONが複数の韓国語カテゴリで測定した結果、5つの特徴をすべて備えた韓国語ページは、そうでないページの2〜3倍の引用頻度を示しました。韓国語ページはこれに加えて、主要な用語の英語併記(AEO・schema markup・FAQPage)が、ChatGPTの多言語応答においてシグナルを補強してくれます。