要約 / ポイント
- GEOの基礎論文による測定結果:引用+41%、統計+40%、出典+30~40%の可視性向上。一方、キーワードスタッフィングはほぼ無効でした。
- 生成エンジンは挑戦者に有利です。GEO手法により、ランク5のサイトは+115%の利益を得た一方、トップランクのサイトは約30%の回答シェアを失いました。
- 3つのゲートは、検索(クロール可能性)、合成(引用可能な主張と数値)、そして出典です。ChatGPTのAPIがウェブを閲覧するのは約74%のケースに過ぎません。
- GEOの重要な半分はオフサイトにあります。エンジンは主にサードパーティのページから回答を組み立てるため、カバレッジと言及数があなたについて何が語られるかを決定します。
このカテゴリーは、GEO、answer engine optimization (AEO)、AI visibility、そして開発者コミュニティでの「LLM SEO」という3つ(+α)の名称で呼ばれます。これらは同一の分野ですが、検索需要はまだ収束していません(2026年7月時点のGoogle Adsボリューム調査:"generative engine optimization"が月間約4,400件、"answer engine optimization"が約2,400件、"ai visibility tools"が約1,600件、"llm seo"が約880件)。本ガイドでは、研究文献で採用されているGEOという用語を使用します。
用語の由来と、論文で実際に測定された内容
"GEO: Generative Engine Optimization"(Aggarwal, Murahari et al.、2023年11月発表、KDD 2024にてプレゼンテーション)は、9つのドメインにわたる10,000件の実際のユーザークエリを用いた「GEO-bench」を構築しました。そして、生成エンジンに対して9つのコンテンツ介入を行い、各ソースがどれだけの回答枠を獲得したかを測定しました。この測定結果はこの分野の基礎となる成果物であり、その数値を正確に把握することが重要です。なぜなら、「GEOで可視性が40%向上する」と謳うブログのほとんどが、その結論を導き出した手法の内訳を省略しているからです。
| Intervention | Measured effect on visibility | Takeaway |
|---|---|---|
| Add quotations | ~+41% (position-adjusted word count) | Quotable sentences get lifted into answers |
| Add statistics | ~+40% | Numbers are the most portable form of authority |
| Cite sources | +30–40% | Content that shows receipts gets treated as a receipt |
| Fluency / readability edits | +15–30% | Clear prose is easier to synthesize from |
| Keyword stuffing | ≈ no improvement | The classic SEO reflex does nothing for answers |
この論文で最も過小評価されている発見は、「誰が恩恵を受けるか」についてです。下位ランクのサイトほど劇的に有利になります。引用を追加することで、従来の検索順位で5位だったサイトの可視性は115%向上した一方、トップランクのサイトは回答シェアを約30%失いました。生成エンジンは単に既存の順位を再提示するのではなく、回答ごとに順位を再決定します。もしあなたが、強固なドメインに対して「10個の青いリンク」のゲームで負け続けているなら、GEOはここ数年で初めて、構造的にチャレンジャー(挑戦者)を優遇するランキング体制と言えます。
生成エンジンが実際に回答を構築する仕組み
主要な検索エンジンはすべて、取得 (retrieve)(通常は従来の検索インデックスを使用)、合成 (synthesize)(それらの情報から回答を生成)、そして場合によっては引用 (cite)(使用したソースを明示)という同じ3つのステップを踏みます。各ステップは失敗し得る関門です。クローラーがページを取得できなかったり、JavaScriptを実行しないとテキストが表示されなかったりすれば、取得に失敗します。コンテンツに抽出可能な要素(明確な主張、数値、引用可能な文章など)がなければ、合成に失敗します。そして、引用されるかどうかは、ほとんどのダッシュボードが隠している変数に大きく左右されます。当社の本番環境モニタリングによると、ChatGPTのAPIがウェブを閲覧したのは呼び出し全体の約74%に過ぎず、残りは学習済みの記憶から回答していました。そこでは、現在のサイトではなく、数ヶ月前の第三者による説明が何を語るかを決定しています。
この記事が気に入ったら、毎朝同じようなものをメールで受け取れます。
1日1通 · 2クリックで解除 · サードパーティのトラッキングなし
GEOが実践において意味すること:2つの側面
自社サイト上 — あなたがコントロールできる半分:
- 機械的に取得をパスする。 robots.txtでAIクローラーを許可し、サーバーサイドでレンダリングされたテキストを提供し、タイトル、ディスクリプション、構造化データを配信します。10秒で終わる無料チェックですべて確認できます。
- 抽出可能なコンテンツを書く。 重要なすべてのページには、論文で測定された3つの要素(具体的な統計、引用可能な一文の主張、リンクされたソース)を含めるべきです。質問に対して簡潔な一文で答えるページは、検索エンジンが再利用しやすいページです。
- 独自のデータを公開する。 検索エンジンは数値を引用しますが、そのソースは誰かが担わなければなりません。一次データによる測定は、私たちが確認した中で最も確実に引用される成果物であり、競合他社がコピーできない唯一のものです。
サイト外 — 多くのガイドが見落としている半分:生成AIエンジンは、主に第三者のページ(比較、レビュー、ディレクトリ、報道など)から回答を組み立てます。私たちのモニタリングでは、検索エンジンが購入者向けの質問に対して実際に引用するページは、圧倒的にベンダー自身のサイトではありません。そのため、取得される第三者サイトでの存在感がGEOの重要な半分を占めます。つまり、検索エンジンが取得するページ上に存在する、あなたに関する言及、リスト掲載、編集記事などです。これはリンクビルディングが常に目指してきたものと同じ権威構築作業ですが、現在の通貨は単なるリンクのPageRankではなく、誰か他の人の回答に値するページで引用可能であることです。
効果がないと測定されたもの
- キーワードの詰め込み — 基礎となる論文のテストでは、ほぼゼロの効果でした。密度調整ツールは古い物理法則を最適化しているに過ぎません。
- ランキング施策としてのllms.txt — 主要なAIサービスでこれを使用すると発表したところはありません。10分でできる礼儀として公開するのは良いですが、戦略にはなりません。
- 回答枠をお金で買うこと — OpenAI自身の広告ポリシーには、広告はChatGPTの回答に影響を与えないと明記されており、広告は有料購読者には表示されません。私たちは一次ソースを用いてこれを検証しました。
- 単一の言及数(メンション数)を追うこと — コーパス内の言及数はランキングではなく、最低ラインに過ぎません。私たちは、コーパス内のカウントが1であっても、4つのライブ回答のうち3つで引用されているサイトを確認しています。ゼロであることを不可視性の証明として売るベンダーは、根拠のない雰囲気だけを売っています。
自分を欺かずにGEOを測定する方法
独自のモニターを運用して得た3つのルール:ウェブに基づいた(web-grounded)数値であることを強く求め(すべてのベンダーにその数値がそうであるかを確認してください)、すべての言及数は「少なくともN」として扱い、常に引用元が明記された行レベルの回答を読んでください。その証拠こそが製品そのものです。このためのツール市場は、当社のAI可視化ツールガイドで、測定された収集コストとともにマッピングされています。6つのエンジンで1つの質問を収集するコストはベンダー料金で約24.5セントかかるため、クリックして確認できないスコアには決して支払わないでください。
率直なまとめ
GEOは現実的で測定可能であり、弱者に非常に寛容ですが、魔法ではありません。また、基本原則から切り離されたものでもありません。サイトを機械的に読み取り可能な状態にし、引用に値する数値を含んだ、引用したくなるようなページを作成し、エンジンが情報を取得するためのサードパーティの露出面を構築してください。いつもの開示ですが、私たちはこの市場でサービスを提供しています。Stork Wireはまさにそのサードパーティの露出を構築するものであり、私たちの無料チェッカーは費用をかけずに始められる場所です。そのため、私たちの主張はそれに応じて評価してください。ただし、この論文の数値は私たちのものではなく、業界のものです。詳細は上記にリンクされています。

