更新日 2026-09-30
GEO(生成エンジン最適化)エージェンシーの選び方
GEO(生成エンジン最適化)エージェンシーは、商談につながるプロンプトの定義、再現可能な回答ベースラインの構築、検証できる証拠ギャップの改善、そしてAI出力を制御できると約束せずに変化を測定する役割を担います。選定では、引用保証や中身の見えない独自スコアではなく、方法、成果物、データ所有権、品質管理、意思決定ルールを確認します。まず範囲を限定したパイロットを行い、プロンプト群、回答全文、参照元、レポートへのアクセスは自社アカウントに残してください。
市場にはGEO専業会社、AI検索サービスを追加した従来型SEO会社、デジタルPR会社、運用支援を提供するソフトウェア企業が混在しています。呼び方が似ていても、実際の成果物は大きく異なります。
本稿は、特定ベンダーを順位付け・レビューせずに提案を比較するための手順です。生成エンジン最適化を、SEOを補完する証拠と測定のプログラムとして扱い、ブランド掲載を保証する近道とは考えません。
GEOエージェンシーは何を担うべきか
有効な契約は、次の5つの責任をつなぎます。
- 買い手質問の設計: 対象者、市場、意思決定段階、重要なプロンプトを定義する。
- ベースライン証拠: 回答全文、表示された参照元、取得失敗、言語・地域、日付を保存する。
- 適格性と証拠の改善: クロールやインデックスの問題を修正し、事実ページを強化し、エンティティ情報の不整合を解消する。
- 権威性の構築: レビューの捏造や裏付けのない主張を避け、関連する第三者掲載を獲得する。
- 測定と意思決定: 回答での可視性、検索成果、参照流入、事業成果を分けて評価する。
すべての作業を1社が実行する必要はありません。責任範囲と依存関係が明確であれば十分です。コンテンツ会社は技術的な遮断をコンテンツの失敗として報告すべきではなく、モニタリング会社も回答取得と回答改善を同一視すべきではありません。
1. 提案依頼の前に購入要件を書く
まず1つの市場と1つの事業課題を選びます。要件には次を含めます。
- 対象製品、カテゴリー、オーディエンス
- 優先市場、言語、回答面
- 観測したい買い手の意思決定
- 既存のSEO、分析、CRM、コンテンツ、PRの責任者
- 規制対象または承認が必要な主張
- 期間、予算、利用できる社内能力
- 拡大投資を正当化する結果
「AIでの可視性を高める」だけでは不十分です。より良い要件は、「クラウドアクセス製品を比較する米国英語圏のセキュリティ担当者向けに、3つの回答面で40プロンプトのベースラインを作成し、自社と競合2社の説明を検証し、1つの証拠ギャップを修正し、公開後に同じパネルを再実行する」です。
これによりコホート、分母、比較対象、意思決定が定義されます。何が欠けているかを確認する前に、提案が無制限のコンテンツ契約へ膨らむことも防げます。
2. 安定したプロンプト・回答プロトコルを求める
測定パネルをどう作成し固定するかを確認します。有用なプロンプトは、類似表現を大量に並べるのではなく、異なる意思決定タスクを網羅します。
- カテゴリー探索と候補選定
- ユースケースと対象者への適合
- 価格、地域、連携、セキュリティ、導入条件
- 比較と代替製品
- 証拠、制約、リスクを確認する質問
各実行では、正確なプロンプト、プラットフォーム、取得できる場合はモデルまたは回答面、ロケール、地域設定、時刻、完了状態、回答全文、表示された参照元を保存します。取得前に、言及、推薦、比較、不在、正確な説明、自社ドメイン引用の判定ルールを定義します。
この手順がなければ、後から都合のよい例だけを選べます。固定パネルはAIの変動をなくしませんが、変化を解釈・監査しやすくします。
3. 適格性と観測された可視性を分ける
優れた提案は、2つの証拠層を区別します。
適格性の証拠は、関連ページが発見、クロール、インデックス、レンダリング、理解され得るかを確認します。canonical、robotsルール、内部リンク、表示コンテンツ、スニペット適格性、ページと一致する構造化データなどです。
観測された回答の証拠は、固定プロンプトパネルに対して回答面が実際に何を出力したかを確認します。言及、推薦、引用、事実の正確性、競合の登場、参照元の傾向などです。
両者は関係しますが、置き換えられません。技術監査を通過しても回答エンジンによる引用は保証されません。ブランド言及があっても、エージェンシーが原因とは限りません。Googleは、AI検索機能にも通常の検索の基礎要件が適用され、特別なAIマークアップは不要だと説明しています。検索・引用取得用クローラーと、学習やその他のコンテンツ利用用クローラーも分けて扱います。
AI可視性監査を使い、依存関係の順番を確認します。遮断があるなら適格性を先に、次にブランド情報と証拠、その後に実際の回答と参照元を検証します。
4. サービス名ではなく成果物を比較する
各提案を具体的な成果物へ変換します。
技術・エンティティ基盤
クロール/インデックス診断、canonicalとrobotsの指摘、レンダリング確認、名称の一貫性、構造化データ検証、優先順位付き改善リストなどが考えられます。各課題には対象URL、証拠、責任者、受入テストを求めます。
買い手の証拠とコンテンツ
質問とページの対応表、製品事実台帳、買い手の意思決定に結びつくコンテンツ要件、情報源要件、レビュー責任、除外事項を確認します。「AI向けコンテンツを作る」だけでは成果物として不十分です。
デジタルPRと第三者証拠
提案では、対象者と情報源カテゴリーを明示し、獲得掲載と有料掲載を区別し、スポンサー関係を開示します。レビュー捏造、未開示タイアップ、虚偽の専門家主張は禁止します。アウトリーチ件数ではなく、関連性のある公開済み証拠を数えます。
モニタリングとレポート
バージョン管理されたプロンプトパネル、回答全文、表示引用、取得失敗、判定ルール、分母、競合定義、変更履歴を求めます。元の証拠を確認できないダッシュボードは監査が困難です。
5. データとアクセス権を自社管理にする
契約前に、誰が次の情報を所有し、エクスポートできるかを定めます。
- プロンプト一覧とバージョン履歴
- 取得した回答全文と引用
- 判定ルールとラベル付き結果
- 分析、Search Console、CRM設定
- コンテンツ要件、原稿、調査メモ、承認済み主張
- アウトリーチ先、掲載実績、開示記録
- ダッシュボード、元ファイル、最終報告
最小権限を採用し、必要な権限だけを付与します。管理者権限は社内に残し、契約終了時の手順も文書化します。ベンダー独自プラットフォームから完全な証拠を出力できない場合、その利便性が移行・検証リスクに見合うか判断してください。
6. 明示的な重みで提案を採点する
次の例は、洗練された営業資料が弱い運用モデルを隠すのを防ぎます。
- 方法と再現性 — 25%: 固定プロンプト、保存回答、定義、比較可能な再実行。
- 関連専門性 — 20%: 自社の買い手行程、市場、言語、リスク水準での実績。
- 成果物と所有権 — 20%: 具体的成果、責任者、受入基準、アクセス権。
- 測定品質 — 20%: 明示した分母、失敗、信頼限界、分離した成果層。
- 商業適合 — 15%: 現実的な範囲、社内作業、依存関係、価格、終了条件。
営業会議での自信ではなく、書面の証拠を採点します。事例で改善率が示されたら、指標定義、ベースライン、期間、サンプル数、同時期の変更、顧客による検証可否を確認します。分母のない割合は証明になりません。
7. ゲート付き90日パイロットを行う
各段階に終了条件を設けると評価しやすくなります。
1〜30日目:ベースラインと診断
買い手質問の枠組みを承認し、最初のプロンプト群を固定し、ベースラインを取得します。取得品質を確認し、優先順位付きの適格性・証拠バックログを作ります。元証拠と分類を再現できることを次段階への条件にします。
31〜60日目:範囲を限定した1つの改善
重要な依存関係を1つ修正します。既存比較ページで製品制約を明確にする、インデックス適格性を修復する、証拠に基づくユースケースページを公開する、といった作業です。対象URLと公開日を記録し、同時に10の施策を変えないようにします。
61〜90日目:比較可能な再実行と判断
本番実装を検証し、事前に合意した観察期間を置き、変更していないパネルを再実行します。回答変化と検索流入、リード、売上は分けて報告します。停止、方法修正、改善の反復、範囲拡大のいずれかを決定します。
パイロットは即時引用を約束するものではありません。信頼できるループを運用できるかを検証するためのものです。
例:2つのエージェンシー提案を比較する
以下は説明用の架空例です。 B2B決済会社が、米国英語圏の30プロンプトについて90日パイロットを依頼します。A社は「AI順位トップ3」、24記事、単一の可視性スコアを約束しますが、回答全文を提供せず、生成回答内での順位も定義しません。
B社は、固定プロンプトパネル、3つの回答面でのベースライン、回答全文と参照元の保存、技術・証拠バックログ、承認済みページ改善1件、比較可能な再実行を提案します。言及、推薦、自社引用、正確性、取得失敗を別々に定義し、モニタリング環境とエクスポートは顧客が所有します。
B社の公開ページ数は少ないかもしれませんが、提案は検証しやすくなります。価格や業界知識の深さは交渉が必要です。重要なのは、作業が確認できる証拠と期末判断を生むことです。
GEOエージェンシー提案の危険信号
次が含まれる場合は立ち止まってください。
- 引用、順位、流入、売上の保証
- プロンプト群、分母、回答元データのない秘密のスコア
- クローラー、schema、
llms.txt変更を掲載保証として説明 - 診断前に設定された大量のコンテンツ本数
- 捏造レビュー、未開示の有料掲載、操作目的の隠しコンテンツ
- 期間、ベースライン、同時変更の開示がない事例改善率
- ブランド言及と自社ドメイン引用を区別しない報告
- 事実確認、規制対象主張、製品変更への承認プロセスがない
- ベンダー所有アカウントだけを使い、終了後に履歴を失う契約
エージェンシー、社内チーム、ソフトウェアの使い分け
技術SEO、コンテンツ、専門家レビュー、デジタルPR、測定をまたぐ実行が必要で、社内に調整能力が足りない場合はエージェンシーが適します。ただし戦略責任者は社内に置きます。
製品知識が機密性を持ち、主張承認が複雑で、既存のSEO、コンテンツ、分析、PR部門がループを運用できるなら社内チームが適します。外部専門家は設計レビューや限定的な課題解消に利用できます。
継続的な取得、証拠保存、競合比較、報告が主な不足ならソフトウェアが適します。ソフトウェアは編集判断、技術実装、PR関係、主張承認を代替しません。社内所有、専門家による実行、顧客管理のモニタリングを組み合わせるチームも多くあります。
- 書面化した買い手範囲、固定プロンプトパネル、保存された回答全文の証拠。
- 適格性、回答、検索、参照、事業成果を分けた測定層。
- 具体的な成果物、責任者、受入テスト、依存関係。
- プロンプト、回答、参照元、レポートの顧客所有権または出力権。
- 比較可能な再実行と、拡大・修正・停止を判断する範囲限定パイロット。
よくある質問
関連する買い手プロンプトの定義、回答ベースラインの構築、技術的適格性と検証可能な証拠の改善、適切な第三者権威の形成を支援し、言及、引用、正確性、検索成果、事業成果の変化を測定します。
方法、関連専門性、具体的成果物、データ所有権、測定定義、品質管理、商業適合、終了条件を比較します。引用保証や独自スコアより、元証拠を提供する範囲限定パイロットを優先します。
プロンプト群の版、プラットフォーム、市場、日付、成功回答、取得失敗、言及、推薦、自社引用、事実の正確性、競合の登場、表示参照元に加え、検索成果と事業成果を分けて報告します。
できません。適格性、証拠、一貫性、測定は改善できますが、回答エンジンは変動し、その運営者が制御します。引用、順位、流入、売上の保証は危険信号です。
90日は実用的な開始枠です。ベースラインと診断、範囲限定の改善、比較可能な再実行と判断に分けます。適切な観察期間は作業内容により異なり、開始前に合意します。
必ずしも不要ではありません。ソフトウェアは回答、参照元、比較を保存し、エージェンシーは技術、コンテンツ、PR、測定の実行を調整できます。適切な体制は社内能力によって異なり、戦略所有権は顧客側に残します。