AI検索の 対策では、 優れた 文章を 書く ことよりも 先に、 「機械が 正しく 読み取れる サイトか どうか」が 土台に なります。 生成AIの 回答や AIに よる 検索結果は、 クローラが 集めた ページを 解釈し、 意味を 構造と して 理解した上で 引用元を 選びます。 その ため、 構造化データ (=ページの 意味を 機械可読な形で 明示する 記述)、 llms.txt (=AIに 読ませたい 情報を 案内する ファイル)、 サイトマップ、 インデックス性、 表示速度と いう 技術基盤を 整える ことが、 AIに 引用・ 参照される 確率を 底上げする 近道に なると 考えられます。 本稿は この 5つを、 Web・マーケ担当が すぐ 着手できる 粒度で 解説します。
AI検索の 裏側では、 クローラ (=Webを 巡回して ページを 取得する 自動プログラム)が HTMLを 取得し、 その 内容を 解釈して 「何に ついて 書かれた ページか」を 判断します。 人間なら 見出しや 文脈で 自然に 読み取れる ことも、 機械に とっては 曖昧です。 ここで 技術基盤が 働きます。 ページの 意味を 機械可読な形で 明示し、 巡回しやすく 整え、 速く 安定して 表示できるように する ほど、 AI側は 正確に 理解し、 引用元と して 採用しや すくなると みられます。
テクニカルSEO (=サイトの 技術的な 土台を 最適化する 取り組み)は、 従来の 検索エンジン対策と AI検索対策で 共通する 部分が 大きいのが 実務上の 利点です。 クロール (巡回) ・インデックス (索引登録) ・レンダリング (表示処理)と いう 基本の 流れは 同じで、 そこに AI向けの 案内 (llms.txtや 構造化データの 強化)を 上乗せする 形に なります。 つまり 既存の SEO資産を 捨てずに 拡張できます。
図1:クローラが 取得した ページを 解釈し、 引用元と して 選ぶまでの 基本ステップ。
拡大図1:クローラが取得したページを解釈し、引用元として選ぶまでの基本ステップ。
閉じる 出所:GMO AI検索ラボ 構造化データは、 ページの 内容を 「これは 会社名」 「これは 価格」 「これは 著者」と 機械に 明示する ための 記述です。 語彙 (=意味の 共通辞書)には schema.org (スキーマドットオルグ=主要検索企業が 共同運営する 構造化データの 標準規格)を 使い、 記述形式には JSON-LD (ジェイソン・エルディー=ページ本文と 分離して scriptタグに 埋め込む方 式)を 使うのが 標準的です。 本文の 見た 目を 変えずに 意味情報だけを 足せる ため、 実装と 保守が しやすいのが 利点です。
どの 型 (Type=schema.orgが 定める カテゴリ)を 使うかは ページの 役割で 決めます。 企業サイトなら Organization (組織)、 記事なら Article、 商品なら Product、 よく ある 質問なら FAQPage、 パンくずなら BreadcrumbListが 基本です。 重要なのは、 構造化データに 書く 内容と ページに 実際に 表示されている 内容を 一致させる ことです。 表示していない 情報を 構造化データにだけ書くと、 ガイドライン違反と して 扱われる 場合が あります。
図2:意味を 明示する 記述は 「語彙・形式・型」の 三層で 成り 立つ。
拡大図2:意味を明示する記述は「語彙・形式・型」の三層で成り立つ。
閉じる 出所:GMO AI検索ラボ llms.txt (エルエルエムズ・ドットテキスト)は、 サイトの ルート (=トップ階層)に 置く テキストファイルで、 AIに 優先的に 読んで ほしい ページや 要点を 案内する 目的の 提案仕様です。 人間向けの ナビゲーションとは 別に、 AIが 要点を 効率よく 把握できる 「案内板」を 用意する 発想です。 まだ 広く 確立した 標準ではなく 提案段階の 取り組みですが、 主要ページへの リンクと 簡潔な 説明を まとめて おく 実装コストは 低く、 先行して 整える 価値が あります。
混同しやすいファイルとの 違いを 押さえて おきます。 robots.txt (ロボッツ・ドットテキスト)は クローラの 巡回可否を 指示する ファイル、 サイトマップは 全ページの 一覧を クローラに 渡すファイル、 llms.txtは AIに 読ませたい 要点を 案内する ファイルです。 役割が 異なる ため、 どれか 一つで 代替は できません。 三者を 併用して、 巡回・網羅・要点案内を 分担させるのが 筋の 良い 設計です。
図3:AI向けの 案内ファイルを 整備する 基本的な 流れ。
拡大図3:AI向けの案内ファイルを整備する基本的な流れ。
閉じる 出所:GMO AI検索ラボ どれだけ良い ページを 作っても、 クローラに 存在を 知られず 索引に 登録されなければ AIの 参照対象に なりません。 ここで 役に 立つのが サイトマップ (=サイト内の 全U RLと 更新日を まとめて クローラに 渡すXMLファイル)です。 特に 新規ページや 深い 階層の ページは 自然な 巡回で 見つかりにく いため、 サイトマップで 明示的に 知らせる ことで 発見漏れを 減らせるでしょう。
インデックス性 (=ページが 索引に 登録されうる 状態か)も 点検が 要ります。 noindex (=索引に 登録しないようクローラへ 指示する タグ)が 誤って 残っていないか、 robots.txtで 重要ページの 巡回を 意図せず 塞いでいないか、 正規化タグ (canonical=重複ページの 代表URLを 示すタグ)が 正しい 先を 指しているかを 確認します。 これらの 設定ミスは 「作ったのに 一切参照されない」と いう 事態を 静かに 招く 可能性が ある ため、 公開前後の 定番チェック項目にして おきたい ところです。
図4:発見・許可・重複整理の 三層で インデックス漏れを 防ぐ。
拡大図4:発見・許可・重複整理の三層でインデックス漏れを防ぐ。
閉じる 出所:GMO AI検索ラボ 表示速度と 描画方 式は、 クローラが ページ内容を 最後まで 取得できるかに 直結します。 読み込みが 遅い、 あるいは 重要な本文が JavaScript (=ブラウザ上で 動く 処理を 記述する 言語) 実行後に しか 現れない 構成だと、 クローラが 本文を 取りこぼす 恐れが あります。 Core Web Vitals (コア・ウェブ・ バイタルズ=Googleが 定める 表示体感の 指標群)を 目安に、 読み込みや 操作応答の 遅さを 潰しておく ことが、 人間の 使い勝手と AIの 読み取りやすさの 両方に つながります。
描画方 式では、 本文が 最初の HTMLに 含まれる 形 (サーバー側で 描画してから 返す方 式)が 読み取り上は 安全です。 クライアント側で JavaScriptを 実行して 初めて 本文が 出る 構成に 依存すると、 レンダリングの 成否や 重さ次第で 本文が 拾われない 場合が あります。 重要な本文・ 見出し・構造化データは、 JavaScript実行を 待たずに 取得できる 状態に しておくのが 堅実です。
図5:速度と 描画方 式を 整え、 本文を 確実に 読み取らせる 手順。
拡大図5:速度と描画方式を整え、本文を確実に読み取らせる手順。
閉じる 出所:GMO AI検索ラボ AI検索対策で 役割の 異なる 3つの ファイルの 整理。 ファイル 主な 役割 AIに 対する 働き robots.txt クローラの 巡回可否を 指示する 読ませたくない 範囲を 伝える サイトマップ 全ページの URLを 一覧で 渡す 存在を 漏れなく 知らせる llms.txt 読ませたい 要点を 案内する 重要情報へ 効率よく 導く
横にスクロールできます
当ラボの 定点観測では、 引用先5,783ドメインの うち45.3%に あたる 2,619件が、 期間中に 1回しか 引用されていません。 一方、 12日間の 観測で 引用され 続けた 283件は、 引用 延べ件数の 63.8%を 占めていました。 一度きりで 消えた 1,871件が 占める 割合は 4.8%です。
図6:クローラが 取得した ページを 解釈し、 引用元と して 選ぶまでの 基本ステップ。
拡大図6:クローラが取得したページを解釈し、引用元として選ぶまでの基本ステップ。
閉じる 出所:GMO AI検索ラボ 繰り返し引用される 側に 回るには、 まず 機械が 問題なく 読み取れる 状態に ある ことが 前提に なると みられます。 文章の 出来を 上げる 前に、 土台の ほうで 落ちていないかを 確かめて おくと よいでしょう。
構造化データを 入れれば 必ず AIに 引用されますか。 いいえ。 構造化データは 意味を 正しく 伝えて 理解されやすく する 土台であり、 引用を 保証する 仕組みでは ありません。 表示内容との 一致や本文の 質と 組み合わせて 初めて 効果が 出ます。
llms.txtは 今すぐ 用意すべきですか。 広く 確立した 標準ではなく 提案段階の 取り組みですが、 実装コストは 低く 害も ありません。 重要ページと 要点を 案内する ファイルを 先行して 置いておく 価値は 十分あります。
従来の SEO対策と AI検索対策は 別物ですか。 基盤は 共通です。 クロール・インデックス・ 表示速度と いった 技術基盤は 同じで、 そこに 構造化データの 強化や llms.txtと いった AI向けの 案内を 上乗せする 形に なります。 既存の SEO資産を 活かせます。
JavaScriptで 本文を 出す構成は 避けるべきですか。 重要な本文・ 見出し・構造化データは、 JavaScript実行を 待たずに 取得できる 状態に しておくのが 安全です。 実行後に しか本文が 現れない 構成は、 クローラが 取りこぼす 可能性が あります。