GLOSSARY
Meta-ExternalAgent
Meta
Meta-ExternalAgent とは 何か
Meta-ExternalAgent は、
サイト側から
なぜ重要か (AI検索での 位置づけ)
AI検索の
仕組み (UA と robots.txt)
Meta-ExternalAgent は
Meta-ExternalAgent は、
| 項目 | 内容 |
|---|---|
| 所有者 | Meta |
| 3分類 | 学習・収集系 |
| UA文字列の | meta-externalagent/1.1 (+/documentation/sharing/webmasters/web-crawlers) / meta-externalagent/1.1 |
| robots.txt | 尊重する |
| AI検索での | 訓練・インデックス候補に |
- UA検知の
手が かり:アクセスログの UA文字列に 「meta-externalagent」を 含むかで 判別します (部 分 一致で 拾います)。 - robots.txtでの
拒否例:`User-agent: meta-externalagent` の 行に 続けて `Disallow: /` を 書くと 全体を 拒否できます。 一部だけ 拒否したいなら `/` を 対象パス (例 `/private/`)に 変えます。 - 反映までの
時間:robots.txt の 変更は 最長24時間キャッシュされる ため、 拒否を 書いた 直後に 来訪が 止まるとは 限りません。 - なりすまし対策:UA名は
詐称可能なので、 Meta が 公開する IPレンジ (=アクセス元IPアドレスの 範囲)や 逆引き (IPから ホスト名を 引く 照合)で 本物かを 確かめます。
具体例・ データ
実務上は、
| ボット | 目的 | robots.txt | AI検索での |
|---|---|---|---|
| Meta-ExternalAgent | 学習+インデックス | 尊重する | 訓練・索引候補。 |
| Meta-ExternalFetcher | ユーザー起点の | 無視する | ユーザー個別の |
| facebookexternalhit | リンク共有時の | 安全確 | 共有時の |
横にスクロールできます
なりすまし
よく ある 誤解・ 注意点
実務での 扱い方
- まず方
針を 決める :Meta の 学習・インデックスに 使われる ことを 「認知の 土台」と して 許すか、 「無断学習は 拒否」の 立場で 止めるか、 自社の 考えを 明確にします。 - robots.txt を
整える :拒否するなら `User-agent: meta-externalagent` に `Disallow:` を 書きます。 反映まで 最長24時間かかる ことを 前提に、 変更直後の 来訪継続で 慌てません。 - ログで
UAを 集計する :meta-externalagent の 来訪回数を、 meta-externalfetcher・facebookexternalhit や 他社ボットと 分けて 数え、 「学習系」と 「回答・共有系」を 混ぜない 集計にします。 - IPで
裏を 取る :多量アクセスや 不審な 挙動が あれば、 UA名だけで 判断せず 公式IPレンジ・逆引きと 照合し、 詐称を 除外します。 - 可視化は
別指標で 測る :AI検索での 引用露出は、 Meta-ExternalAgent の 数ではなく 回答出典の モニタリングで 評価します。
よく ある 質問 (FAQ)
Meta-ExternalAgent を ブロックすると Meta の AIに 全く 出なくなりますか?
いいえ。
robots.txt に 書けば すぐ 止まりますか?
すぐとは
Meta-ExternalAgent と facebookexternalhit は 同じですか?
別物です。
UAが meta-externalagent なら本物と 信じて よいですか?
いいえ。
関連する出典
この記事の根拠にした一次情報(=発表元がみずから出している資料)です。
関連用語
Meta-ExternalFetcher
めたえくすたーなるふぇっちゃーMeta(=Facebook・Instagram などを運営する企業)が、ユーザー操作を起点に個々のリンクをその場で取得する user-triggered フェッチャー。自動巡回ではないため robots.txt を無視する可能性があります。
FacebookBot
ふぇいすぶっくぼっとMeta(=Facebook・Instagram などを運営する企業)のボット。従来から文書化され、AI(音声認識)向けの訓練データ収集などに使われる学習・収集系。リンク共有プレビュー用の facebookexternalhit とは目的が別。
AIクローラー
えーあいくろーらー生成AI各社がWebページを自動取得するボットの総称。学習・収集系と回答・検索系に大別されます。
robots.txt
ろぼっつてきすとサイト直下に置き、クローラーに取得してよい範囲を伝える取り決めファイル。強制力はなく準拠は任意。
ユーザーエージェント
ゆーざーえーじぇんとHTTPリクエストでソフトが自己申告する名前。ブラウザとボットの見分けに使うが、詐称も可能。
AI検索
エーアイけんさく生成AIを使って答えを導く検索の総称。
生成AI
せいせいえーあい文章・画像・音声などを新しく作り出すAIの総称。AI検索とAIO対策の大前提。
