業界基準への自己評価
業界の計測基準に、どこまで対応できているか。
IAB Tech Labの基準「Measuring Visibility in the AI Era」に、Geo Index がどこまで対応しているかを自己評価しました。対応していない項目も、そのまま載せています。
無料プランで、1つの質問をChatGPT・Claude・Geminiに送って計測できます。カード登録は要りません。

業界基準への自己評価
IAB Tech Labの基準「Measuring Visibility in the AI Era」に、Geo Index がどこまで対応しているかを自己評価しました。対応していない項目も、そのまま載せています。
無料プランで、1つの質問をChatGPT・Claude・Geminiに送って計測できます。カード登録は要りません。

3行でいうと
業界団体IABの基準が求める項目に、当社自身が「対応済み・一部対応・未対応」の3段階で評価しました。
求められる項目8つのうち、対応済みは2つ、一部対応は5つ、未対応は1つです。
第三者の審査は受けていません。いまの計測は、傾向をつかむ水準にあたると考えています。
求められる項目(8項目)
判断に使える水準の基準(9項目)
基準の概要
AIの回答での見え方を4つの観点でとらえ、計測の厳しさを2段階に分ける考え方です。
AIの回答に、そのブランドやサイトが出てくるかどうかです。
回答の中で、どれだけ目立つ位置・扱いで出てくるか。
どのような文脈・論調で語られているか。
その語られ方が、読み手のその後の行動にどう影響するか。
増減の向きや、おおよその位置づけをつかむための水準です。
予算配分などの判断に使う水準です。何回くり返し測ったか、結果がどれだけぶれるかを、より厳しく示すことが求められます。
自己評価
対応済み・一部対応・未対応の3段階で、当社が自ら評価した結果です。対応していない項目もそのまま掲載しています。
| 求められる項目 | 自己評価 | 内容 |
|---|---|---|
| モデル名の表示 | 対応済み | すべての計測値に、実行したモデル名と取得時刻を表示します。どのモデルのいつの回答なのかを、あとから確認できます。 |
| くり返し測ったときのぶれの説明 | 一部対応 | 同じプロンプトをくり返し計測したときの結果のぶれは、回数(例: 8回中3回)と幅の両方で示します。この方針を公開しています。8回のくり返し計測では、計画・完了・失敗した回数もあわせて表示します。 |
| Presence(回答に出るか) | 対応済み | AIの回答に、対象ブランド・対象サイトの引用や言及があるかを検出します。引用と言及は区別して数えます。 |
| Prominence(回答内での目立ち方) | 一部対応 | 回答の中でどれだけ目立つ位置に出たかも集計しています。5つの見え方の3つ目「回答のどこに出たか」(卓越性)にあたります。ただし、位置の意味はAIごとに違います。位置と引用のされ方の関係も、まだ確かめられていません。そのため、傾向をつかむ参考値(Directional)として扱います。 |
| Portrayal(どう語られているか) | 一部対応 | AIの回答が自社をどのような文脈・論調で語っているかを、肯定的・中立・否定的に分類します。いまは論調の傾向をつかむまでで、語られ方の細かい評価はまだできていません。 |
| Persuasion(行動への影響) | 未対応 | 回答を読んだ人の行動の変化や、問い合わせ・申し込み(コンバージョン)への影響は計測していません。対応していない項目として、そのまま掲載します。 |
| 結果の幅(信頼区間)の扱い | 一部対応 | 結果のぶれ幅を示すことは、基準で求められています。ただし、何回くり返せば十分かの目安は示されていません。そのため当社は、幅(下限%〜上限%)と回数を必ず並べて表示します。精度が高いように見える書き方はしません。 |
| 計測水準の2段階(Directional / Decision-grade) | 一部対応 | 現時点の当社の計測は、傾向をつかむ水準(Directional)にあたると自己評価しています。判断に使える水準(Decision-grade)を満たしているとは考えていません。 |
判断に使える水準
予算配分などの判断に使える水準として、9つの基準が定められています。基準ごとに、求められる内容と当社の現状を並べます。判定は上の表と同じ3段階です。対応できていない基準もそのまま載せています。
| 基準 | 自己評価 | 求められる内容(要旨) | 当社の現状 |
|---|---|---|---|
| くり返し回数 | 一部対応 | 求められる内容(要旨)結果が安定する回数まで回答を集め、1つのプロンプトあたりの回答数と、ばらつきの判定方法を公開します。 | 当社の現状同じプロンプトを8回くり返す「くり返し計測」と、最大2回の「広さ優先の計測」の2種類を公開し、提供しています。レポートには、予定・完了・失敗した回数を表示します。あわせて、結果の幅(Wilson の95%区間)と直近7日の変動幅も表示します。 |
| プロンプト数 | 一部対応 | 求められる内容(要旨)幅広いプロンプトを用意し、総数・分類ごとの内訳・質問の形式を公開します。50件未満の計測は「探索的」区分として扱われます。 | 当社の現状プロンプトはお客様が決めます。組み合わせがあとから変わっていないことを確かめられる形で記録します。無料プラン(プロンプト1件)は探索的区分にあたります。 |
| プロンプトの種類 | 未対応 | 求められる内容(要旨)4つの目的(情報収集・比較・おすすめ・購入)のプロンプトをそろえ、目的ごとに結果を表示します。 | 当社の現状プロンプトを目的ごとに分類し、目的別に集計して表示する機能は、まだ実装していません。 |
| 計測の頻度 | 一部対応 | 求められる内容(要旨)週1回以上の頻度で計測します。 | 当社の現状予約実行を使えば、週1回以上の計測を設定できます。実際の頻度はお客様の設定によります。 |
| 同じ結果が出るか(再現性) | 対応済み | 求められる内容(要旨)7日間で許される変動幅を決め、信頼水準を報告し、ばらつきの確認手順を公開します。 | 当社の現状直近7日の変動幅(最小%〜最大%)と、その7日分をまとめた結果の幅(Wilson の95%区間)を表示します。計算方法も公開しています。当社が独自に決めた合格ラインは設けません。 |
| データの検証 | 一部対応 | 求められる内容(要旨)外部データとの突き合わせ・外れ値の扱い・会社名の表記ゆれの扱い・比較の基準・分かっている限界を、すべて公開します。 | 当社の現状どの数値も計測の記録番号からたどって計算し直せます。データが足りないときは、数値欄を「—」と表示し「データ不足」と添えます。ゼロとして数えることはしません。各AI提供元の公式データなど、外部データとの照合はしていません。 |
| 計測方法の公開 | 対応済み | 求められる内容(要旨)プロンプトの選び方・回答から数値にする手順・AIごとの扱い・まとめ方を、すべて公開します。 | 当社の現状指標の定義とぶれ幅の計算方法を公開しています。AIクローラーごとにサイトへアクセスできているかの確認方法も公開しています。複数のAIをひとつにまとめた総合点は出しません。 |
| 対象のAIの範囲 | 一部対応 | 求められる内容(要旨)対象の市場でAIの利用の過半を占める範囲をカバーし、重み付けと市場シェアの根拠を公開します。 | 当社の現状OpenAI・Anthropic・Googleの3社を、モデル名を明示して計測しています。市場シェアによる重み付けはしておらず、シェアの根拠も公開していません。 |
| 複数のAIのまとめ方 | 対応済み | 求められる内容(要旨)AIごとに分けて表示し、AI間の違いを示し、重み付けを公開します。 | 当社の現状AIごとに分けて表示し、ひとつにまとめた総合点は出しません(そのため重み付けもありません)。 |
まだ決まっていないこと
基準の中で未解決のもの、扱う範囲の外のもの、まだ用意されていないものを分けて書きます。いずれも当社の現時点の考え方です。
基準側の状況: 基準の中でも未解決の論点とされていて、何回くり返せば十分かの数値は示されていません。
Geo Index の考え方: 当社は標準として、同じプロンプトを8回くり返す方法を公開し、提供しています。くり返しの回数は、結果のぶれを示すためのものです。精度を左右するプロンプトの数とは別の話です。
基準側の状況: この基準が扱う範囲の外です。
Geo Index の考え方: 当社は robots.txt の記述を確認したうえで、各AIクローラーと同じ名前を名乗って実際にアクセスを試します。セキュリティ画面・アクセス拒否・応答なしで、AIクローラーが誤って止められていないかを調べます。robots.txt では許可していても実際には届いていない状態は、記述の確認とは分けて表示します。
基準側の状況: 地域ごとの標準の計測条件は用意されておらず、日本語圏を前提とした条件も示されていません。
Geo Index の考え方: 当社は、日本語・日本市場向けの計測条件をまとめています。研究(arXiv:2410.01171)では、質問の言語によってAIが参照する資料が変わる傾向が報告されています。日本語での引用のされ方は、英語と同じとは考えません。
注意事項
求められる内容(要旨)は、IAB「Measuring Visibility in the AI Era」(2026年8月公開)にある基準一覧(Criteria Matrix)を、当社が要約したものです。判定は当社の自己評価であり、IABによる評価・認証を受けたものではありません。
無料プランは「お試し(探索的)」区分です。業界の基準では、プロンプトが50件未満の計測は探索的(exploratory)な区分として扱われます。無料プラン(1週間に15クレジット・3つのAIで計測)はこの区分にあたります。傾向をつかみ、使い心地を試すためのもので、予算配分などの判断に使う設計ではありません。
関連する資料