AI 可視性の算出方法
このページでは、実際のプログラムの計算方法どおりに、GEO by TriloAI のレポートの数字がどう出ているかを説明します。レポートには意味の異なる 3 種類の数字があります。言及率、AI 可視性スコア、GEO スコアです。
まず 3 種類の数字を区別する
言及率
AI の回答のうち、何割がブランドに言及したか。最も直接的で、自分でも数えられる数字です。95% の区間を付けます。
AI 可視性スコア
言及の有無に加えて、推薦されたか、何位かも見て、プラットフォームごとに重み付けした 0〜100 点のスコアです。
GEO スコア
6 項目を加重した総合スコアで、大半はサイトとウェブ上のブランド情報で決まります。AI が実際に言及したかは 10% だけです。
何を聞くか:最大 15 問、7 つの購買意図
- ブランドの業種、サービス、市場に合わせて、購買を考える人が AI に聞く質問を最大 15 問作ります。内訳は推薦 3 問と、比較・懸念・ロングテール・地域・価格・乗り換えが各 2 問です。
- 重複や不適切な質問を除いた実際の質問数をレポートに記載します。多くは 13〜15 問です。新規分析のウィザードでは、質問を編集したり、独自の質問を貼り付けたりできます。ご自身の質問が 10 問以上ある場合は、先頭の 15 問をそのまま使います。10 問に満たない場合は、7 つの質問タイプの配分に沿ってシステムが質問を補い、最大 15 問にします。補うときはタイプごとに上限があるため、上限を超えたり、タイプを判定できなかったりしたご自身の質問は使われないことがあります。システムが作った質問がチェックを通らない場合は差し替えます。
- 質問はその市場の言語で尋ねます。たとえば日本は日本語、台湾は繁体字中国語です。
- システムが作る質問にはブランド名を入れず、ブランド名そのもので可視性が高く出すぎないようにしています。ご自身で貼り付けたカスタム質問はそのまま使うため、ブランド名を含む質問はスコアを押し上げます。
誰に聞くか:5 つの AI プラットフォーム(中国市場は 3 つ)
- 台湾、米国、日本、韓国、グローバル:ChatGPT、Gemini、Perplexity、Google の AI による概要(AI Overviews)、Claude の 5 つの AI プラットフォーム。
- 中国:DeepSeek、Kimi、通義千問(Qwen)。この 3 つは OpenRouter 経由でモデルを呼び出すため、ウェブ検索なしでモデルそのものを測ることになり、ブランドを少なく見積もる場合があります。
- Google の AI による概要の結果は 3 種類です。概要を取得できた、Google がその質問にもともと概要を表示しない、技術的な失敗。スコアに入るのは概要を取得できたものだけで、技術的な失敗が 20% を超えると、レポートにデータ不完全と表示します。
- あるプラットフォームへの照会が失敗した場合は、ChatGPT が代わりに回答します。この代替結果は、元のプラットフォームのスコアには入りません。Claude が失敗した場合は代わりの回答を使わず、その質問には Claude の回答がないものとして扱います。
- 今回 Claude に照会できなかった場合(サービスの一時停止中など)、そのレポートはほかの 4 つのプラットフォームで採点し、Claude を含めていないことをレポートに記載します。Claude を含むレポートとはプラットフォームの組み合わせが異なるため、スコアをそのまま比べることはできません。
言及率と 95% の区間
言及率 = ブランドに言及した回答数 ÷ 有効な回答数
- 各質問の各プラットフォームでの回答を 1 件と数えます。1 つの回答で何度言及されても 1 回です。
- 区間は 2 つの方法で計算します。Wilson 区間と、「質問を再抽出し、さらに各回答を再抽出する」2 段階のリサンプリング(固定の乱数シード、1,000 回)です。最終的な区間は両方を含むように、下限は低いほう、上限は高いほうを取ります。質問が少ないほど区間は広くなります。
- 言及率は 50% 以上、20〜50%、20% 未満の 3 段階に分けます。区間が複数の段階にまたがる場合は「要確認」と表示します。もう一度測ると別の段階になる可能性がある、という意味です。
AI 可視性スコア:回答ごとの採点とプラットフォームの重み
AI 可視性スコア = Σ(各プラットフォームの得点 × 重み)÷ Σ(各プラットフォームの有効回答数 × 5.5 × 重み)× 100
- 回答ごとの点数:言及 +1、推薦 +2、順位 1 位 +2・2 位 +1.5・3 位 +1・4 位 +0.5・5 位 +0.3、ブランドについての記述が 30 文字以上あれば +0.5。1 回答の上限は 5.5 点です。
- 否定的な言及(AI が避けるよう勧めている場合など)は、「言及」と記述の点数だけを数え、推薦と順位の点数は付けません。
- 再質問した回答は、点数にさらに出現率を掛けます(次のセクションを参照)。
- プラットフォームの重み:Google の AI による概要 1.5、ChatGPT・Gemini・Perplexity は各 1.0、Claude は 0.6。日本と韓国の市場では ChatGPT 1.2、Perplexity 0.8 で、Claude は同じく 0.6。中国市場は DeepSeek 1.0、Kimi 1.2、通義千問 0.8 です。
もう一度聞いてランダム性を抑える
- ブランドに言及した回答は ChatGPT、Gemini、Perplexity、Claude でもう一度質問し、競合だけに言及した回答も最大 15 件を再確認します。1 レポートあたりの再質問は最大 30 件です。
- 1 回目に出てきて再質問で出てこなかったブランドは、その回答の点数を半分にします。再質問でだけ出てきたブランドは追加しません。
- Google の AI による概要は再質問しません。分析時間が足りない場合、この手順は省略します。
- 当社の実測では、同じブランド・同じ 14 問を 2026年9月27日に 2 回聞いたところ、言及率は 31.5% と 41.7% でした。前後比較は同じ質問セットで行い、スコアの差だけでなく、区間が重なるかを確認してください。
GEO スコア:6 項目の加重
GEO スコアは、AI がブランドを見つけ、理解し、引用しやすいかを見るもので、大半はサイトとウェブ上のブランド情報で決まります
項目
重み
見ている内容
引用されやすさ
25%
サイトの文章を AI がそのまま引用しやすいか:長さ、単独で意味が通じるか、事実とデータ、構造、裏付けの引用、読みやすさ。
ブランド権威
20%
YouTube、Reddit、Wikipedia、Wikidata、LinkedIn などの公開プラットフォームで、ブランド情報がどれだけ見つかるか。重みは市場と業態に合わせて調整し、一部の市場の店舗型ビジネスは Google ビジネスプロフィールも確認します。
コンテンツ信頼性
20%
E-E-A-T のチェック:経験、専門性、権威性、信頼性のシグナル。
テクニカル SEO
15%
メタタグ、構造化データ、AI クローラーのアクセス可否、見出し構造、サイトマップ、画像の代替テキスト、llms.txt、内部リンクなどの技術チェック。
AI 可視性
10%
上で説明した AI 可視性スコア。
プラットフォーム対応
10%
AI エージェントがサイトを読み取り、操作できるか(WebMCP と AI 探索に関するチェック)。
評価:80 点以上 A、60 点以上 B、40 点以上 C、20 点以上 D、それ以外は F。
つまり GEO スコアが高くても、AI に必ず推薦されるわけではありません。AI に言及・推薦されているかは、言及率と AI 可視性スコアで確認してください。
llms.txt について:AI ツール向けのサイト案内ファイルで、ランキング要因ではありません。Google も、AI 検索機能に表示されるためにこうした特別なファイルは必要ないと説明しています(Google 検索セントラル、2026年10月2日確認)。当社は技術チェックの小さな 1 項目として扱っています。
既知の限界
- AI の回答は変わります。1 つのレポートはその時点のスナップショットで、後で同じ結果になるとは限りません。
- 1 レポート最大 15 問、各回答は 1〜2 回の質問なので、サンプルは大きくありません。方向性や明らかな差を見るのに向いており、1〜2 ポイントの変化を見るのには向きません。
- ブランド名は自動認識と同名の統合で判定します。AI が別の名前で呼んでいる場合(社名だけなど)は、分析設定で別名を登録しないと数えられません。
- 言及の多い上位 40 の競合はウェブ検索でリアルタイムに確認し、実在を確認できないものは除外しますが、誤判定の可能性は残ります。検索サービスが一時的に使えない場合はこの手順を省略し、レポートにその旨を記載します。
- 中国市場は、ウェブ検索なしでモデルそのものを測っています。
- ブランドページから再追跡すると、前回と質問が変わる場合があります。前後比較をするときは、新規分析で同じカスタム質問を貼り付けてください。