この記事の要点
- 5 つの AI は、ウェブを検索して根拠を示すかどうか、どこの検索を使うかで性格が分かれます
- 同じ質問でも、AI によって名前が挙がる企業も順番も違います。1 つの AI の結果で全体を判断できません
- 企業が見るべきなのは「どの AI が優れているか」ではなく、「見込み客が使う AI で、自社がどう答えられているか」です
主要な生成 AI は、何が違うのですか?
違いがいちばん表れるのは、答えの材料をどこから持ってくるかです。各社の公開情報をもとに整理すると、次のとおりです。
| サービス | 提供元 | ウェブの検索 | 根拠の示し方 | 利用規模(各社の発表) |
|---|---|---|---|---|
| ChatGPT | OpenAI | 必要に応じて自動で検索。手動でも指定できる | 引用と「情報源」の一覧 | 週間 10 億人以上(2026 年 8 月) |
| Gemini | Google の検索を使って答えることがある | 回答に参照元を示すことがある | 月間 9 億人以上(2026 年 5 月) | |
| Claude | Anthropic | ウェブ検索に対応(全プラン) | 検索を使った回答には引用を付ける | — |
| Perplexity | Perplexity | 原則として毎回検索する | 答えと一緒に引用元を並べる | — |
| Copilot | Microsoft | Bing の検索を使う | 参照したサイトを引用として示す | — |
Google 検索の中の AI 機能(AI 概要・AI モード)は、対話型 AI とは別に使われています。AI 概要は月間 25 億人以上、AI モードは月間 10 億人以上の利用があると Google は発表しています(2026 年 5 月)。
同じ質問でも、AI によって答えは違いますか?
違います。当方は、同じ 25 問を 3 つの AI に 3 回ずつ投げて比べました。
| Gemini 2.5 Flash | Claude Sonnet 4.6 | GPT-4o mini | |
|---|---|---|---|
| 対象サービスの名前が挙がった割合(出現率) | 76.0% | 61.3% | 56.0% |
| 対象サービスが最初に勧められた割合(1 位率) | 6.7% | 10.7% | 17.3% |
いちばん名前が挙がる AI で、いちばん 1 位になりにくい、という逆転が起きていました。「AI で出ている」と言っても、どの AI の話かで意味が変わります。
この計測は、各社の AI を API で、ウェブ検索を使わない設定で呼び出したものです。各サービスのアプリや画面で、ウェブ検索を使って答える場合とは条件が違う点に注意してください。
使い分けるなら、どう選べばいいですか?
利用者として使う場合の目安は次のとおりです。
| やりたいこと | 向いている使い方 | 理由 |
|---|---|---|
| 最新の情報を、出典つきで調べたい | 検索をする AI(Perplexity、ChatGPT の検索、Google の AI モードなど) | 根拠のページを開いて確かめられる |
| 文章の下書き、要約、言い換え | どの対話型 AI でも | 検索の有無はあまり関係しない |
| Google の検索結果とあわせて見たい | Google の AI 概要・AI モード | 通常の検索と同じ画面で使える |
| 社内の資料やメールと組み合わせたい | 業務向けのプラン(各社) | 管理機能や、学習に使わない設定がある |
どの AI でも、答えが誤っていることはあります。OpenAI も、検索結果や引用は不完全だったり古かったりする場合があるので、引用元を開いて確かめるよう案内しています。
企業から見ると、どの AI を気にすればいいですか?
見込み客が実際に使っている AI です。業種や顧客層によって違うので、最初は幅広く測って差を見るのが確実です。
| 見ること | 理由 |
|---|---|
| 検索をする AI を最低 1 つ入れる | 根拠のサイトが分かり、打ち手の手がかりになる(検索しない AI からは、引用元を取得できない) |
| Google の AI 概要と AI モードは分けて見る | 同じ Google でも、表示される場面と仕組みが違う |
| AI ごとの結果を平均しない | 上の表のように、平均すると「どの AI で負けているか」が消える |
AI の型ごとに効く打ち手が違う点は ChatGPT・Gemini で LLMO の打ち手は違うのか に、各サービスの詳しい説明は ChatGPT 検索とは・Perplexity とは にまとめました。
| 主張 | 根拠の強さ | 根拠 |
|---|---|---|
| 同じ質問でも、AI によって名前が挙がる割合は大きく違う | ◎ 実証 | 当方の実測(1 分野・1 日) |
| どの AI でも、答えには誤りが含まれうる | ◎ 実証 | 各社の公式の案内 |
| ある AI で挙がる企業は、他の AI でも挙がる | ✕ 否定されつつある | 当方の実測で、出現率と 1 位率の並びが AI ごとに逆転 |
根拠の強さは、◎ 実証(当方の実測、または複数の独立した調査が同じ結論)/○ 有力/△ 仮説/✕ 否定されつつある、の 4 段階で示しています。
※ 各サービスの機能と利用規模は、記載した時点の各社の公開情報にもとづくもので、変更されることがあります。