km.idaeo.ai · IDAEO 知識庫

🏛 本記事はテーマ館「ai」の所蔵です

AIに尋ねる言語が、引用される出典の言語を決める——私たちが実測で確かめました

自作の引用プローブで実測しました。AIは英語の質問には英語サイトを、日本語の質問には日本語サイトを引用し、当方の中国語サイトの被引用は 0 回でした。質問の言語が出典の言語を決めます。多言語版は加点ではなく、入場券です。

感覚では答えたくなかった問い

あなたは中国語でとても良い記事を書きました。内容は堅実で、資料も揃っています。ここで、英語を話す誰かが同じテーマをAIに尋ねたとします。AIの回答に、あなたのサイトは現れるでしょうか。

この問いに感覚で答えたくなかったので、私たちは実験をしました。

実験の方法

私たちは引用プローブを自作しました。やり方は単純です。同じ質問セットを、言語を変えてAIに尋ね、回答末尾の引用リストにどのサイトが現れたかを記録します。「引用された」とは、URLがそのリストに載ったこと。載らなければ、引用されていない。曖昧さの入る余地はありません。

プラットフォームは 2 つ、Perplexity sonar と Gemini grounding です。この 2 つを選んだのは、どちらも出典を素直に列挙してくれるので、一つずつ突き合わせて確認できるからです。この回のプローブは 2026-08-07 に実行しました。

結果:言語は言語ごとに

結果は、痛いほど綺麗に分かれました。

日本語の質問の引用元は、日本語サイトでした:clabel.co.jp、note.com、prtimes.jp。英語の質問の引用元は、英語メディアでした:LinkedIn、Reuters、JapanToday、tradingeconomics、cnbc、cambridge.org。

そして私たち自身のサイトは、0 回。順位が低かったのではなく、そもそも土俵に上がっていませんでした。

なぜこうなるのか

AIを、客の注文を取るウェイターだと考えてみてください。客が英語を話せば、ウェイターは英語のメニューだけを開きます。客が日本語を話せば、日本語のメニューだけ。あなたの店が中国語のメニューしか刷っていなければ、料理がどれほど良くても、英語を話す客には何があるのか伝わりません。

ウェイターはあなたを嫌っているわけではありません。客の言語に合わせて動いているだけです。これは手順であって、狙い撃ちではありません。

注目したいのは、これが「読めない」問題には見えないことです。AIは中国語を読めますし、翻訳もできます。それでも外から観測できる行動パターンは安定しています。回答が何語なら、引用元もその言語。プラットフォーム内部の仕組みは見えませんし、推測もしません。作り手にとって、原因が何かは実はそれほど重要ではありません——重要なのは、このパターンが安定して現れることです。その言語の版がなければ、リストに載らない。

AIは質問の言語と同じ言語の出典を選びます。中国語のコンテンツは、英語の回答の中でほぼ不可視です。

クロールされることと、引用されることは別

「うちのサイトは毎日AIクローラーが来ているから、露出には困っていないはず」と言う人もいるでしょう。

クロールと引用は別の話です。前作「AIクローラーは声量、売上ではない」で五か月分の帳簿を付けました。AIクローラーの持ち出しは約3,000万回、AIの紹介で戻ってきた人間はわずか476回(可視下限)でした。出典:https://km.idaeo.ai/ai/ai-crawler-shop-ledger

クロールは在庫の持ち出し、引用は料理の提供です。倉庫から在庫が運び出されても、あなたの料理が食卓に並ぶとは限りません——客の話す言語が、あなたのメニューと合っていなければ、なおさらです。

もう一つの対照があります。前作で自サイトのトラフィックの言語構成を測りました——英語 74.7%、日本語 22.0%、中国語 3.3%。出典:https://km.idaeo.ai/ai/visibility-lesson-1

世界から私たちへの質問の多くは、中国語では起きていません。コンテンツが中国語だけというのは、大半の扉を先に閉めているのと同じです。

私たちのやり方:同文四言語

つまり結論は「中国語をもっと上手く書く」ではなく、「同じ記事を、他の言語でも持つ」です。

本サイトのやり方は同文四言語です。zh-Hant は素のパスを canonical にし、zh-Hans・en・ja は ?lang= の変種で持ち、sitemap 内で hreflang を相互参照させています。

メニューの比喩で言えば、同じ一冊のメニューを、客が読めるすべての言語で刷り、どの一冊の裏表紙にも「当店には他にこれらの言語版があります」と記しておくことです。canonical はどれが正本かをはっきりさせ、hreflang は各版がお互いを身内だと認識できるようにします。この相互参照がないと、検索側は各言語版を無関係なページとして扱うかもしれず、同文にした労力が無駄になります。

要は「同文」です。言語ごとに別々の記事を書くのではなく、同じ内容の言語違いの版を持つこと。そうすれば、AIがどの言語で探しても同じものにたどり着き、それらが同じものだと分かります。

多言語版は加点ではなく、入場券です。その言語の版がなければ、選ばれる資格すらありません。

限界を先に述べます

この実験のサンプルは小さいものです。その尺度で読んでください。

  • プラットフォームは 2 つだけ:Perplexity sonar と Gemini grounding。他のAIプラットフォームは未検証です。
  • 質問数は少なめです。別の質問セットでは、結果が変わる可能性を否定できません。
  • サイトは n=1:測ったのは自分たちのサイトだけです。あなたのサイト、あなたのテーマでは、結果が違うかもしれません。
  • 自前の観測は 2026-08-10 07:52 UTC に稼働したばかりで、サンプルはまだ若いです。

私たちが言い切れるのは方向性の結論だけです。質問の言語が、引用される出典の言語を決める。数字は一回の観測として扱ってください。法則ではありません。

あなたにできること

  • 最も重要なコンテンツを選び、対象読者の言語の版があるかを確認してください。全サイトを一度にやる必要はありません。最もよく聞かれるテーマから始めましょう。
  • すでに多言語版がある場合は、canonical と hreflang が相互参照になっているかを確認し、各言語版が無関係なページとして扱われないようにしてください。
  • 対象言語であなたのテーマをAIに尋ね、引用リストに自分がいるかをご自身の目で確かめてください。いなければ、入場券はまだ買えていません。
  • 入場券を買った後も、しばらくしてからもう一度尋ねてください。引用は一度で決まる名簿ではなく、継続して見張る価値があります。

FAQ

AIが英語の質問に答えるとき、なぜ中国語の出典を引用しないのですか?
実測では、AIは質問の言語と同じ言語の出典を選ぶ傾向がありました。英語の質問の引用リストは英語メディア(LinkedIn、Reuters、JapanToday、tradingeconomics、cnbc、cambridge.org)、日本語の質問の引用リストは日本語サイト(clabel.co.jp、note.com、prtimes.jp)でした。プラットフォーム内部の仕組みは公開されていないため、観測されたパターンのみを述べています。
AIが英語の質問に答えるとき、なぜ中国語の出典を引用しないのですか?実測では、AIは質問の言語と同じ言語の出典を選ぶ傾向がありました。英語の質問の引用リストは英語メディア(LinkedIn、Reuters、JapanToday、tradingeconomics、cnbc、cambridge.org)、日本語の質問の引用リストは日本語サイト(clabel.co.jp、note.com、prtimes.jp)でした。プラットフォーム内部の仕組みは公開されていないため、観測されたパターンのみを述べています。
When AI answers English questions, why doesn't it cite Chinese sources?Our tests show AI tends to pick sources in the language of the question. The citation list for our English questions was English media (LinkedIn, Reuters, JapanToday, tradingeconomics, cnbc, cambridge.org), and the list for our Japanese questions was Japanese sites (clabel.co.jp, note.com, prtimes.jp). The platforms' internal mechanisms are not public; we only describe the observed pattern.
うちのサイトはAIクローラーによく巡回されています。いずれ引用されるのではないですか?
クロールされたのは、内容が倉庫に入ったということ。引用されたのは、食卓に出されたということ。別の話です。前作の五か月の帳簿では、約3,000万回のクロールに対し、人間のクリックは476回だけ(可視下限)でした。出典:https://km.idaeo.ai/ai/ai-crawler-shop-ledger
うちのサイトはAIクローラーによく巡回されています。いずれ引用されるのではないですか?クロールされたのは、内容が倉庫に入ったということ。引用されたのは、食卓に出されたということ。別の話です。前作の五か月の帳簿では、約3,000万回のクロールに対し、人間のクリックは476回だけ(可視下限)でした。出典:https://km.idaeo.ai/ai/ai-crawler-shop-ledger
My site gets crawled by AI bots all the time — will it get cited sooner or later?Being crawled means your content entered the warehouse; being cited means it was served at the table. Two different things. Our earlier five-month ledger: roughly 30 million crawls bought only 476 human clicks (a visible lower bound). Source: https://km.idaeo.ai/ai/ai-crawler-shop-ledger
「同文四言語」とはどういう意味ですか?
同じ内容を複数の言語版として作ることで、言語ごとに別々の記事を書くことではありません。本サイトは zh-Hant の素のパスを canonical とし、zh-Hans・en・ja を ?lang= の変種で提供し、sitemap 内の hreflang で相互参照させています。
「同文四言語」とはどういう意味ですか?同じ内容を複数の言語版として作ることで、言語ごとに別々の記事を書くことではありません。本サイトは zh-Hant の素のパスを canonical とし、zh-Hans・en・ja を ?lang= の変種で提供し、sitemap 内の hreflang で相互参照させています。
What does "one text, four languages" mean?Making multiple language versions of the same content, rather than writing a different article per language. This site uses the bare zh-Hant path as canonical, serves zh-Hans, en, and ja as ?lang= variants, and cross-references them with hreflang in the sitemap.
機械翻訳をそのまま載せた版でも、入場券になりますか?
入場券の最低条件は「その言語版が存在し、取得できること」です。翻訳の品質が影響するのは、入場券を手にした後の競争です。本実験では翻訳品質が引用に与える影響を測っていないため、この点については結論を出しません。
機械翻訳をそのまま載せた版でも、入場券になりますか?入場券の最低条件は「その言語版が存在し、取得できること」です。翻訳の品質が影響するのは、入場券を手にした後の競争です。本実験では翻訳品質が引用に与える影響を測っていないため、この点については結論を出しません。
If I put up a straight machine translation, does that count as a ticket?The minimum condition for a ticket is that the language version exists and can be fetched. Translation quality affects how you compete after you hold the ticket. This experiment did not test how translation quality affects citation, so we draw no conclusion on that part.
hreflang の相互参照とは何ですか?なぜ重要なのですか?
sitemap やページ内で「これらのURLは同一内容の言語違いの版です」と宣言し、互いに相手を指し合うことです。相互参照がないと、検索側は各言語版を無関係なページとして扱うかもしれず、同文の効果が散ってしまいます。
hreflang の相互参照とは何ですか?なぜ重要なのですか?sitemap やページ内で「これらのURLは同一内容の言語違いの版です」と宣言し、互いに相手を指し合うことです。相互参照がないと、検索側は各言語版を無関係なページとして扱うかもしれず、同文の効果が散ってしまいます。
What is hreflang cross-referencing, and why does it matter?Declaring in the sitemap or in pages that "these URLs are language versions of the same content," with each version pointing at the others. Without the cross-references, the search side may treat the language versions as unrelated pages, and the effect of keeping one text dissipates.
この結論はすべてのサイトに当てはまりますか?
保守的に見てください。2 プラットフォーム、少ない質問数、n=1 のサイト——これは一回の方向性の観測であって、法則ではありません。ご自身のテーマと対象言語でプローブを実行し直してから、判断することをお勧めします。
この結論はすべてのサイトに当てはまりますか?保守的に見てください。2 プラットフォーム、少ない質問数、n=1 のサイト——これは一回の方向性の観測であって、法則ではありません。ご自身のテーマと対象言語でプローブを実行し直してから、判断することをお勧めします。
Can this conclusion be applied to every site?Please read it conservatively. Two platforms, few questions, an n=1 site — this is one directional observation, not a law. We recommend rerunning the probe with your own topics and target languages before deciding.

この記事を引用

TK Lin・《AIに尋ねる言語が、引用される出典の言語を決める——私たちが実測で確かめました》・IDAEO 知識庫・2026-08-11・https://km.idaeo.ai/ai/four-language-experiment

更新 2026-08-11T12:20:10.717Z · server-rendered · four-language · IDAEO 知識庫