km.idaeo.ai · IDAEO 知識庫

🏛 本文屬於主題館「ai」

AI 用什麼語言提問,就引什麼語言的來源——我們實測給你看

自建引用探測實測:AI 答英文題引英文站、答日文題引日文站,我方中文站 0 次被引。提問語言決定引用來源的語言。多語版不是加分,是入場門票。

一個不想用感覺回答的問題

你用中文寫了一篇很好的文章。內容扎實、資料齊全。現在有個說英文的人,拿同一個主題去問 AI。AI 的回答裡,會出現你的網站嗎?

我們不想用感覺回答這題,所以做了一場實驗。

實驗怎麼做

我們自建了一套引用探測。做法很直接:拿同一批題目,換不同語言去問 AI,然後記錄答案末尾的引用清單裡,出現了哪些網站。所謂「被引」,就是網址出現在那份清單上;沒出現,就是沒被引,沒有模糊空間。

平台用兩個:Perplexity sonar 與 Gemini grounding。挑這兩個,是因為它們都會老老實實把來源列出來,可以逐條對帳。這一班探測跑在 2026-08-07。

結果:語言各歸各的

結果乾淨得刺眼。

日文題的引用來源,是日文站:clabel.co.jp、note.com、prtimes.jp。英文題的引用來源,是英文媒體:LinkedIn、Reuters、JapanToday、tradingeconomics、cnbc、cambridge.org。

而我們自己的站,0 次被引。不是排名靠後,是連場都沒進。

為什麼會這樣

把 AI 想成一個幫客人點菜的服務生。客人說英文,服務生就只翻英文菜單;客人說日文,就只翻日文菜單。你的店只印了中文菜單,菜做得再好,說英文的客人根本不會知道你有什麼菜。

服務生不是討厭你。它只是照著客人的語言辦事,這是流程,不是針對。

值得注意的是,這不太像「看不懂」的問題。AI 明明讀得懂中文,也會翻譯。但從外面觀測到的行為模式很穩定:答案是什麼語言,引用來源就是什麼語言。平台內部怎麼運作,我們看不到,也不猜。對創作者來說,原因是什麼其實不重要——重要的是這個模式穩定出現:你沒有那個語言的版本,你就不在清單上。

AI 按提問語言挑同語言來源。中文內容在英文答案裡,近乎隱形。

被爬過,不等於被引用

有人會說:我的網站天天被 AI 爬蟲光顧,應該不缺曝光吧?

被爬和被引是兩件事。我們在前作〈AI 爬蟲雜貨店帳本〉算過五個月的帳:AI 爬蟲來搬了 3,000 萬次,循 AI 介紹回來的真人只有 476 次(可見下限)。出處:https://km.idaeo.ai/ai/ai-crawler-shop-ledger

爬取是搬庫存,引用是上菜。庫存被搬走,不代表你的菜會被端上桌——尤其當客人講的語言,跟你的菜單對不上。

另一個對照:我們在前作量過自家流量的語言結構——英文 74.7%、日文 22.0%、中文 3.3%。出處:https://km.idaeo.ai/ai/visibility-lesson-1

世界對我們的提問,多數不是用中文發生的。內容只有中文,等於把大多數的門先關上。

我們的做法:同文四語

所以結論不是「中文要寫得更好」,而是「同一篇文,別的語言也要有」。

本站的做法是同文四語:zh-Hant 用裸路徑當 canonical;zh-Hans、en、ja 用 ?lang= 變體;sitemap 裡用 hreflang 互指。

用菜單的比喻說:同一份菜單,印成客人看得懂的每一種語言,而且每一本的封底都註明「本店還有這些語言的版本」。canonical 負責說清楚哪一本是正本,hreflang 負責讓各版本互相認親。少了這層互指,搜尋端可能把它們當成互不相干的頁面,同文的力氣就白費了。

重點在「同文」:不是各語言各寫各的,而是同一篇內容的不同語言版本。這樣 AI 不管用哪種語言找,都能找到同一份東西,也知道它們是同一份東西。

多語版不是加分題,是門票。沒有那個語言的版本,你連被挑選的資格都沒有。

限制,先講清楚

這場實驗的樣本很小,請按這個尺度理解:

  • 平台只有兩個:Perplexity sonar 與 Gemini grounding。其他 AI 平台未測。
  • 題數少。換一批題目,結果不排除有出入。
  • 站是 n=1:我們只測了自己的站。你的站、你的主題,結果可能不同。
  • 本站自建觀測 2026-08-10 07:52 UTC 才開機,樣本還很年輕。

我們敢下的只有方向性結論:提問語言決定引用來源的語言。數字請當作一次觀測,不是定律。

你可以做的事

  • 挑出你最重要的內容,檢查它有沒有目標讀者語言的版本。不必整站一次做完,從最常被問的主題開始。
  • 已有多語版的,檢查 canonical 與 hreflang 是否互指,別讓各語言版被當成不相干的頁面。
  • 用目標語言去問 AI 你的主題,親眼看引用清單裡有沒有你。沒有,就是門票還沒買。
  • 買了門票之後,隔一段時間再問一次。引用不是一次定生死的名單,值得持續盯。

FAQ

AI 回答英文問題時,為什麼不引用中文來源?
實測顯示 AI 傾向按提問語言挑同語言來源。我們的英文題引用清單是英文媒體(LinkedIn、Reuters、JapanToday、tradingeconomics、cnbc、cambridge.org),日文題引用清單是日文站(clabel.co.jp、note.com、prtimes.jp)。平台的內部機制未公開,我們只陳述觀測到的模式。
AIが英語の質問に答えるとき、なぜ中国語の出典を引用しないのですか?実測では、AIは質問の言語と同じ言語の出典を選ぶ傾向がありました。英語の質問の引用リストは英語メディア(LinkedIn、Reuters、JapanToday、tradingeconomics、cnbc、cambridge.org)、日本語の質問の引用リストは日本語サイト(clabel.co.jp、note.com、prtimes.jp)でした。プラットフォーム内部の仕組みは公開されていないため、観測されたパターンのみを述べています。
When AI answers English questions, why doesn't it cite Chinese sources?Our tests show AI tends to pick sources in the language of the question. The citation list for our English questions was English media (LinkedIn, Reuters, JapanToday, tradingeconomics, cnbc, cambridge.org), and the list for our Japanese questions was Japanese sites (clabel.co.jp, note.com, prtimes.jp). The platforms' internal mechanisms are not public; we only describe the observed pattern.
我的網站常被 AI 爬蟲爬,是不是遲早會被引用?
被爬是內容進了倉庫,被引是內容被端上桌,兩件事。前作五個月帳本:3,000 萬次爬取,只換到 476 次真人點擊(可見下限)。出處:https://km.idaeo.ai/ai/ai-crawler-shop-ledger
うちのサイトはAIクローラーによく巡回されています。いずれ引用されるのではないですか?クロールされたのは、内容が倉庫に入ったということ。引用されたのは、食卓に出されたということ。別の話です。前作の五か月の帳簿では、約3,000万回のクロールに対し、人間のクリックは476回だけ(可視下限)でした。出典:https://km.idaeo.ai/ai/ai-crawler-shop-ledger
My site gets crawled by AI bots all the time — will it get cited sooner or later?Being crawled means your content entered the warehouse; being cited means it was served at the table. Two different things. Our earlier five-month ledger: roughly 30 million crawls bought only 476 human clicks (a visible lower bound). Source: https://km.idaeo.ai/ai/ai-crawler-shop-ledger
「同文四語」是什麼意思?
同一篇內容做出多個語言版本,而不是各語言各寫不同的文章。本站以 zh-Hant 裸路徑為 canonical,zh-Hans、en、ja 走 ?lang= 變體,sitemap 內 hreflang 互指。
「同文四言語」とはどういう意味ですか?同じ内容を複数の言語版として作ることで、言語ごとに別々の記事を書くことではありません。本サイトは zh-Hant の素のパスを canonical とし、zh-Hans・en・ja を ?lang= の変種で提供し、sitemap 内の hreflang で相互参照させています。
What does "one text, four languages" mean?Making multiple language versions of the same content, rather than writing a different article per language. This site uses the bare zh-Hant path as canonical, serves zh-Hans, en, and ja as ?lang= variants, and cross-references them with hreflang in the sitemap.
用機器翻譯直接翻一版放上去,算有門票嗎?
門票的最低條件是「該語言版本存在、能被抓到」。翻譯品質影響的是拿到門票之後的競爭。本實驗沒有測翻譯品質對引用的影響,這部分不下結論。
機械翻訳をそのまま載せた版でも、入場券になりますか?入場券の最低条件は「その言語版が存在し、取得できること」です。翻訳の品質が影響するのは、入場券を手にした後の競争です。本実験では翻訳品質が引用に与える影響を測っていないため、この点については結論を出しません。
If I put up a straight machine translation, does that count as a ticket?The minimum condition for a ticket is that the language version exists and can be fetched. Translation quality affects how you compete after you hold the ticket. This experiment did not test how translation quality affects citation, so we draw no conclusion on that part.
hreflang 互指是什麼?為什麼重要?
在 sitemap 或頁面裡宣告「這幾個網址是同一內容的不同語言版」,而且彼此都指向對方。少了互指,搜尋端可能把各語言版當成無關頁面,同文的效果就散掉了。
hreflang の相互参照とは何ですか?なぜ重要なのですか?sitemap やページ内で「これらのURLは同一内容の言語違いの版です」と宣言し、互いに相手を指し合うことです。相互参照がないと、検索側は各言語版を無関係なページとして扱うかもしれず、同文の効果が散ってしまいます。
What is hreflang cross-referencing, and why does it matter?Declaring in the sitemap or in pages that "these URLs are language versions of the same content," with each version pointing at the others. Without the cross-references, the search side may treat the language versions as unrelated pages, and the effect of keeping one text dissipates.
這個結論可以套用到所有網站嗎?
請保守看待。兩平台、題數少、n=1 站,這是一次方向性觀測,不是定律。建議用你自己的主題與目標語言重跑一次探測,再做決定。
この結論はすべてのサイトに当てはまりますか?保守的に見てください。2 プラットフォーム、少ない質問数、n=1 のサイト——これは一回の方向性の観測であって、法則ではありません。ご自身のテーマと対象言語でプローブを実行し直してから、判断することをお勧めします。
Can this conclusion be applied to every site?Please read it conservatively. Two platforms, few questions, an n=1 site — this is one directional observation, not a law. We recommend rerunning the probe with your own topics and target languages before deciding.

引用本文

TK Lin・《AI 用什麼語言提問,就引什麼語言的來源——我們實測給你看》・IDAEO 知識庫・2026-08-11・https://km.idaeo.ai/ai/four-language-experiment

更新 2026-08-11T12:20:10.717Z · server-rendered · four-language · IDAEO 知識庫