# 取數方法書｜IDAEO-BLOG-2026-002

> as-of 2026-07-14（JST）｜正式版 2026-07-29｜文章：https://km.idaeo.ai/ai/visibility-lesson-2
> 本檔為第二課的取數方法正本，與第一課 method.md 同規格。公開供第三方複驗。

## 1. 量測器與口徑

| 讀數 | 量測器 | 起算日 | 口徑邊界 |
|---|---|---|---|
| 各月 AI 爬蟲抓取 | 自家網站程式內的 AI 爬蟲偵測器（App 層），依 User-Agent 識別 | 2026-03-03 | 與第一課的 30 天全量爬取統計（15,174,060 次）**演算法不同，不可互比**；7 月起偵測器演算法改變，故不列 7 月 |
| 引用型（索引＋答題兩類合計） | 同上，依 User-Agent 身分歸類 | 2026-03-03 | 與「答題取材」為**不同儀器**，數字不可互比 |
| 答題取材（answer fetch） | 自建端點計數 | 2026-05-19 | 5 月僅半月量，**不可與整月比大小** |
| 身分查證 | 自建查證端點計數 | 2026-06-08 | — |
| 真人導流 | referer 實錄 | 2026-04-15 | **下限**：多數 AI 服務不送 referer；3 月無此讀數，故不對 3 月真人數做任何宣稱 |
| 標題「3,000 多萬次」 | 跨完整量測面累積（含邊緣網路統計） | — | 與 App 層逐月計數**不能相加、不能互比**；逐月加總小於標題累積量屬口徑差非矛盾 |

## 2. 乾淨口徑

- 所有真人數字已剔除自家測試與監控流量。第一筆真引用即在完成此剔除後才認列（首次看到訊號時經核對發現為自家測試流量，未認列）。
- 編輯鐵則：可以不寫，但不能造假。

## 3. 已知限制（與正文一致）

1. **n=1**：單一台日內容平台的供給側樣本，不能外推到其他網站或全網。
2. **階梯是觀察不是機制**：各級「首次出現」受「我們哪天開始量」影響；先後可記錄，因果不可歸因。
3. **6 月增幅不可歸因**：同月開始每日發布內容並啟用新網域，「它們更愛來」與「我們給的變多」本儀器分不開。
4. **工作量為刻意降精度真值**：「上千次／上百份／數十道」是把內部帳本精確數字故意講模糊（做法屬商業機密）。
5. **跨儀器不可比**：本文各讀數分屬三套量測器（App 層偵測器／自建答題取材端點／自建查證端點），彼此不可互比。

## 4. 複驗方式

1. 下載 `public-claims-v2.json`（逐條標註 dataset_backed／text_backed／self_reported）。
2. 依 `evidence-core-v2.json` 的 canonicalization 規格正規化後計算 SHA-256，與 `public_claims_sha256` 比對。
3. RFC3161 時戳複驗：`openssl ts -verify -data canonical.bin -in public-claims-v2.tsr -CAfile ../tsa-ca.pem -untrusted ../tsa.crt`
4. 通過即代表這批公開數字在時戳時點已存在且未被事後竄改（artifact integrity）；**不等於 source truth**——原始事件真偽需 source-system 稽核。

## 5. 誠實聲明：本篇與第一課的憑據不對稱

第一課有外部引用（Kuroma／Profound）作為對照；本篇為單站時間序敘事，**外部引用 0 條**，且自報等級（self_reported）宣稱佔比高於第一課。引用本篇數字時，請一併參考 `public-claims-v2.json` 內每條的 `evidence_level` 標記。

聯絡：column@idaeo.ai
