AI 回答裡出現精確數字、論文題名或法條時,最差的做法是直接問它:「你確定嗎?」它可能道歉改口,也可能替錯誤補上一個更像真的來源。
真正的查核只有一個核心:把答案拆成可以驗證的主張,回到原始來源逐項核對。 下面這套流程不需要專業查核工具,一般工作文件通常五分鐘就能先篩掉最危險的錯誤。
先決定哪些句子要查
不必逐字驗證整段回答。先標出會改變讀者判斷的內容:
- 數字、比例、金額與排名。
- 日期、版本、職稱、價格與產品功能。
- 論文、法條、判例、標準與政策。
- 某人「曾經說過」的引言。
- 因果關係,例如「因為 A,所以 B 增加」。
- 帶有「首次、唯一、一定、已證實」等強烈語氣的結論。
只是改寫語氣的句子,通常不用查;會影響決策的事實,優先查。若你還不熟悉 AI 為何會自信地出錯,先看 AI 幻覺是什麼。
5 分鐘 AI 事實查核 SOP
第 1 步:把答案拆成最小主張。
假設 AI 寫:「某公司在 2026 年推出新方案,價格降低,已在台灣開放。」這句話其實包含四個主張:
- 公司確實推出該方案。
- 推出時間是 2026 年。
- 新價格比舊價格低。
- 台灣使用者目前可以使用。
任何一項錯誤,原句的結論都可能不成立。把句子拆開,才知道要找什麼證據。
第 2 步:用搜尋找到原始來源。
搜尋引擎、Perplexity或 ChatGPT Search 可以幫你定位資料,但不要停在摘要。來源優先順序可以這樣排:
台灣法規先看主管機關與全國法規資料庫;公司方案與價格看官方定價頁、說明中心和公告;財務數字查公開資訊觀測站或公司財報;論文結論回到出版社、DOI 和全文;人物引言則找逐字稿、影片或正式聲明。律師解析、媒體報導與評測文章可以協助理解,但應保留原始文件作為證據。
維基百科、論壇與搜尋摘要可以提供關鍵字,但不適合作為重要主張的最後證據。
第 3 步:確認是同一件事。
找到頁面後,先核對四個欄位:
- 對象:同名公司、同名人物或相似產品有沒有搞混?
- 時間:資料發布日、更新日與事件發生日是否不同?
- 地區:美國方案是否真的適用台灣?
- 版本:功能屬於哪個模型、帳號或付費層級?
很多錯誤都來自套用範圍:資料本身正確,時間、地區或版本卻放錯了。
第 4 步:檢查來源是否真的支持原句。
在頁面內搜尋關鍵字,讀命中段落的前後文。尤其注意這些語氣差異:
| 原文 | 不能擅自改寫成 |
|---|---|
| may、could、associated with | 已證實會造成 |
| 部分受測者 | 所有人 |
| 測試環境 | 真實世界一定如此 |
| 即將推出、逐步開放 | 已全面上線 |
| 起價、最高可達 | 所有人都支付或獲得該數字 |
來源存在,不代表來源支持 AI 的結論。 這一步往往比找到連結更重要。
第 5 步:留下可重查的紀錄。
至少記下:原始主張、結論、來源網址、查核日期。正式文章或公司文件可用這張表:
例如,官方只寫「逐步推出」,「台灣已開放」就應標成尚無法確認並改用保留語氣;官方寫的是「起價」,文章就要補上價格條件;研究只觀察到關聯,便不能寫成已證實因果。這些修改都應和來源一起記下。
以後來源更新或讀者提出疑問時,不必從頭搜尋。
不同資料要怎麼搜
數字與統計。
把數字、單位和主題一起搜尋,例如 4.2% GDP 台灣 2025。找到原表後確認分母、期間、名目或實質、年增或季增。只差一個定義,數字就可能完全不同。
論文與 DOI。
先將完整題名貼到 Google Scholar;有 DOI 再到 doi.org開啟。核對作者、期刊、年份與摘要。只看 AI 產生的引用格式沒有意義,格式正確最容易偽裝不存在的論文。
台灣法條與政府規定。
到全國法規資料庫搜尋法規名稱與條號,再看「異動日期」和「生效日期」。行政指引、新聞稿與法律條文不是同一種效力;涉及個案適用時,仍應請專業人士判斷。
產品功能與價格。
查官方定價頁、說明中心與版本紀錄,並注意國家、稅額、帳單週期與方案層級。舊新聞即使當時正確,也不能證明今天仍然適用。
引言與人物說法。
優先找影片、逐字稿、官方社群或完整訪談。二手文章只截一句時,要回到上下文確認受訪者是在陳述事實、表達預測,還是引用別人。
三個常見查核陷阱
問另一個 AI,兩個答案一樣。
這只能說明兩個模型給了相同答案。它們可能引用同一篇錯誤文章,也可能一起接受問題裡的錯誤前提。多模型比較適合找出分歧點,不適合用多數決判真偽。
來源是知名媒體,所以不用回頭查。
媒體可能是在轉述公司公告、研究或法院文件。重要數字應沿著報導中的連結回到原始文件;找不到時,就清楚寫成「媒體報導」,不要包裝成官方確認。
連結打得開,就算查證完成。
最常見的錯誤恰恰是「真來源、錯引用」。頁面可能談同一主題,卻沒有支持那個數字或因果結論。每一條引用都要能回答:原文的哪一句支撐我的哪一句?
可以請 AI 幫忙,但不要讓它當裁判
AI 很適合做三件事:把長文拆成待查主張、替每個主張建議可能的原始來源、整理你已確認的證據。你可以這樣要求:
請把下列內容拆成可獨立驗證的事實主張。每項標示「數字、日期、引用、法規、產品現況、推論」類型,並建議應查哪一種原始來源。不要判定真假,也不要補寫來源。
接著仍由你開啟來源、核對原文。若處理公司機密或個資,先看 AI 隱私自保指南,不要為了查核又把敏感資料貼進不適合的帳號。
哪些情況不能只做五分鐘查核
- 醫療:檢查正式指引、適用族群與更新日期,個人決策詢問醫療專業人員。
- 法律:確認法域、法條版本與判例效力,個案請律師判斷。
- 財務:讀原始財報與風險揭露,不用 AI 摘要直接交易。
- 學術研究:閱讀方法、樣本、限制與利益衝突,不只看摘要。
- 會自動執行的 Agent:除了查答案,還要測工具呼叫、權限、錯誤復原與稽核紀錄。
查核讓 AI 留在適合的位置工作。它擅長加速整理;是否足以支持決策,仍要由證據決定。
常見問題
AI 說的話大概有幾成是真的?
沒有一個適用所有情境的固定比例。結果會隨問題領域、資料新舊、模型版本、是否能搜尋及評測方式而變。比起記住一個百分比,更實用的是針對會影響決策的主張逐項查證。
Perplexity 或 ChatGPT Search 有附來源,就比較可靠嗎?
它們通常讓查核更方便,但連結不是正確保證。仍要確認來源品質、日期、地區與原文是否支持回答。搜尋工具的價值是縮短找資料的時間。
AI 給的論文引用,最快怎麼驗證?
先用完整題名搜尋 Google Scholar,再從 DOI 或出版社頁面核對作者、年份與摘要。題名搜不到、DOI 無法開啟或作者資料對不上時,不要引用,除非找到可驗證的正式紀錄。
不是記者,也需要留下查核紀錄嗎?
私人閒聊不必;對外文章、公司簡報、客戶建議與高風險決策值得留下。最簡版本只要四欄:主張、結論、來源、查核日期,已足以避免日後重查和誤用舊資料。