回到頂部
從 AI 回答拆解主張、尋找原始來源到記錄結論的事實查核流程

如何查證 AI 回答?5 分鐘事實查核 SOP

AI 回答有數字、論文或法條,怎麼判斷真假?用一套 5 分鐘 SOP 拆解主張、找原始來源、核對引文,留下可重查的證據。

內容查核: 連結查核: 來源查核:

本文含聯盟連結

AI 回答裡出現精確數字、論文題名或法條時,最差的做法是直接問它:「你確定嗎?」它可能道歉改口,也可能替錯誤補上一個更像真的來源。

真正的查核只有一個核心:把答案拆成可以驗證的主張,回到原始來源逐項核對。 下面這套流程不需要專業查核工具,一般工作文件通常五分鐘就能先篩掉最危險的錯誤。

先決定哪些句子要查

不必逐字驗證整段回答。先標出會改變讀者判斷的內容:

  • 數字、比例、金額與排名。
  • 日期、版本、職稱、價格與產品功能。
  • 論文、法條、判例、標準與政策。
  • 某人「曾經說過」的引言。
  • 因果關係,例如「因為 A,所以 B 增加」。
  • 帶有「首次、唯一、一定、已證實」等強烈語氣的結論。

只是改寫語氣的句子,通常不用查;會影響決策的事實,優先查。若你還不熟悉 AI 為何會自信地出錯,先看 AI 幻覺是什麼

5 分鐘 AI 事實查核 SOP

第 1 步:把答案拆成最小主張。

假設 AI 寫:「某公司在 2026 年推出新方案,價格降低,已在台灣開放。」這句話其實包含四個主張:

  1. 公司確實推出該方案。
  2. 推出時間是 2026 年。
  3. 新價格比舊價格低。
  4. 台灣使用者目前可以使用。

任何一項錯誤,原句的結論都可能不成立。把句子拆開,才知道要找什麼證據。

第 2 步:用搜尋找到原始來源。

搜尋引擎、Perplexity或 ChatGPT Search 可以幫你定位資料,但不要停在摘要。來源優先順序可以這樣排:

台灣法規先看主管機關與全國法規資料庫;公司方案與價格看官方定價頁、說明中心和公告;財務數字查公開資訊觀測站或公司財報;論文結論回到出版社、DOI 和全文;人物引言則找逐字稿、影片或正式聲明。律師解析、媒體報導與評測文章可以協助理解,但應保留原始文件作為證據。

維基百科、論壇與搜尋摘要可以提供關鍵字,但不適合作為重要主張的最後證據。

第 3 步:確認是同一件事。

找到頁面後,先核對四個欄位:

  • 對象:同名公司、同名人物或相似產品有沒有搞混?
  • 時間:資料發布日、更新日與事件發生日是否不同?
  • 地區:美國方案是否真的適用台灣?
  • 版本:功能屬於哪個模型、帳號或付費層級?

很多錯誤都來自套用範圍:資料本身正確,時間、地區或版本卻放錯了。

第 4 步:檢查來源是否真的支持原句。

在頁面內搜尋關鍵字,讀命中段落的前後文。尤其注意這些語氣差異:

原文不能擅自改寫成
may、could、associated with已證實會造成
部分受測者所有人
測試環境真實世界一定如此
即將推出、逐步開放已全面上線
起價、最高可達所有人都支付或獲得該數字

來源存在,不代表來源支持 AI 的結論。 這一步往往比找到連結更重要。

第 5 步:留下可重查的紀錄。

至少記下:原始主張、結論、來源網址、查核日期。正式文章或公司文件可用這張表:

例如,官方只寫「逐步推出」,「台灣已開放」就應標成尚無法確認並改用保留語氣;官方寫的是「起價」,文章就要補上價格條件;研究只觀察到關聯,便不能寫成已證實因果。這些修改都應和來源一起記下。

以後來源更新或讀者提出疑問時,不必從頭搜尋。

AI 事實查核 SOP 三層流程,從快速掃描、交叉搜尋到高風險情境專家確認
先找高風險主張,再回到原始來源核對;醫療、法律、財務等情境還要增加專業審查。

不同資料要怎麼搜

數字與統計。

把數字、單位和主題一起搜尋,例如 4.2% GDP 台灣 2025。找到原表後確認分母、期間、名目或實質、年增或季增。只差一個定義,數字就可能完全不同。

論文與 DOI。

先將完整題名貼到 Google Scholar;有 DOI 再到 doi.org開啟。核對作者、期刊、年份與摘要。只看 AI 產生的引用格式沒有意義,格式正確最容易偽裝不存在的論文。

台灣法條與政府規定。

全國法規資料庫搜尋法規名稱與條號,再看「異動日期」和「生效日期」。行政指引、新聞稿與法律條文不是同一種效力;涉及個案適用時,仍應請專業人士判斷。

產品功能與價格。

查官方定價頁、說明中心與版本紀錄,並注意國家、稅額、帳單週期與方案層級。舊新聞即使當時正確,也不能證明今天仍然適用。

引言與人物說法。

優先找影片、逐字稿、官方社群或完整訪談。二手文章只截一句時,要回到上下文確認受訪者是在陳述事實、表達預測,還是引用別人。

三個常見查核陷阱

問另一個 AI,兩個答案一樣。

這只能說明兩個模型給了相同答案。它們可能引用同一篇錯誤文章,也可能一起接受問題裡的錯誤前提。多模型比較適合找出分歧點,不適合用多數決判真偽。

來源是知名媒體,所以不用回頭查。

媒體可能是在轉述公司公告、研究或法院文件。重要數字應沿著報導中的連結回到原始文件;找不到時,就清楚寫成「媒體報導」,不要包裝成官方確認。

連結打得開,就算查證完成。

最常見的錯誤恰恰是「真來源、錯引用」。頁面可能談同一主題,卻沒有支持那個數字或因果結論。每一條引用都要能回答:原文的哪一句支撐我的哪一句?

AI 回答紅旗清單,包含精確數字、完美引用、過度自信、無效來源與過時資訊
精確數字、完美引用與肯定語氣都在提醒你:優先查核這些主張。

可以請 AI 幫忙,但不要讓它當裁判

AI 很適合做三件事:把長文拆成待查主張、替每個主張建議可能的原始來源、整理你已確認的證據。你可以這樣要求:

請把下列內容拆成可獨立驗證的事實主張。每項標示「數字、日期、引用、法規、產品現況、推論」類型,並建議應查哪一種原始來源。不要判定真假,也不要補寫來源。

接著仍由你開啟來源、核對原文。若處理公司機密或個資,先看 AI 隱私自保指南,不要為了查核又把敏感資料貼進不適合的帳號。

哪些情況不能只做五分鐘查核

  • 醫療:檢查正式指引、適用族群與更新日期,個人決策詢問醫療專業人員。
  • 法律:確認法域、法條版本與判例效力,個案請律師判斷。
  • 財務:讀原始財報與風險揭露,不用 AI 摘要直接交易。
  • 學術研究:閱讀方法、樣本、限制與利益衝突,不只看摘要。
  • 會自動執行的 Agent:除了查答案,還要測工具呼叫、權限、錯誤復原與稽核紀錄。

查核讓 AI 留在適合的位置工作。它擅長加速整理;是否足以支持決策,仍要由證據決定。

常見問題

AI 說的話大概有幾成是真的?

沒有一個適用所有情境的固定比例。結果會隨問題領域、資料新舊、模型版本、是否能搜尋及評測方式而變。比起記住一個百分比,更實用的是針對會影響決策的主張逐項查證。

Perplexity 或 ChatGPT Search 有附來源,就比較可靠嗎?

它們通常讓查核更方便,但連結不是正確保證。仍要確認來源品質、日期、地區與原文是否支持回答。搜尋工具的價值是縮短找資料的時間。

AI 給的論文引用,最快怎麼驗證?

先用完整題名搜尋 Google Scholar,再從 DOI 或出版社頁面核對作者、年份與摘要。題名搜不到、DOI 無法開啟或作者資料對不上時,不要引用,除非找到可驗證的正式紀錄。

不是記者,也需要留下查核紀錄嗎?

私人閒聊不必;對外文章、公司簡報、客戶建議與高風險決策值得留下。最簡版本只要四欄:主張、結論、來源、查核日期,已足以避免日後重查和誤用舊資料。

查核工具與原始入口

№ · further reading

延伸閱讀