AI search

ChatGPT 引用 Grokipedia:當 AI 開始引用 AI 生成的百科

《衛報》實測發現,GPT-5.2 回答超過十二個問題時引用 xAI 的 AI 生成百科 Grokipedia 九次,還重述已遭查證推翻的內容,Claude 也有類似案例。當聊天機器人引用 AI 寫的百科,來源把關成為所有 AI 搜尋產品的難題。

ChatGPT 引用 Grokipedia:當 AI 開始引用 AI 生成的百科 — 文章封面

2026 年 1 月 24 日,《衛報》刊出記者 Aisha Down 的實測報導:OpenAI 最新模型 GPT-5.2 在回答超過十二個不同問題時,引用了 xAI 經營的 AI 生成百科 Grokipedia 九次。TechCrunch 隔天跟進報導,並稱 Grokipedia 的內容正在「逃離」馬斯克生態系。

真正該在意的不是「引用了對手的產品」,而是引用之後輸出的內容:GPT-5.2 在部分主題上給出比 Wikipedia 更強的主張,也重述了《衛報》先前已查證推翻的細節。當 AI 開始把 AI 生成的百科當成來源,來源品質就不再是單一模型的問題,而是整個資訊檢索生態的問題。GPT-5.2 正是 OpenAI 開年加快模型節奏後的旗艦,背景可參考〈2026 開年觀察〉。

測試發現了什麼

《衛報》的測試中,引用出現的主題相當冷門:伊朗的政治結構(Basij 民兵的薪資、Mostazafan 基金會的所有權),以及英國歷史學家 Richard Evans 的生平——他曾在對抗大屠殺否認者 David Irving 的訴訟中擔任專家證人。在 MTN-Irancell 與伊朗最高領袖辦公室的關係上,ChatGPT 引用 Grokipedia 後做出比 Wikipedia 更強的主張;關於 Evans 庭審工作的細節,則重述了《衛報》2025 年 11 月已查證推翻的說法。

值得注意的細節是:在爭議熱區——1 月 6 日國會山莊事件、媒體偏袒川普的指控、HIV/AIDS——ChatGPT 反而沒有引用 Grokipedia。引用集中在長尾冷門主題,恰好是安全過濾與人工審查最難覆蓋的地方。

Grokipedia:AI 寫、AI 改的百科

Grokipedia 由 xAI 於 2025 年 10 月上線,起因是馬斯克批評 Wikipedia 對保守派抱持偏見。它的運作方式沒有人類直接編輯:條目由 AI 撰寫,連修改請求也由 AI 處理。外界批評從上線起沒停過:The Verge 發現許多條目直接抄自 Wikipedia;WIRED 報導條目中出現「色情內容導致愛滋危機」的說法、對奴隸制的「意識形態辯護」,以及貶低跨性別者的用語。

不只是 ChatGPT

TechCrunch 指出,Anthropic 的 Claude 在部分查詢下似乎也引用 Grokipedia;《衛報》提到的案例包括石油產量與蘇格蘭啤酒。兩家公司回應的對比相當強烈。OpenAI 表示,其網頁搜尋「旨在從廣泛的公開來源與觀點取材」,並備有安全過濾器、可見的引用,以及處理低可信度來源的機制;xAI 發言人對《衛報》的回覆則只有一句:「Legacy media lies.」(傳統媒體說謊。)

對 AI 搜尋產品的啟示

研究人員把這類風險稱為「LLM grooming」:惡意行為者——包括俄羅斯宣傳網路——把不實資訊種進模型會抓取的內容裡。研究員 Nina Jankowicz 的警告更具體:她審視過的 Grokipedia 條目,引用的來源「往好處說是不可信,往壞處說是刻意的不實資訊」;而大型聊天機器人的引用,會讓這類來源在讀者眼中變得正當。她的經歷更刺眼:一段被捏造、歸於她名下的引言,在原發媒體下架後,仍持續出現在 AI 的輸出裡。

給做搜尋與 RAG 產品的團隊三個提醒。第一,「有引用」不等於「有依據」:檢索與排序需要來源分層,而不是把所有抓得到的網頁一視同仁。第二,長尾查詢是評測盲區:只測熱點議題的安全機制,測不到真正出問題的地方。第三,AI 生成的內容正在成為其他 AI 的輸入——來源溯源(provenance)該被當成產品功能設計,而非假設網路上找得到的都算資料。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

這篇內容對你有幫助嗎?

支持本站繼續整理實用的 AI 文章、教學與開發筆記。

請我喝杯咖啡
分享X電郵