成功 Success > 數位工具
feature picture
陶氏數位新聞研究中心

AI 搜尋錯誤率高達6成!一次看:8大工具誰最準?付費版更愛胡說八道?

2025-03-19 數位時代 林美欣
分享
收藏
已完成
已取消

重點一:AI 搜尋工具普遍表現不佳,錯誤回答率高達 60% 以上。



重點二:不要以為付費 AI 模型就很安全,研究發現,這些高級模型提供的錯誤答案比免費版更有信心且更多。



重點三:AI 搜尋工具常無視發布商的機器人排除協議,未正確引用原始內容。

研究發現,AI 搜尋工具正迅速增加受歡迎程度,但效能卻令人擔憂。

根據陶氏數位新聞研究中心(Tow Center for Digital Journalism)最新研究顯示,市面上常見的 8 款主流 AI 聊天機器人在資訊檢索測試中,超過 60% 的回答完全錯誤

其中,馬斯克(Elon Musk)的 Grok 3 更創下錯誤率高達 94% 的驚人紀錄。這些工具正從網際網路爬取和重新包裝內容,但呈現方式卻常常掩蓋了嚴重的資訊品質問題。

延伸閱讀:Perplexity、ChatGPT 只要一鍵就能搜尋,Google 會被 AI 搜尋取代嗎?

AI 搜尋錯誤率高得嚇人

陶氏數位新聞研究中心是由哥倫比亞大學新聞學研究所成立,該中心的測試結果顯示,目前最受歡迎的生成式 AI 搜尋工具表現不佳,整體而言超過 6 成的問題答案完全錯誤。測試涵蓋 8 主流 AI 搜尋工具,包括 ChatGPT 搜尋、Perplexity、Perplexity Pro、Gemini、DeepSeek Search、Grok-2 Search、Grok-3 Search 和 Copilot。

在所有測試工具中,Perplexity 表現最佳,但仍有 37% 的回答不正確;而表現最差的 Grok 3 則有高達 94% 的回答錯誤

更令人擔憂的是,這些 AI 工具在提供錯誤答案時往往表現出極高的信心,很少使用如「可能」、「似乎」等詞,也極少承認知識不足。ChatGPT 在 200 個回應中,僅 15 次表示缺乏信心,且從未拒絕提供答案。

AI工具錯誤率.jpg
陶氏數位新聞研究中心

研究方法

該研究團隊從 20 家新聞機構隨機選取了 200 篇文章(每家 10 篇),確保每篇文章摘錄的內容在傳統 Google 搜尋中,都能在前 3 個結果中找到原始來源。然後,研究人員向每個 AI 搜尋工具提供這些摘錄,要求識別對應文章的標題、原始發布來源、發布日期和網址。

研究人員根據三項屬性:正確文章、正確發布來源和正確網址,手動評估了聊天機器人的回應。按照這些參數,每個回應被標記為以下標籤之一:完全正確、正確但不完整、部分不正確、完全不正確、未提供或爬蟲被阻止。

AI 搜尋常犯的幾項錯誤

根據該研究,AI 搜尋工具在實際使用中展現出多項嚴重問題,包括:

未能正確連結原始來源: AI 聊天機器人經常錯誤引用文章。例如,DeepSeek 在 200 次查詢中有 115 次錯誤歸因摘錄來源。即使聊天機器人正確識別了文章,也常未能正確連結到原始來源,而是引導到 Yahoo News 或 AOL 等平台上的轉載版本。

延伸閱讀:AI 可以幫你速速寫履歷,但也有搞砸的風險!專家教你如何避免「踩雷」

付費模型「更有自信」胡說八道: 令人驚訝的是,付費版本如 Perplexity Pro(每月 20 美元,約新台幣 639 元)或 Grok 3(每月 40 美元,約新台幣 1,278 元)雖然比免費版答對了更多問題,但它們整體錯誤率反而更高,主要是因為它們傾向於提供明確但錯誤的答案,而非拒絕直接回答。

虛構或損壞的網址: 超過一半來自 Gemini 和 Grok 3 的回應引用了虛構或損壞的網址,導致錯誤頁面。Grok 3 在 200 個提示中有 154 個引用導致錯誤頁面,即使在正確識別文章時,它也經常連結到虛構的網址。

8 款聊天機器人搜尋正確度評比

如下表,Perplexity Pro 表現還算不錯,錯誤率約 40%;然而 Grok 3 的錯誤率高達 94%,是所有測試中最高的。

聊天機器人 錯誤率 是否為高級模型 是否公開其爬蟲程序的名稱 引用錯誤來源的次數
Perplexity 約 37% 57 (錯誤文章) + 27 (404 錯誤連結) = 84
Perplexity Pro 約 40% 是 ($20/月) 72 (錯誤文章)
Grok 2 約 53% 62 (錯誤文章) + 10 (404 錯誤連結) = 72
DeepSeek 約 57% 115 (錯誤文章)
Copilot 約 60% 72 (錯誤文章)
ChatGPT 約 61% 79 (錯誤文章) + 42 (缺失連結) = 121
Gemini 約 76% 127 (404 錯誤連結) + 22 (錯誤文章) = 149
Grok 3 94% 是 ($40/月) 117 (404 錯誤連結) + 26 (錯誤文章) = 143
付費模型.jpg
陶氏數位新聞研究中心

研究中也發現,多數機器人無視發布者的爬蟲限制,即使被封鎖仍獲取內容。例如,Perplexity Pro 正確識別了近三分之一本應無權訪問的 90 個摘錄。

而就算有合作關係,AI 也未必能 100% 準確識別其內容,像是《舊金山紀事報》(San Francisco Chronicle)允許 OpenAI 的爬蟲,但 ChatGPT 只正確識別了 10 個分享摘錄中的 1 個。

必須說明的是,「機器人排除協議」雖不具有法律約束力,但它是一種被廣泛接受的標準,用於指示網站哪些部分應該被抓取,哪些部分不應該被抓取。

AI 巨頭們怎麼說?

對於報告結果,研究中心指出,「我們聯繫了本報告中提到的所有人工智慧公司徵求意見,只有 OpenAI 和微軟做出了回應,但都沒有回答我們的具體發現或問題。」

OpenAI 指出:「我們透過幫助每周 4 億 ChatGPT 用戶透過摘要、引用、清晰連結和歸因發現優質內容來支持出版商和創作者。我們與合作夥伴合作,以提高內聯引用的準確性並尊重出版商的偏好,包括透過管理 robAI.txt 中的 OrobAI-Search 來增強它們在搜尋結果。」

微軟則表示:「微軟尊重 robots.txt 標準,並尊重那些不希望其網頁內容被該公司的生成式 AI 模型使用的網站提供的指示。」

本文出自 數位時代;資料來源:Tow Center for Digital JournalismTECHSPOTmashable

繼續閱讀 數位工作術 AI
相關文章
領導 Leadership > 團隊管理
feature picture
經理人

導入 AI、複製顧問思維!無限創意行銷翁小五如何打造策略型人才團隊?

經理人 x 無限創意行銷
2026-07-23
分享
收藏
已完成
已取消

二十出頭那年,無限創意行銷創辦人翁小五(翁銘鴻)第一次創業就賠光兩百萬,以破產收場。面對失敗,他沒有就此放棄,而是放下創業者身份,加入一家顧問公司從基層做起。憑著積極與績效,他兩個月內升任總經理特助,近距離參與多個企業輔導案,三年扎根學習,讓他看清創業挫折背後的共同病灶,也成為日後創辦無限創意行銷的養分。

如今,無限創意行銷成立 9 年,服務超過90家企業、橫跨 50 餘種產業。翁小五觀察到,台灣中小企業超過 171 萬家,多數雖設有行銷職能,卻普遍缺乏宏觀的品牌策略思維。這個缺口,催生出一批以創辦人個人魅力為核心的行銷顧問公司,然而創辦人一旦抽身,服務品質也會隨之稀釋。對此,翁小五如何把個人的商業判斷,轉化為整個行銷團隊都具備的顧問價值?

從行銷執行走向經營診斷,揪出企業成長阻礙

「企業客戶在意的,是那些看不見、卻正在影響營運的東西」,翁小五表示,一般行銷公司強調開源,管理顧問公司強調節流,無限創意行銷則強調用商業模式定位,把開源與節流兩者一併落實。他的團隊會從產、銷、人、發、財的角度分析獲客成本與財務結構,用數字及早找出還沒浮上檯面的隱患,從體質健檢做起,才能完成真正有力道的行銷成果。

翁小五也觀察到,多數行銷公司習慣單點執行,缺乏組織性與策略性思維;加上行銷人員普遍沒有創業經驗,難以從經營者視角理解全局,導致每一次的專案都流於片段操作,缺乏長期延續性。對此,他建議企業應善用外部資源、發揮綜效,理想狀態是產業 know-how 與行銷專業強強聯手,同時掌握自身專長分寸:會員經營適合由品牌內部執行,口碑操作則不妨仰賴外部專業。

以無限創意行銷為例,長期深耕 KOL 合作關係,累積大量檔期數據與成效分析經驗,不只省去企業直接對接的時間成本,更能有效降低試錯與踩雷的風險。翁小五強調,行銷顧問的價值遠不止於完成單一任務,從組織管理、行銷策略、回購機制到數據累積,真正的顧問價值是協助企業建立可持續運作的品牌經營能力。

AI Agent 複製顧問思維,讓團隊站在創辦人的肩膀上做事

目前無限創意行銷團隊共 19 人,分駐台南與台北,每年服務約 20 家中小企業客戶,營收規模從 5,000 萬到 5 億元不等,涵蓋傳產、服務業與正尋求轉型的企業。

隨著團隊規模擴大,翁小五面對的挑戰是,如何讓不同背景成員都具備同等水準的顧問思維。個人經歷難以被複製,但思考框架可以複製,這是他找到的解方。「在 AI 出現之前,要做這件事其實很難」,他坦言,自己是顧問業界少數具備真實創業經驗的過來人,但這些經驗卻很難傳承給團隊。

如今進入 AI 時代,情況有了轉變,翁小五著手整理自己的經驗背景與判斷方式,訓練成 AI Agent。「讓 AI 變成我的分身,團隊就能透過使用這個 AI 代理人,站在我的肩膀上做事。」

除了親自帶著團隊應用 AI,翁小五也從人才與流程兩端著手賦能團隊:一方面重用懂 AI 的人才,並為團隊制定學習地圖;另一方面聘請外部顧問盤點工作流程,協助團隊將工作拆解成模組。隨著累積的專案案例愈來愈多,這套系統也能逐步優化,加速成功經驗複製。

無限創意-2.JPG
無限創意行銷創辦人翁小五(翁銘鴻)。
經理人

AI 能做到及格,但拉開差距的仍是人的判斷與品味

工作流程重整之後,下一道課題,是如何讓每位成員都真正具備顧問價值。翁小五表示:「AI 能把基本功做到及格,但要做到八、九十分,需要靠人。人的價值在於,回歸到人性,在決策當中加入溫度。」他認為,關鍵不只在邏輯拆解問題的能力,更在於能否對產業累積出屬於自己的品味與判斷。

顧問素養的養成,他認為最基礎的是,要先把職業能力提升到一定程度;對企業經營者來說,則是不吝嗇分享獲利,唯有績效能確實反映在薪酬上,團隊才會相信努力是值得的,也才願意進一步談價值、談成長。同理,在 AI 時代下,當團隊親身感受到 AI 帶來的實質效益,成就感一旦累積,自然也會主動投入學習。

看得見成果,進而持續推進,這種思維除了體現在內部管理,也是他與客戶長期合作的關鍵。翁小五分享某企業客戶的案例:由於客戶端老闆主導性強、對專案參與度高,他深知在信任基礎尚未穩固前,若沒有清楚的權責界線,執行上容易產生拉扯。因此合作初期,他特別著重先做好職能劃分,每月同時有戰略面與執行面匯報,讓不同層級主管各自追蹤。

他分享:「當客戶看到各層面都有穩定輸出,就會放心授權給基層人員。所以客戶創業第一年,我們就幫他做到 2 億元營收,後續也有餘裕做體驗式行銷,去經營更多品牌體驗,傳遞品牌的溫度和價值。」

翁小五強調,顧問的價值,在於提供能落地的方法,陪伴客戶從看見、相信走向行動。當團隊每個人都能獨立承接策略層級的對話,顧問便從創辦人的個人標籤,轉化為整個組織共同具備的能力。無限創意行銷顧問案續約率達 90%,其實就是最佳證明,也讓它得以在中小企業品牌轉型的浪潮中,持續扮演長期陪跑的角色。

無限創意-3.JPG
無限創意行銷將顧問經驗訓練成 AI Agent,讓團隊站在創辦人的肩膀上思考、服務客戶。
經理人

[本文由經理人整合行銷部與無限創意行銷共同製作]

解鎖更多提問機會!

請先登入會員

會員專區

使用會員功能前,請先登入

  • 台灣首款對話式 AI 職場教練,一次提升領導力
  • 會員專享每日運勢、名人金句抽籤
  • 收藏文章、追蹤作者,享受個人化學習頁面
  • 定向學習!20 大關鍵字,開放自選、訂閱
  • 解鎖下載專區!10+ 會員專刊一次載
訂閱方案