2024 年初,AI 新創公司 Anthropic 悄悄加碼一項內部代號「巴拿馬計畫」(Project Panama)的秘密行動。這項計畫的目的,是大量收購世界各地的實體書,把書脊裁掉之後逐頁掃描,變成 AI 訓練資料庫的養分。
一份內部規劃文件寫道:「我們不希望外界知道這件事。」短短一句話,就看得出公司多想避開外界目光。直到一起集體訴訟解封了超過 4000 頁的法庭文件,這場耗資數千萬美元的「毀書行動」才被攤在陽光下。
買書、剪本、掃描、回收:巴拿馬計畫怎麼把書變成 AI 養分
Anthropic 找來 Google 前高層湯姆.透維(Tom Turvey)主導這項計畫,他二十年前就參與過打造 Google 圖書計畫,當年同樣鬧出著作權爭議。文件顯示,Anthropic 一度考慮直接向圖書館或二手書店買書,名單裡包括紐約知名地標二手書店 Strand(以「18 哩書牆」聞名),還有紐約公共圖書館。Strand 受訪時表示,最後並沒有把書賣給 Anthropic;紐約公共圖書館則未做回應。
最終,Anthropic 轉向二手書商 Better World Books 與英國的 World of Books 大量採購數百萬本書。合作的掃描廠商提案指出,他們要在 6 個月內轉換 50 萬到 200 萬本書。
掃描廠商用「油壓裁切機」削掉書脊,再用高速、高畫質、產線等級的掃描儀逐頁掃描,掃完的書則交給回收公司運走。確切的掃描數量和花費,在法庭文件裡都被塗黑。
雖然掃描實體書之後銷毀在法律上站得住腳,但在那之前下載盜版書的行為,卻讓 Anthropic 付出了 15 億美元的天價代價。
買書之前先偷書!Anthropic賠上 15 億美元
共同創辦人班.曼恩(Ben Mann)在 2021 年 6 月連續 11 天,親自從盜版網站 LibGen 下載了大量小說與非小說作品。隔年,他還傳送新成立的「海盜圖書館鏡像」(Pirate Library Mirror)網站連結給同事,興奮留言「來得正是時候!!!」,該網站曾公開宣稱其「在多數國家蓄意違反著作權法」。Anthropic 在訴訟中辯稱,他們從未用 LibGen 資料訓練出產生營收的商用模型,也未曾用海盜圖書館鏡像訓練過任何完整模型。
無獨有偶,Meta 也私下找過盜版圖書資源。文件顯示,Meta 員工內部多次擔心,未經授權下載數百萬本書可能違反著作權法。一名工程師 2023 年寫道:「用公司筆電跑 BT 下載感覺不太對勁。」但同年 12 月的內部郵件顯示,這個做法在「向 MZ(外界認為是執行長祖克柏的縮寫)呈報」後就獲得批准。事後 Meta 律師否認下載訓練資料時曾散布原告作品。
由於下載盜版影子圖書館的行為面臨極高的版權訴訟風險,Anthropic 最終選擇在 2025 年 8 月與作者和解,同意支付 15 億美元,並否認任何不法行為。這筆和解金預計向數千名作者提供每部作品約 3000 美元的賠償,涵蓋約 50 萬部作品。
法官核准 15 億美元和解,但沒替整個產業定案
2026 年 7 月 20 日,法官阿拉塞莉.馬丁尼茲-奧爾金(Araceli Martinez-Olguin)正式核准這筆和解案。雖然這是美國著作權史上規模數一數二大的和解案,卻沒有徹底解決整個 AI 產業的法律爭議——和解代表這起案子不會進入上訴法院,當初法官做出的判決,也就不會成為有拘束力的判例。
這起案子裡,法官威廉.艾爾薩普(William Alsup)曾在 2025 年 6 月做出關鍵裁定,認定 Anthropic 用書籍訓練 AI 模型屬於「轉化性使用」,符合合理使用原則,他把 AI 訓練比喻成老師「教學童怎麼把文章寫好」。
在另一起 Meta 案裡,法官文斯.查布里亞(Vince Chhabria)同樣認定,作者沒能證明 Meta 的模型傷害了實體書的銷量。換句話說,法院目前的認定是:「把合法買來的書掃進 AI 訓練庫」(也就是巴拿馬計畫這種做法)站得住腳;但在那之前「非法下載影子圖書館的盜版檔案」(也就是 LibGen 那個階段),才是各家 AI 巨頭賠錢、被告的真正主因。
如今,Google、Meta、Midjourney 和 OpenAI 仍面臨一連串版權訴訟,包括阿歇特(Hachette)、聖智學習(Cengage)、愛思唯爾(Elsevier)等出版商,也在 Google 案中提出了集體訴訟。
二手書市場被 AI 公司買爆:中間商賺錢,稀有書恐從此消失
這種「實體書破壞性掃描」的需求,正如經典反烏托邦小說《華氏 451 度》(Fahrenheit 451)中燒書的景象,在二手書市場催生了「AI 買家中間商」的匿名採購產業鏈。批評者指出,AI 公司急著在「AI slop」(劣質文字)充斥網路前,搶下 2023 年生成式 AI 爆發前出版、純由人類創作的高品質書籍。
一名匿名書商透露,在 AI 買家進場後,他每周的書籍銷量從大約 20 本暴增到數百本。他表示:「這筆生意在財務上對我有利,能清掉舊庫存…… 但我很不喜歡這些書的最終用途,也不喜歡罕見的書被打成紙漿。」面對爭議,伊隆.馬斯克(Elon Musk)公開表示反對純粹銷毀式的掃描,並在 X 上發文透露:「我已要求 SpaceXAI 團隊將任何稀有書籍保留在圖書館中,用比較費工的方式掃描,而不是直接切掉書脊。」
康乃爾理工學院數位與資訊法學教授詹姆斯.格林曼(James Grimmelmann)指出,Anthropic 後期選擇花大錢買實體書進行「巴拿馬計畫」,而非全靠下載盜版,在法律合規上是個「聰明的決定」;但他警告,AI 巨頭在版權界限明朗前,早已將大量版權內容嵌入自身產品管道,騎虎難下。當法院陸續判定「訓練環節」屬合理使用,「書籍究竟從哪裡來、來得乾不乾淨」將成為未來版權戰場的決勝關鍵。
資料來源:The Washington Post、Yahoo Finance、TechCrunch;本文初稿由 AI 協助整理,編輯:支琬清