「現代焚書」「數位焚書」與版權爭議/由奧地利研發的 Treventus ScanRobot 2.0 MDS 自動書本掃描機。 這類設備是專門提供給國家級圖書館、大學或大型數位典藏機構的大型工業儀器,有專利的 V 型書托(不傷書脊),並利用真空吸附與氣流無觸碰翻頁,每小時能掃描高達 2,500 頁。 由於極度保護書籍,常用於掃描 14 世紀以來的珍貴古籍或散架老書。 不過這台價格預估約 新台幣 250 萬至 400 萬元之間/AI 公司主張「購買實體書 → 轉為一對一數位檔 → 銷毀實體原件」屬於著作權法中的轉化性合理使用(Fair Use)。因為他們沒有將副本轉售,且銷毀了原件,藉此規避重製與侵權的法律風險。稀有書、絕版書或未被公立圖書館典藏的孤本,一旦被 AI 公司買下並銷毀,它在現實世界中就永久消失了。更嚴重的是,這些知識變成了少數科技巨頭私有資料庫裡的權重參數,一般大眾反而無法再接觸到原始資料。

 https://www.threads.com/share/BiYPGVx2MM/


https://www.threads.com/share/Fl5yNR1sc/

AI公司練模型的方式: 把圖書館裡借都借不到的稀有藏書,掃描完就直接絞掉。 而這台機器,翻頁都不用手碰,就能救下全部。

-------------------

https://www.threads.com/share/E1yXusuKm/

AI公司為了訓練AI,不擇手段收購大量老書,掃描進資料庫後就進行銷毀。每一本被掃描的書都會從現實世界永久消失。其中的知識僅作為訓練資料保存在任何人都無法持有、瀏覽或轉售的系統中。

https://www.threads.com/share/DP6g5QJKW/


不用「摧毀」書的掃描方式,這台是由奧地利研發的 Treventus ScanRobot 2.0 MDS 自動書本掃描機。

這類設備是專門提供給國家級圖書館、大學或大型數位典藏機構的大型工業儀器,有專利的 V 型書托(不傷書脊),並利用真空吸附與氣流無觸碰翻頁,每小時能掃描高達 2,500 頁。
由於極度保護書籍,常用於掃描 14 世紀以來的珍貴古籍或散架老書。
不過這台價格預估約 新台幣 250 萬至 400 萬元之間https://www.threads.com/share/J9BlRkRec/

在 AI 產業迅速發展的背後,這段時間確實掀起了非常大的「數位焚書」與版權爭議。

你所貼出的 Thread 貼文,正好精準地呈現了「商業 AI 訓練」與「文化典藏機構」在處理紙本書籍時,完全相反的兩種思路與做法:

一、 AI 公司為何要採用「破壞性掃描」?

AI 公司(如 Anthropic 等)與中間商(如 ISBNdb 等)近年大規模收購二手書與絕版老書。他們之所以切掉書脊、掃描後直接銷毀,主要出於三個核心考量:

  1. 獲取「未受 AI 污染」的高質量文本:

    網路上已經充斥大量由生成式 AI 產生的垃圾內容(AI Slop)。為了訓練出邏輯更嚴密、知識更準確的大模型,AI 公司極度渴望 2022 年以前出版、未經 AI 污染的實體書籍文字。

  2. 極致的效率與成本控制:

    對 AI 公司來說,他們需要的是「數百萬冊」的數據量。使用工業液壓裁切機切掉書脊,將散頁直接送入每分鐘數百頁的高速進紙掃描機,成本與時間遠低於非破壞性掃描。

  3. 法律上的「合理使用」防護:

    在美國法律實務中(如 Bartz v. Anthropic 案),AI 公司主張「購買實體書 → 轉為一對一數位檔 → 銷毀實體原件」屬於著作權法中的轉化性合理使用(Fair Use)。因為他們沒有將副本轉售,且銷毀了原件,藉此規避重製與侵權的法律風險。

爭議焦點:

這種做法被文化界指責為「現代焚書」。許多稀有書、絕版書或未被公立圖書館典藏的孤本,一旦被 AI 公司買下並銷毀,它在現實世界中就永久消失了。更嚴重的是,這些知識變成了少數科技巨頭私有資料庫裡的權重參數,一般大眾反而無法再接觸到原始資料。

二、 典藏機構的文明守護:Treventus ScanRobot

相對地,貼文中提及的 Treventus ScanRobot 2.0 MDS,代表的是文化資產保存與數位典藏的標準做法。

為什麼 ScanRobot 能夠「不傷書」?

  • 60 度 V 型書托(V-Shaped Cradle):

    傳統平鋪掃描需要把書本完全攤平(180 度),這會直接撕裂老舊古籍的書脊與縫線。ScanRobot 的 V 型設計讓書籍只需開啟 60 度,對書脊壓力極小。

  • 氣流與真空無觸碰翻頁(Air-Blowing & Vacuum Pick-up):

    它不使用機械手臂或人工指尖捏貼紙張,而是利用專利氣流將頁面吹起,再透過溫和的真空吸嘴吸附翻頁。這能確保哪怕是 14 世紀發黃、脆弱、甚至邊緣碎裂的羊皮紙或手工紙,都不會遭到二次傷害。

  • 雙單眼鏡頭同時拍照:

    在翻頁瞬間,角度完美的雙鏡頭會直接捕捉左右頁面,提供極高解析度且無變形的影像。

設備定位與普及瓶頸

這類設備單台售價高達新台幣 250 萬至 400 萬元(約 8 ~ 13 萬美元),且操作需要專業培訓與維護成本,因此主要部署於大英圖書館、奧地利國家圖書館、各國國立大學與國家級檔案館。

兩相對比下的反思

比較維度AI 公司(工業撕書掃描)國家典藏/ ScanRobot(非破壞性掃描)
核心目的快速取得文字 Token 以訓練模型永久保存人類文化遺產与原始貌
處理方式切除書脊、裁切散頁、高速掃描後碎紙銷毀60° V型托架、氣流吸附翻頁、完全不傷實體
實體下場永久消失(變成垃圾廢紙)完美留存(原件可繼續保存數百年)
成果歸屬閉源或私有 AI 模型,公眾需付費訂閱使用開放數位圖書館、研究機構與大眾免費查閱

這三則 Threads 貼文揭示了當代科技演進中最矛盾的一幕:AI 為了獲取人類文明最精華的知識而「吃掉」書籍,但真正珍惜並讓文明得以跨越世代延續的,依然是那些願意投入資源去保護實體載體的典藏技術。

這三段網路說法混合了真實技術、部分真實事件、以及誇張化敘述。可以分成兩件事來看:

  1. AI 公司是否真的買書→掃描→銷毀?
  2. Treventus ScanRobot 2.0 MDS 是否能「不破壞古籍」掃描?

一、AI 公司「掃完書就絞掉」:有真實案例,但網路敘述過度簡化

近年確實出現 AI 公司大量購買紙本書籍,用於大型語言模型(LLM)訓練資料的爭議。部分報導指出,某些公司或中間商大量收購二手書、絕版書,進行數位化後銷毀紙本。

原因主要有:

1. 高品質文字資料越來越難取得

AI 模型需要大量「人類撰寫」的文字:

  • 書籍
  • 學術論文
  • 專業教材
  • 歷史資料
  • 文學作品

因為近年網路開始充斥 AI 生成內容,有些研究與業界人士擔心未來網路資料會形成「AI 互餵污染」,因此更重視舊有人工出版品。


2. 為何掃完要銷毀?

這不是因為「AI 不需要書」,而是工業化處理考量:

傳統掃描:

一本書 → 慢慢翻頁 → 拍攝 → 保留原書

速度慢。

工業破壞式掃描:

書 → 切除書背 → 分離紙張 → 高速掃描 → 回收紙漿

速度快很多。

類似圖書館大量電子化時,也曾使用「破壞式掃描」。

但爭議在於:

如果一本書:

  • 已絕版
  • 全球只有幾本
  • 有歷史批註
  • 是私人收藏本

那它被銷毀後,文化價值可能永久消失。

因此批評者認為:

「知識被保存了,但承載知識的原件消失了。」


二、是否「AI 公司買走全世界稀有藏書」?

這部分有誇大。

目前比較可靠的說法是:

✅ 有大量收購二手書、舊書
✅ 有部分採用破壞式掃描
✅ 有法律與倫理爭議

但:

❌ 不是所有 AI 公司都這樣做
❌ 不是所有書都被銷毀
❌ 並非「圖書館珍藏全部被搬走」

例如國家圖書館、大學圖書館的珍本通常會採用保護式數位化,不會破壞原件。


三、Treventus ScanRobot 2.0 MDS:確實是真正存在的保護型掃描設備

4

奧地利公司 Treventus Mechatronics GmbH 開發的 ScanRobot 2.0 MDS 是高階自動書籍掃描系統。官方資料指出:

  • 採用 60° V 型書托
  • 減少書脊壓力
  • 自動翻頁
  • 可處理珍貴書籍
  • 最高約 2,500 頁/小時

它的理念正好與「切書掃描」相反:

方法優點缺點
破壞式掃描極快、成本低書永久消失
ScanRobot 類設備保留原書、適合古籍設備昂貴、速度較慢

四、「每小時2500頁」是真的嗎?

基本上是真的,但要理解:

2500 頁/小時 ≠ 2500 頁珍本完整處理。

實際速度受:

  • 書厚
  • 紙張狀況
  • OCR需求
  • 影像品質
  • 人員操作

影響。

例如:

一本 500 頁古籍:

理論速度:

500 ÷ 2500 × 60
≈ 12 分鐘

但實務可能需要:

  • 裝書
  • 校正
  • 檢查
  • OCR
  • 後製

可能數十分鐘以上。


五、價格 250~400 萬台幣是否合理?

大致合理。

這類設備不是一般掃描器,而是:

  • 工業級攝影系統
  • 自動翻頁機構
  • 書籍保護結構
  • 專用軟體

通常屬於:

國家圖書館、大學圖書館、檔案館等級設備

價格可能達數十萬美元級距,依配置而不同。


六、真正值得討論的問題:知識保存 vs AI 競爭

這件事其實反映一個很大的矛盾:

傳統圖書館理念:

書存在 → 人人可以借閱 → 知識公共化

AI 公司模式:

書轉成資料 → 模型吸收 → 成為私人技術資產

爭議核心不是「掃描」本身,而是:

誰擁有數位化後的知識?

例如:

一本1930年代地方志:

  • 原書只有3本
  • 被掃描
  • 紙本消失
  • OCR資料存於私人公司伺服器

問題變成:

人類文明資料是否正在從公共收藏,轉移到少數企業控制的資料庫?

這也是目前 AI 訓練資料、著作權與文化保存爭論的核心。


總結判斷

網路說法判斷
AI 公司買大量舊書訓練模型✅ 有此現象
掃完後銷毀部分書籍✅ 有報導案例
所有稀有藏書都被毀❌ 誇張
Treventus ScanRobot 真存在✅
可不破壞古籍掃描✅
每小時2500頁✅ 官方規格
價格250~400萬台幣✅ 大致合理

所以這篇 Threads 的核心訊息「AI 資料競爭造成紙本書消失危機」有其真實背景,但「AI 公司正在摧毀全世界珍貴藏書」屬於較強烈的渲染。

留言