← 返回 Siami 首頁

AI 與 X 光聯手破譯 2000 年封印:赫庫蘭尼姆捲軸首次被完整讀出

▲ 739 💬 261
AI 與 X 光聯手破譯 2000 年封印:赫庫蘭尼姆捲軸首次被完整讀出

編按:本文綜合整理自 Vesuvius Challenge 官方公告、Hacker News 討論串,並加入 Siami 編輯部觀點與分析。

公元 79 年,維蘇威火山爆發,羅馬龐貝城與鄰近的赫庫蘭尼姆(Herculaneum)瞬間被埋在滾燙的火山灰下。一座巨大的希臘化羅馬圖書館——赫拉克利德斯的「紙莎草別墅」(Villa dei Papiri)——也連同數百卷碳化捲軸一起被封存。過去兩千年,學者只能眼睜睜看著它們變成脆弱的焦炭;要打開它,等於毀了它。

2026 年 6 月 25 日,這個僵局被打破。Vesuvius Challenge 團隊宣布:人類首次完整讀出一卷赫庫蘭尼姆捲軸——PHerc. 1667(俗稱 Scroll 4)——而且從頭到尾、沒有碰過它的一片紙。


從焦炭到可閱讀的全貌

PHerc. 1667 原本是一支黑色碳化的捲狀物。團隊用以下步驟把它的文字救回來:

  1. 高解析度相位對比 X 光顯微斷層掃描(phase-contrast X-ray microtomography),在法國格勒諾布爾的歐洲同步輻射光源 ESRF 的 BM18 線站完成。
  2. 重建捲軸內部幾何結構,把螺旋狀的紙莎草一層一層追蹤、攤平。
  3. 機器學習模型偵測墨跡——這種墨跟碳化的紙幾乎同色,肉眼與傳統影像分不出來。
  4. 紙草學家逐欄轉錄、校對,最後彙整成可閱讀的希臘文文本。

整個流程從資料到程式碼全部開源(scrollprize.org/data、GitHub: ScrollPrize/villa),採用 Creative Commons 授權。任何人想驗證、想接手讀下一卷,都可以做到。

過去兩千年,這座碳化圖書館的條件是殘酷的:捲軸靠著「變脆」才活了下來。要讀它,就得毀它。數百卷的內容因此一直處在「被保存、卻無法觸及」的狀態。今天,這個規則被改寫了。


三卷捲軸,三個里程碑

Vesuvius Challenge 這次不是只讀一卷,而是同步推進三項突破:

PHerc. 1667:史上第一次「從頭到尾」讀完一卷

這卷在 19 世紀、1969 年、1980 年代曾被多次嘗試手動打開,每次都毀掉外層。最後只剩下大約 8 公分高的內核,原本應該是 19 到 24 公分高。這次,團隊把殘存的二十二欄希臘文完整轉錄出來。這是第一次「連續讀完一整卷」,不是只辨識幾個字或幾個段落。

讀出的內容是一篇斯多葛學派的倫理學論文,主題圍繞人性、衝動與道德進步。最後一欄提到一個名字:阿里斯托克雷翁(Aristocreon)——大斯多葛學者克律西波斯(Chrysippus)的外甥與弟子。加上語言與主題線索,學者把這部作品定位在西元前 2 世紀的斯多葛文獻。

雖然紙面有破損,但仍能讀出兩千年來首見的段落,例如:

「…我們會探問某件事,但如果我們以某種方式偏離了自己與自己的本性,我們就抓不到它…」

「…我們已經竭盡所能地研究、學習…擁有同樣的實踐智慧…」

「…對我們而言,這些就是善;即使是從相反的惡來看,也不會有什麼善——更不用說美——也不會有什麼惡——更不用說醜——也不會有幸福…」

完整逐欄轉錄收在團隊釋出的 preprint PDF。

PHerc. Paris 4(Scroll 1):用更高解析度「看見」墨跡

第二個突破發生在 Scroll 1。新的高解析度技術讓墨跡直接在捲軸內部的三維 X 光資料中變得可見。把三維墨跡切出來、投影回攤平的紙面,得到的文字與 2023 年 Grand Prize 贏家讀出的版本一對一完全吻合——這是用更好的資料、從完全獨立的路徑再次確認:那個讀法是真的。

PHerc. 139:閉合捲軸的「書名 + 作者」

第三個突破在 PHerc. 139。團隊讀出它的標題與作者署名:作品是伊比鳩魯學派哲學家菲洛德穆斯(Philodemus)的《論眾神》第八卷。赫拉克利德斯圖書館裡很大一部分就是菲洛德穆斯的著作;能在捲軸還沒被打開前就讀出標題,學者就能在展開正文之前先知道手上這卷在談什麼。


為什麼這件事重要

這不是「又一個 AI 應用案例」。這是人類第一次在不破壞的前提下,把一卷兩千年前的焦炭變成可閱讀的書。具體而言:

  • 可規模化:同一套流程(X 光 + 幾何重建 + 機器學習墨跡偵測 + 開源)已經在另外兩卷上獨立驗證。它不是「只能用在 PHerc. 1667」的特化模型。
  • 可被重複驗證:資料、模型、程式碼全部開源。任何研究團隊都能拿原始 X 光、自己重新跑一遍、挑戰結果。
  • 保護文化資產:赫庫蘭尼姆的「紙莎草別墅」藏有數百卷捲軸,被視為古典學界最大的未解之謎之一。傳統的「打開即毀」是零和遊戲;現在變成非破壞性的資料採集。
  • AI 解決了一個被認為「只剩人力」能做的問題:早期 18、19 世紀學者嘗試用機械展開(Piaggio 機器)失敗;1990 年代起的多光譜、紅外線、中子造影也只讀出零碎字元。這次是 AI 模型第一次完整解開一卷——而且是在學者公開承認「卡關」之後。

編按:這條技術路線的關鍵人物是 Brent Seales 教授(EduceLab),他從 2000 年代起就在鑽研「虛擬展開」(virtual unwrapping)技術。2023 年他和 GitHub 前 CEO Nat Friedman、創投家 Daniel Gross 共同創辦 Vesuvius Challenge,把這項技術從實驗室推向開源社群。


數據解讀與質疑

雖然成果驚人,讀者也要注意三個限制:

  1. 捲軸殘缺程度不一。PHerc. 1667 只剩下原來高度的 1/3 到 1/2,外層早被前人破壞。讀出的二十二欄是「殘存」的二十二欄,不是當年全卷的完整文字。研究團隊在公告中明確指出:text is fragmentary,文字有缺漏。
  2. 墨跡偵測的 AI 模型仍可能漏字、誤字。機器學習在「碳化的紙 vs. 碳化的墨」之間拉出訊號差,但這條界線非常細。Vesuvius Challenge 強調「每一欄都由紙草學家逐欄轉錄、校對」,但我們目前還沒看到獨立第三方團隊拿相同資料重跑後得出的逐字比對。
  3. 「開放」不等於「無授權」。捲軸本體由義大利那不勒斯國家圖書館(Biblioteca Nazionale di Napoli “Vittorio Emanuele III”)持有。掃描資料、衍生模型、轉錄文本是 CC 授權;但若要把研究成果商用、出版或改編,需要再與館方與義大利文化資產主管機關協商。

另外,這次的「獎金制度」值得注意:Vesuvius Challenge 用「公開競賽 + 獎金」動員了全球社群,多數後來進入研究團隊的成員原本是參賽者。這是一個開源模式跑出真實科學突破的少數案例,與傳統「實驗室 → 期刊 → 引用」的線性模型形成對比。


影片與延伸素材


讀者怎麼參與

Vesuvius Challenge 把接下來的捲軸閱讀工作全面開源。讀者可以:

赫庫蘭尼姆的圖書館有數百卷等待被讀。PHerc. 1667 只是第一卷。下一卷是誰讀、用什麼模型讀、讀出什麼內容——這個問題現在屬於整個開源社群。

網友熱門留言 (5)

#1 Hacker News 讀者 ▲ 1266
讓我們想想 200 BC 的阿里斯托克雷翁。他寫下這些思想的時候,可能設想它會在圖書館保存一段時間,也許三百年。但他不會想到三百年後一座火山會摧毀這卷、卻又以某種方式保存了它。然後差不多兩千年後,未來人類用他和沙子、閃電有遠親關係的『材料』做成的機器,把捲軸重新讀出來、瞬間傳給整個星球上比他那個時代多無數倍的人。
#2 Hacker News 讀者 ▲ 412
從 2000 年的焦炭裡恢復文字片段,對他們來說一定難以置信;但『把書保存數千年』這件事本身,他們不會太驚訝。在古騰堡印刷術之前,抄寫員手抄羊皮紙的效率其實很高。許多古文明的經典,最古老的手抄本往往比原作晚數百年、甚至上千年才抄出來,而且常常不是原語言。
#3 Hacker News 讀者 ▲ 287
抄寫員主動抄書,是連續性的保存工作,需要持續努力(和資金),而且要事先規劃。它是勞動。但正如你最後一句話指出的,它不只允許錯誤,還『容許』錯誤——翻譯本身就是詮釋行為。相對地,從 2000 年的焦炭救回文字,在文化上等同於『復活』。就像找到一個被冰封的古代人(古代冷凍艙),然後解凍——這本身在科學上就是『復活死者』的一個子集合。
#4 Hacker News 讀者 ▲ 203
古希臘人早就學會用光和火把資料傳到遠方。烽火跟光纖電纜差別有多大?但我覺得他們會更驚訝的是我們發明了社群媒體和 AI 這種『會摧毀大腦』的東西。古代社會比我們更重視智慧,也更謹慎地引入新技術。我讀到連『書寫』這種今天被視為萬能的好東西,當年也曾被嚴格檢視過。
#5 Hacker News 讀者 ▲ 156
我猜那個年代對『從靜態文本教學』的批評,跟現代教育理論蠻合的。當時對照口述傳統、強調記憶的教學,老師會感嘆:學生不只因為知道可以『查書』而不再背誦,也因此失去了良好的記憶力與脈絡回想能力——這是很重要的生活技能。