編按:本文綜合整理自 Hacker News 討論、The Register 報導、Kernel Recipes 2026 官方議程、Daniel Stenberg 部落格,並加入 Siami 編輯部觀點與分析。
Linux 核心穩定分支的大家長 Greg Kroah-Hartman(Greg KH),10 月初在巴黎 Kernel Recipes 2026 研討會上投下震撼彈:他把 Anthropic 在 4 月公開的 Claude Mythos Preview 拿來實測,結果 79 個「重大漏洞」報告裡,只有 10 個是真的。
這個數字跟 Anthropic 當時「為什麼必須限量釋出 Mythos」的行銷話術,幾乎是完全相反的答案。
Mythos 79 個漏洞的真實分布
Greg 在演講中直接秀出他拿到 Mythos raw 報告後的分類結果(slide 文字版被 HN 用戶整理出來):
Mythos's 79 vulnerabilities:
24 - no detail at all "something crashed"
14 - not a bug at all
3 - totally made up data
15 - already fixed in latest release
(剩 23 個,最後 10 個為「真實 bugfix」)
換句話說,真正算得上新發現的漏洞只有 10 個——這 10 個全都被 Greg 跟其他 maintainers 修掉、發了 CVE,但其他 69 個不是垃圾、就是重複、就是已經修過的。
Greg 在演講第 3 分 19 秒揭穿 Mythos 的「發現」方法:純粹是 pattern matching 過去幾十年 Linux kernel 開發者修過的 patch 機制,然後把同樣模式套到其他位置看有沒有漏掉。Anthropic 沒有像「正常人」那樣在報告裡 cite 那些原始 fix 的開發者。
Mythos 在發布時被 Anthropic 包裝成「危險到必須限量釋出」的頂級資安 AI。Greg 的 79 → 10 數字等於直接打臉這個敘事。
Greg 不是唯一一個這樣講的人
Mythos 的爭議不是從 Greg 開始的,curl 創辦人 Daniel Stenberg 早在 5 月就開過第一槍。
他用 Mythos 掃了 178K 行的 curl 原始碼(src/ 跟 lib/ 子目錄),結果 Mythos 報告裡最後確認的 CVE 只有 1 個(severity low,預計 6 月底隨 curl 8.21.0 釋出)。其他 4 個是 false positive 或只是 bug。Daniel 在 部落格 原文標題就寫著 “yes, as in singular one”(只有一個,沒看錯),語氣不無諷刺。
他的結論跟 Greg KH 高度一致:
「我個人結論只能是:這模型的 hype 主要還是 marketing。我沒看到證據顯示它比 AISLE、Zeropath、Codex Security 這些工具有更高階的發現能力。」
但 Daniel 沒把話說死,他留下一段很重要的補充:
「任何沒用 AI 工具掃過自己原始碼的專案,幾乎肯定會被新世代工具找到大量瑕疵。Mythos 會找到,其他工具也會。不用 AI code analyzer 等於把先機讓給攻擊者。」
為什麼這件事重要
Mythos 案例對整個 AI 產業有三層意義,這也是 Siami 編輯部最在意的部分。
第一層:當代 LLM 對資安的真實定位
LLM 對資安確實有用——但不是「取代人類資安研究員」這麼戲劇化。Greg KH 跟 Daniel Stenberg 兩位業界最實務的 maintainer 都同意,AI 工具的價值在「快速地毯式掃描 + 把可疑點整理成人能讀的格式」,真正的判斷還是要交給人。
Greg 3 月在 KubeCon Europe 訪問時就講過一句話,被 The Register 引用後在社群傳開:
「Something happened a month ago, and the world switched. Now we have real reports.」
意思是 AI 生成的 bug report 在某個時間點之後,品質從垃圾變成可用的真實報告——但這個轉折是「品質變好」不是「取代人類」。Greg 在 9 月 Kernel Recipes 演講則補了另一半:「可以是可以,但你還是得自己看 code 自己驗。」
第二層:hype 機器對開源社群的傷害
Anthropic 當時用「這個模型太危險所以不能公開」的說法限制 Mythos 釋出,只透過 Linux Foundation 跟 Project Glasswing 給特定 open source 專案(包括 curl、Linux、FreeBSD、OpenBSD、FFmpeg 等)優先使用權。
但「危險所以限量」這套話術的代價是:媒體放大、群眾恐慌、policy maker 開始認真考慮 AI 監管(Anthropic CEO Dario Amodei 還因此去見了教宗)。結果 Greg 跟 Daniel 實測之後告訴你,這個「危險」沒那麼危險。
這跟過去 Sam Altman 說 GPT-3 太危險、內部 Gemini 早期版本「有意識」是同一套 PR 模式。Anthropic Mythos 不是新招,只是 play 得更精緻。
第三層:open source maintainer 的真實負擔
Greg 5 月時還跟 Linus Torvalds 一起公開警告:Linux kernel 的 security mailing list 已經被 AI 生成的 bug report 塞爆。Linus 直接說那個 list「almost entirely unmanageable」。Torvalds 在 Linux 7.1 RC4 公告裡定了新規矩,要求 AI 生成的 report 必須經人類過濾才能送出。
Greg 的演講則把這個觀察往下推進一步:Mythos「79 個漏洞」這種誇大敘事,最後要處理的是 maintainer,不是 Anthropic。Linux kernel 志願 maintainer 群本來就人力不足,現在還要每週消化幾十份「『something crashed』」這種無用 report——這對 open source 生態是實質負擔,不是抽象問題。
數據解讀:Mythos 到底抓到了什麼?
把 Mythos 在 4 月發表時的官方 claim 跟後續實測對照,可以整理成一張表:
| Mythos 原始宣稱 | Greg KH 實測 | Daniel Stenberg 實測 |
|---|---|---|
| Linux kernel 多個 zero-day | 79 個報告 → 10 個真 bug | N/A |
| 「危險到必須限量釋出」 | 純 pattern matching 過去 patch | marketing stunt |
| OpenBSD 27 年漏洞 | Mythos 抓到,確認存在 | N/A |
| FreeBSD CVE-2026-4747 NFS 遠端 root | Mythos 抓到,確認存在 | N/A |
| FFmpeg 16 年 codec flaw | Mythos 抓到,確認存在 | N/A |
| Linux CVE-2026-31402 NFS heap overflow | 不是 Mythos,是 Claude Code 較早找到 | N/A |
| curl 漏洞 | N/A | 1 個 low severity CVE |
Mythos 不是完全沒用——它確實抓到了 OpenBSD 那個 27 年歷史的 TCP SACK 整數溢位(可遠端 DoS),還有 FreeBSD NFS stack buffer overflow(能拿 unauthenticated 遠端 root),以及 FFmpeg 16 年 codec 漏洞。但這些「明星級」發現的數量,跟當初 79 個 / 「thousands of zero-days」的行銷規模明顯有落差。
真正能 match Mythos 能力的工具是 AISLE,但 AISLE 用的是「很多小模型 + 自建系統」而不是單一最大 frontier model。這反過來暗示:Anthropic 賣給你的不只是模型,是整套流程。
Greg KH 對開發者的實際建議
Greg 在演講尾聲給 Linux kernel contributor 的建議很具體,也適用於一般開發者:
- 不要把 LLM 寫的 patch 直接送進 kernel staging area(Greg 2026 年 4 月已正式禁止)
- 「NEVER upload any non-public information」(公司機密給 LLM 會被拿來訓練,之後可能洩漏給別人 prompt 的人)
- 「Ignore the comments, look at the code」(LLM 寫的 code 比它的說明文字可靠;說明常常錯)
- bug 報告要可重現:附 commit hash、config、reproduction steps——這跟 AI 工具無關,是基本功
HN 上有人用一個比喻總結 Greg 的立場:
「現在所有頂級 LLM 都像 eager bright 20 歲的 intern——充滿幹勁、書讀很多,但沒有真實世界經驗。放著讓他自己跑你會後悔。但如果你能引導他、監督他每一動,有些價值就會浮現。」
接下來會發生什麼
Siami 編輯部追蹤這條線後,認為三個後續值得關注:
-
Anthropic 是否會對 Greg KH 的 79 → 10 數字公開回應?截至目前(2026-10-04)沒有任何公開聲明。Anthropic 的 4 月 Project Glasswing 報告仍把 79 個 Linux kernel 漏洞列為重要成果。
-
Linux kernel security list 的 AI 報告新規範能否落實?Torvalds 5 月的指引是軟性勸說,Greg 9 月的演講則把「該怎麼 reject AI-generated 假報告」的 SOP 講得更具體。下一個 LTS kernel(7.2)會是觀察點。
-
Mythos 6 與 Fable 5 的後續:根據 Anthropic 2026 年 6 月公告,Fable 5 是 Mythos-class 第一個公開釋出的 tier,Mythos 5 / 6 還在內部測試。Greg KH 的 79 → 10 分析,可能會被 Fable 5 拿來當 benchmark。
本文主要素材:Kernel Recipes 2026 Greg KH 演講(YouTube 連結)、Hacker News 討論串、The Register 2026-03-26 訪問、The Register 2026-05-18 Torvalds 警告、Daniel Stenberg 部落格文章、kernel-recipes.org 2026 議程。Siami 編輯部獨立分析。
網友熱門留言 (5)