編按:本文綜合整理自 Anthropic 官方部落格〈Bringing the cybersecurity capabilities of Claude Mythos 5 to more defenders〉、Hacker News 討論串(48 則留言),並加入 Siami 編輯部觀點與分析。
Anthropic 在 2026 年 8 月 21 日正式將旗下最強的資安專用模型 Claude Mythos 5 從封閉測試推進到更廣泛的防禦場景,並同步啟動一項 3,500 萬美元額度的 Defender Advantage Fund(0xDAF) 計畫,要把開源軟體的修漏洞能量補上來。這是繼 4 月 Project Glasswing 把 Mythos Preview 交給少數關鍵基礎設施防守方之後,Anthropic 在「最危險模型 vs. 防禦者」之間第二次重大表態。
Mythos 5 與 Fable 5 的分工邏輯
Anthropic 把模型拆成兩條線來管:
- Mythos 5:研究級 / 高風險模型。完整保留攻擊與防禦雙重用途,但只有防禦者能拿到。
- Fable 5:廣泛開放給一般使用者,但已用分類器與防護機制封鎖掉所有「雙重用途網路攻擊」行為。
這次的更新,Anthropic 把 Mythos 5 推進到「介面後台」與「產出物層」:
- 與資安廠商合作,把 Mythos 5 嵌進既有的漏洞管理、修補建議、威脅情資產品中。
- Claude Security(公測中)正式開放 Claude Enterprise 客戶用 Mythos 5 掃自家 codebase 並拿到修補建議。
- Cyber Verification Program 預計數週內擴大,讓已認證的防禦者享有 Opus 與 Sonnet 的「降級防護」,再延伸到 Mythos 等級。
重點設計:使用者不直接碰到模型。他們拿到的是漏洞修補清單、安全告警、CWE 分類與信心評分。模型本身被鎖在後台,無法被 prompt injection 引導到攻擊用途。
Defender Advantage Fund:$35M 美元要做什麼
新基金 0xDAF(Defender Advantage Fund) 把 3,500 萬美元的 Claude API credits 發給三類對象:
- 修補被廣泛使用的開源專案的現行漏洞。
- 自動化掃描與修補流程,開源給其他專案複製。
- 嘗試「對抗整類攻擊」的更激進安全設計(例如記憶體安全、形式化驗證、預設安全 API)。
這是 Project Glasswing 期間已捐出 $4M 美元給開源安全組織、支援 Akrites 與 Gold Eagle 兩項協調式漏洞修補行動之後,Anthropic 第二次大手筆投入開源資安。
| 計畫 | 規模 | 對象 | 重點 |
|---|---|---|---|
| Project Glasswing(4 月) | $4M 直捐 + API credits | 受邀的關鍵基礎設施防守方 | 取得 Mythos Preview 早期使用權 |
| Defender Advantage Fund(8 月) | $35M API credits | 開源社群與修補組織 | 修補現行漏洞、自動化、整類攻擊防� |
為什麼這件事重要
把 Mythos 5 從「少數受邀者」推進到「任何用 Claude Security 的 Enterprise 客戶」與「任何整合 Mythos 的資安產品廠商」,是 Anthropic 在 AI 資安領域的策略大轉彎——也是對 OpenAI Cyber Trusted Access 的正面競爭。
- 防守方的能量被結構性放大。原本一個安全團隊要養自己的漏洞掃描團隊或購買昂貴的 SAST/DAST 工具,現在只要開 Claude Security 就能用 Mythos 5 級模型掃自己的 codebase。對中小型企業與開源維護者特別有意義。
- AI 雙重用途風險的真實壓力測試。Anthropic 選擇的解法不是把模型鎖死,而是「控制介面、控制產出物」。這套設計若成功,會成為其他前沿模型廠商的範本;若失敗,會被監管單位拿來當作「無法負責任地釋出」的證據。
- 開源供應鏈安全拿到實質資源。3,500 萬美元的 credits 比多數政府補助更直接——開源維護者最缺的是運算資源與掃描工具,credits 正好打中痛點。HN 上也有留言指出,這個金額相對於一次 HAWK 等級攻擊就要 $100K 美元,其實不算多。
- 與 OpenAI、xAI、Google 的資安計畫正式進入軍備競賽。OpenAI Cyber Trusted Access、Google 的 AI Cyber Defense Initiative、xAI 的 Grok 安全應用各自有不同路線——Anthropic 用「基金 + 模型後台嵌入」的雙軌策略,最接近傳統資安產業的運作模式。
數據解讀與質疑
幾個值得放大檢視的點:
- 3,500 萬美元看起來很多,對照實際攻擊成本其實很少。HN 用戶 janpeuker 指出,光是 Anthropic 自己揭露的 HAWK 等級攻擊研究,一個漏洞就要約 $100K 美元成本。35M credits 全部用來跑漏洞掃描與修補,能覆蓋的漏洞數量是有限的天花板。
- 「介面後台」不等於「無法被引導」。HN 用戶 vasco 實測同一個 Mythos 等級模型在對話裡拒絕 exploit 概念驗證,但換到新分頁、換個說法就能繞過。這說明 Anthropic 的「output-only」策略對直接 API 使用者是有效的,但對透過資安產品介面拿到模型產出的使用者來說,仍然有 prompt injection 與「社交工程式 prompt」風險。
- CTF 圈的負面反應很一致。HN 用戶 tristor 直接說 Claude / Sol 在 CTF 場上「基本上沒用」,而 Qwen、DeepSeek、GLM 在本地或 OpenRouter 上跑得順。這意味著 Mythos 5 的「防禦定位」可能反而讓它在一般資安研究場景中變得不實用——資安研究往往游走在攻擊與防禦之間,被嚴格分類器擋掉之後,研究價值會被稀釋。
- Cyber Verification Program 申請門檻仍不明。HN 用戶 TZubiri 質疑審核流程「看起來超嚴」,目前沒有人公開分享通過經驗。Anthropic 沒有揭露具體的合規標準,這對中小型安全團隊是實際摩擦成本。
- 「AI 寫的公告」的批評值得注意。HN 用戶 janpeuker 直接說「以戰時狀態進入網路領域、不斷修補漏洞」這類用語「太 AI 味」。Anthropic 的對外溝通品質,可能正在成為另一個被放大檢視的問題。
怎麼申請
- 企業用戶:在 Claude admin console 啟用 Claude Security,從
claude.ai/security挑選 repository 開始 Mythos 5 掃描。 - 資安產品廠商:到 Claude 官方網站註冊「打造 Mythos 整合產品」興趣表單。
- 開源安全組織:等待 Anthropic 數週內公布的 Defender Advantage Fund 首輪補助名單。
- 既有 Cyber Verification Program 成員:不需動作,Anthropic 會主動聯繫擴大範圍。
編按:本文綜合整理自 Anthropic 官方部落格〈Bringing the cybersecurity capabilities of Claude Mythos 5 to more defenders〉(2026-08-21)、Hacker News 討論串 #49392331,並加入 Siami 編輯部觀點與分析。文中所有 HN 留言引言皆為翻譯,原文以英文呈現於討論串中。
網友熱門留言 (6)