← 返回 Siami 首頁

Anthropic 將 Claude Mythos 5 資安防禦能力下放給企業與開源社群 並啟動 3,500 萬美元 Defender Advantage Fund

▲ 33 💬 48
Anthropic 將 Claude Mythos 5 資安防禦能力下放給企業與開源社群 並啟動 3,500 萬美元 Defender Advantage Fund

編按:本文綜合整理自 Anthropic 官方部落格〈Bringing the cybersecurity capabilities of Claude Mythos 5 to more defenders〉、Hacker News 討論串(48 則留言),並加入 Siami 編輯部觀點與分析。

Anthropic 在 2026 年 8 月 21 日正式將旗下最強的資安專用模型 Claude Mythos 5 從封閉測試推進到更廣泛的防禦場景,並同步啟動一項 3,500 萬美元額度的 Defender Advantage Fund(0xDAF) 計畫,要把開源軟體的修漏洞能量補上來。這是繼 4 月 Project Glasswing 把 Mythos Preview 交給少數關鍵基礎設施防守方之後,Anthropic 在「最危險模型 vs. 防禦者」之間第二次重大表態。


Mythos 5 與 Fable 5 的分工邏輯

Anthropic 把模型拆成兩條線來管:

  • Mythos 5:研究級 / 高風險模型。完整保留攻擊與防禦雙重用途,但只有防禦者能拿到。
  • Fable 5:廣泛開放給一般使用者,但已用分類器與防護機制封鎖掉所有「雙重用途網路攻擊」行為。

這次的更新,Anthropic 把 Mythos 5 推進到「介面後台」與「產出物層」:

  • 與資安廠商合作,把 Mythos 5 嵌進既有的漏洞管理、修補建議、威脅情資產品中。
  • Claude Security(公測中)正式開放 Claude Enterprise 客戶用 Mythos 5 掃自家 codebase 並拿到修補建議。
  • Cyber Verification Program 預計數週內擴大,讓已認證的防禦者享有 Opus 與 Sonnet 的「降級防護」,再延伸到 Mythos 等級。

重點設計:使用者不直接碰到模型。他們拿到的是漏洞修補清單、安全告警、CWE 分類與信心評分。模型本身被鎖在後台,無法被 prompt injection 引導到攻擊用途。


Defender Advantage Fund:$35M 美元要做什麼

新基金 0xDAF(Defender Advantage Fund) 把 3,500 萬美元的 Claude API credits 發給三類對象:

  • 修補被廣泛使用的開源專案的現行漏洞。
  • 自動化掃描與修補流程,開源給其他專案複製。
  • 嘗試「對抗整類攻擊」的更激進安全設計(例如記憶體安全、形式化驗證、預設安全 API)。

這是 Project Glasswing 期間已捐出 $4M 美元給開源安全組織、支援 Akrites 與 Gold Eagle 兩項協調式漏洞修補行動之後,Anthropic 第二次大手筆投入開源資安。

計畫規模對象重點
Project Glasswing(4 月)$4M 直捐 + API credits受邀的關鍵基礎設施防守方取得 Mythos Preview 早期使用權
Defender Advantage Fund(8 月)$35M API credits開源社群與修補組織修補現行漏洞、自動化、整類攻擊防�

為什麼這件事重要

把 Mythos 5 從「少數受邀者」推進到「任何用 Claude Security 的 Enterprise 客戶」與「任何整合 Mythos 的資安產品廠商」,是 Anthropic 在 AI 資安領域的策略大轉彎——也是對 OpenAI Cyber Trusted Access 的正面競爭。

  1. 防守方的能量被結構性放大。原本一個安全團隊要養自己的漏洞掃描團隊或購買昂貴的 SAST/DAST 工具,現在只要開 Claude Security 就能用 Mythos 5 級模型掃自己的 codebase。對中小型企業與開源維護者特別有意義。
  2. AI 雙重用途風險的真實壓力測試。Anthropic 選擇的解法不是把模型鎖死,而是「控制介面、控制產出物」。這套設計若成功,會成為其他前沿模型廠商的範本;若失敗,會被監管單位拿來當作「無法負責任地釋出」的證據。
  3. 開源供應鏈安全拿到實質資源。3,500 萬美元的 credits 比多數政府補助更直接——開源維護者最缺的是運算資源與掃描工具,credits 正好打中痛點。HN 上也有留言指出,這個金額相對於一次 HAWK 等級攻擊就要 $100K 美元,其實不算多。
  4. 與 OpenAI、xAI、Google 的資安計畫正式進入軍備競賽。OpenAI Cyber Trusted Access、Google 的 AI Cyber Defense Initiative、xAI 的 Grok 安全應用各自有不同路線——Anthropic 用「基金 + 模型後台嵌入」的雙軌策略,最接近傳統資安產業的運作模式。

數據解讀與質疑

幾個值得放大檢視的點:

  • 3,500 萬美元看起來很多,對照實際攻擊成本其實很少。HN 用戶 janpeuker 指出,光是 Anthropic 自己揭露的 HAWK 等級攻擊研究,一個漏洞就要約 $100K 美元成本。35M credits 全部用來跑漏洞掃描與修補,能覆蓋的漏洞數量是有限的天花板。
  • 「介面後台」不等於「無法被引導」。HN 用戶 vasco 實測同一個 Mythos 等級模型在對話裡拒絕 exploit 概念驗證,但換到新分頁、換個說法就能繞過。這說明 Anthropic 的「output-only」策略對直接 API 使用者是有效的,但對透過資安產品介面拿到模型產出的使用者來說,仍然有 prompt injection 與「社交工程式 prompt」風險。
  • CTF 圈的負面反應很一致。HN 用戶 tristor 直接說 Claude / Sol 在 CTF 場上「基本上沒用」,而 Qwen、DeepSeek、GLM 在本地或 OpenRouter 上跑得順。這意味著 Mythos 5 的「防禦定位」可能反而讓它在一般資安研究場景中變得不實用——資安研究往往游走在攻擊與防禦之間,被嚴格分類器擋掉之後,研究價值會被稀釋。
  • Cyber Verification Program 申請門檻仍不明。HN 用戶 TZubiri 質疑審核流程「看起來超嚴」,目前沒有人公開分享通過經驗。Anthropic 沒有揭露具體的合規標準,這對中小型安全團隊是實際摩擦成本。
  • 「AI 寫的公告」的批評值得注意。HN 用戶 janpeuker 直接說「以戰時狀態進入網路領域、不斷修補漏洞」這類用語「太 AI 味」。Anthropic 的對外溝通品質,可能正在成為另一個被放大檢視的問題。

怎麼申請

  • 企業用戶:在 Claude admin console 啟用 Claude Security,從 claude.ai/security 挑選 repository 開始 Mythos 5 掃描。
  • 資安產品廠商:到 Claude 官方網站註冊「打造 Mythos 整合產品」興趣表單。
  • 開源安全組織:等待 Anthropic 數週內公布的 Defender Advantage Fund 首輪補助名單。
  • 既有 Cyber Verification Program 成員:不需動作,Anthropic 會主動聯繫擴大範圍。

編按:本文綜合整理自 Anthropic 官方部落格〈Bringing the cybersecurity capabilities of Claude Mythos 5 to more defenders〉(2026-08-21)、Hacker News 討論串 #49392331,並加入 Siami 編輯部觀點與分析。文中所有 HN 留言引言皆為翻譯,原文以英文呈現於討論串中。

網友熱門留言 (6)

#1 Hacker News 用戶 jnwatson ▲ 87
問題是「網路安全」不是只有安全團隊才會做的事。在我維護的開源專案中,我會找 bug、修 bug,有些 bug 最終會變成本地權限提權漏洞。我寫 regression test 然後修 bug —— 但生成這類 bug 的 regression test 在技術上就是 PoC。我幾乎永遠無法讓 Fable 寫出來,Opus 5 有時也會推給別人,Sol、Luna 也一樣。除非我用社交工程的方式引導模型。這才是真正的問題。
#2 Hacker News 用戶 tristor ▲ 64
我發現 Claude / Sol 在處理允許使用 AI 工具的 CTF 賽題時基本上沒什麼用,但本地跑 Qwen、DeepSeek,或用 OpenRouter 接 GLM 都順得很。任何一個跟資安沾上邊的人都看得出來,Anthropic 現在這個立場對安全社群來說是笨到不行又有害的。
#3 Hacker News 用戶 vasco ▲ 71
這週我在公司 codebase 裡找到兩個問題。找到之後我跟一個 Claude 對話提到其中一個,要它做 exploit 概念驗證展示 —— 它拒絕,連在同一個對話裡做些簡單的事也跟著拒絕。但同一個模型在新分頁裡,換個說法「幫我做個打到某 endpoint 的頁面、payload 是特殊值」,它馬上就做出上一個對話被認為太危險的事。
#4 Hacker News 用戶 janpeuker ▲ 55
Defender Advantage Fund(0xDAF)只給 $35M 美元額度其實不多——光是 HAWK 那種攻擊一個漏洞就要 $100K 美元了。順帶一提,Anthropic 那句「以戰時狀態進入網路領域、不斷修補漏洞」實在太 AI 味了,搞不好這筆錢就是給這個用的。
#5 Hacker News 用戶 TZubiri ▲ 42
Claude Security 計畫看起來跟 OpenAI 的 Cyber Trusted Access 很像。審核流程看起來超嚴,有人真的通過這些合規標準了嗎?
#6 Hacker News 用戶 zeafoamrun ▲ 38
Anthropic 這套完全是廢話。我已經用 Sol 5.6 做安全稽核,表現超棒,而且它不會每次回答都給我一段 AI 嘔吐物。