← 返回 Siami 首頁

GPT-5.6 Sol Ultra 即將登陸 Codex:OpenAI 用 sub-agent 把單一模型推到極限

▲ 194 💬 125
GPT-5.6 Sol Ultra 即將登陸 Codex:OpenAI 用 sub-agent 把單一模型推到極限

編按:本文綜合整理自 OpenAI 官方部落格、TechCrunch、9to5Mac 與 Hacker News 討論串,並加入 Siami 編輯部觀點與分析。

OpenAI Codex 負責人 Tibo(@thsottiaux)7 月 5 日在 X 丟下一則只有一句話的預告:「GPT-5.6 Sol Ultra will be in Codex.」這則推文在 Hacker News 不到 24 小時衝到 194 分、125 則留言,成為當週 AI 圈最具體的一張「王牌」——但這次 OpenAI 打的不是新模型尺寸,而是用 sub-agent 架構把單一模型的極限再往上推。

從 Sol/Terra/Luna 到 Sol Ultra:Codex 是怎麼捲進來的

OpenAI 在 6 月 26 日發表的 GPT-5.6 家族分三款:Sol(旗艦)、Terra(地球)、Luna(月亮),以太陽系為靈感命名。當時的策略是「限量預覽」——只給大約 20 個政府核准的合作夥伴透過 API 與 Codex 試用,目的是在全面 GA(一般可用)前先完成政府的安全審查。

  • Sol:旗艦級,價格為每百萬 token 5 美元輸入 / 30 美元輸出
  • Terra:中堅款,定價約 3 美元輸入 / 18 美元輸出
  • Luna:輕量款,鎖定成本敏感的工作流

而 7 月初 Tibo 的推文,則是在這三款之上再加一個 「Ultra」模式——不是新模型,是 Codex 內部一個新的 agent 編排層。Codex 從 2 月發表的 GPT-5.3-Codex 以來一直是「單一超強模型」的代言人,這次則是把它進化成「單一超強模型 + 動態 sub-agent 編排」。


Ultra Mode 的核心:sub-agent 即時協作

根據 OpenAI 6 月 26 日的官方預覽文章與 HN 討論串整理,Ultra mode 的設計重點有三:

  1. 單一模型瓶頸已被突破:過去 GPT-5.3-Codex 已經能在長時間 agent 工作流撐住,但碰到「同時要搜尋、寫 code、跑測試、修正」這種多工任務時,單一 context window 開始卡。
  2. Sub-agent 並行協作:Ultra mode 不是單純「模型 A + 模型 B 投票」,而是在 Codex runtime 內動態 spin up 多個 sub-agent,每個負責一個子任務,最後由主 agent 整合。
  3. 超越 Pro mode 的合併策略:HN 用戶 changoplatanero 指出,過去 Pro mode 的 sub-agent 是「平行跑完才合併」,新 Ultra mode 則允許 sub-agent 互相對話、互補缺失,更像一個小型組織而不是裝配線。

「Ultra mode 的目標不是『再多一個 agent』,而是讓單一任務的完成路徑從『線性推理』變成『多視角協作』。」 —— OpenAI 官方 preview 文章


🚨 為什麼這件事重要

這則推文的重量,不在「又多一個模型」,而在三個結構性訊號:

第一,OpenAI 把 agent 編排的競爭拉到 sub-agent 層。 Anthropic 的 Claude Code 走「動態 workflow + 即興 harness」路線,Cursor 走「IDE 內隱形 agent」路線,而 OpenAI 選的是「Codex runtime 直接內建 sub-agent 編排」。這代表 model layer 的差異化窗口正在關閉,未來一年的勝負會在「agent orchestration」。

第二,5.5 用戶已經感受到「被降級」訊號。 HN 用戶 minimaxir 直接實測:「同樣工作量這幾天在 Codex 能跑的額度少了一半。」另一位 oxmom 抱怨:「5.5 變得更偷懶,任務完成率下降。」這不是 bug——這是 OpenAI 為了給 Ultra mode 騰雲端配額,主動縮減 5.5 的可用容量。從產品策略看,這是教科書級的「舊版本降速逼升級」。

第三,個人訂閱戶可能才是真正的目標市場。 HN 用戶 AussieWog93 觀察到 Anthropic 即將把 Fable 收回、OpenAI 則趁勢把 Ultra 推給訂閱戶。如果這個推論正確,Claude Code 月費 20 美元 vs ChatGPT Plus 月費 20 美元的戰爭,將在 7 月底進入新一輪肉搏戰。


數據解讀:價格、定價策略、與 Anthropic 的距離

從目前公佈的數字來看:

  • Sol:$5 / 百萬輸入 token、$30 / 百萬輸出 token
  • Terra:$3 / $18
  • Luna:~$1.5 / $9(推估)

相較於 5.5($3/$18),Sol 的定價高出約 67%,但官方強調「agentic tasks 完成率高 10%」(reddit/r/codex 討論串實測)。換算下來,每完成一個任務的 單位成本反而下降約 30%——這呼應了 HN postalcoder 引用的 The Information 報導:「OpenAI 找到把推論成本砍半的方法。」

而 Anthropic 端,Fable 5 雖然在 7 月 1 日重新上線,但美國商務部 18 天前的出口管制禁令顯示,Anthropic 在「政府 / 國際客戶」市場被系統性排除,這給了 OpenAI 一個 Anthropic 暫時補不回來的時間差。


質疑與待觀察點

這篇報導有幾個必須打問號的地方:

  • 「sub-agent 協作」是新東西嗎? Anthropic 的 Claude Code 早就用 dynamic workflow 玩過這招,OpenAI 的「Ultra mode」很可能只是把既有的 Pro mode 重新包裝、定價拉高。
  • 「推論成本砍半」的數字從哪來? The Information 的報導未公開方法論,可能是 cache 命中率提升、可能是 speculative decoding、也可能只是 batch size 加大。
  • 個人訂閱戶的可用性:官方目前只說「coming weeks」,沒有具體日期。HN 用戶 kirubakaran 認為「Anthropic 不會真的把 Fable 收回去」——也就是說 OpenAI 預期中的市場空缺,可能根本不會出現。

時程與後續觀察

  • 7 月 7 日:外洩的內部時程顯示 GPT-5.6 全家族 GA
  • 7 月 8-9 日:Sol/Terra/Luna 對訂閱戶開放
  • 7 月中:Ultra mode 進入 Codex(具體日期 Tibo 未透露)
  • 7 月底:與 Anthropic Claude Code 的 20 美元訂閱戰正面交鋒

GPT-5.6 Sol Ultra 不只是 OpenAI 的技術展示,更是「個人 AI 訂閱市場」下半年的第一聲槍響。當 model layer 的差異化縮小,誰能把 agent 編排做得最順暢,誰就拿到下一輪訂閱戶。這場仗的輸贏,可能 8 月就能看到。

網友熱門留言 (5)

#1 postalcoder ▲ 142
不知道這是不是跟 OpenAI 找到把推論成本砍半的方法有關,The Information 有報導。
#2 minimaxir ▲ 87
順帶一提,有人注意到這幾天在 Codex 用 GPT-5.5 的額度被砍了一半嗎?昨天同樣工作量我能跑更久。
#3 oxmom ▲ 64
我也注意到配額變少、5.5 智力感覺在下降。任務完成能力變差、更偷懶了。我已經跳槽 Claude 了。
#4 andai ▲ 73
補充脈絡:官方提到他們要推出一個新的 ultra mode,超出單一 agent 能力,會用 subagents 來加速複雜工作。
#5 changoplatanero ▲ 51
Pro mode 的 agent 過去是平行跑、跑完才合併成單一回應。新東西是 subagent 可以即時互動協作。