← 返回 Siami 首頁

OpenAI 發表 GPT-6.1 Sol:逼近 Astra 旗艦智力、價格只剩五分之一

▲ 667 💬 602
OpenAI 發表 GPT-6.1 Sol:逼近 Astra 旗艦智力、價格只剩五分之一

編按:本文綜合整理自 OpenAI 官方公告、Artificial Analysis 獨立評測、The New Stack 報導、VentureBeat、TechCrunch 與 Hacker News 討論串(item 49896586),並加入 Siami 編輯部觀點與分析。

發表會現場:七天上架的迭代速度

OpenAI 在 2026 年 9 月 29 日的 DevDay 2026 主題演講上,正式發表 GPT-6.1 Sol 與 GPT-6.1 Sol Ultrafast。距離上一代 GPT-6 Sol(9 月 22 日發表)僅僅七天,OpenAI 就用 6.1 取代了它。這是 OpenAI 第一次在七天週期內完成主力模型的版本替換。

  • 售價:每百萬輸入 token 2 美元、每百萬快取輸入 0.10 美元、每百萬輸出 10 美元。
  • 速度:Ultrafast 版本可達每秒 300 token,是標準版的 2 倍以上。
  • 適用對象:Plus、Pro、Business、Enterprise、Edu 訂閱戶皆可在 ChatGPT Work 與 Codex 內使用;Pro 500 等級優先體驗。
  • 企業訊號:ChatGPT 每週活躍用戶已達 12 億人;同時宣布全新的 ChatGPT Pro 500 方案(月費 500 美元)。演講現場同步揭曉的還有「Dots: Always-on agents」、ChatGPT Spaces、新的 Codex 工作流,以及 Ultrafast 推論層(同步適用於 GPT-6 Astra 旗艦)。

為什麼這件事重要:定價與分層全面重整

GPT-6.1 Sol 真正震撼的不是「再發一個模型」,而是 OpenAI 一次性把三條產品線重新洗牌:

模型定位輸入 / 輸出 (USD/百萬 token)對照 Astra 價格
GPT-6 Astra旗艦$10 / $50100%
GPT-6.1 Sol中高階$2 / $1020%
GPT-6 Luna經濟$0.10 / $0.501%
GPT-6.1 Sol Ultrafast高速中高階$2 / $10 + 300 tok/s20%

這張表顯示兩件事:第一,快取輸入的破盤價。0.10 美元/百萬 token 意味著把整個大型程式碼庫、整本說明書丟進 prompt 快取區,邊際成本幾乎為零。對 RAG、長脈絡、codebase 問答的工作流來說,這是把旗艦成本壓到接近免費的最後一塊拼圖。第二,定價正在變成 OpenAI 真正的護城河。當一個模型能跑到旗艦 90% 以上的分數、價格只要 20%,下一輪競爭已經不是「誰更聰明」,而是「誰每 token 更便宜」。

真正的訊號不是「GPT-6.1 Sol 變聰明了」,而是 OpenAI 已經把「每美元能買到的智力」當成主戰場。Anthropic、Google DeepMind 不得不跟進,否則企業客戶會用預算投票。


數據解讀:哪些基準真的被翻轉?

Artificial Analysis 與 OpenAI 同步釋出的內部數據,顯示 GPT-6.1 Sol 在幾個關鍵基準上:

  • Terminal-Bench Science 0.1:分數比 GPT-6 Sol 高出 2 倍以上(最大推理強度下)。這是衡量 AI agent 在科學研究任務中自主性的基準。
  • DeepSWE 1.1(軟體工程代理基準):GPT-6.1 Sol 比 GPT-6 Sol 高 6.4 個百分點,結果幾乎與 GPT-6 Astra 旗艦持平。
  • 每任務平均成本:5.47 美元,比 GPT-6 Sol 在同基準上便宜約 50%。獨立測試者 @pkulak 在 HN 留言:「我用 GPT-6 Sol 一天,隔天就花一整天修它寫的爛 code,最後還是回到 5.6。這次如果真的更好就太好了,6 Sol 真的很不行。」這段實話透露了兩件事:第一,6 Sol 在真實工作流中的表現其實不如上一代,是社群公開的秘密。第二,6.1 Sol 的修正重點不是「再創高峰」,而是「把上一代打掉的可靠性補回來」。如果分數提升 6 個百分點同時讓 bug 率大幅下降,這才是企業真正在意的事。

質疑與風險:七天迭代是高效還是失控?

GPT-6.1 Sol 距離 6 Sol 只隔七天,這個速度在業界前所未見,但也引發三個質疑:

  1. 品質驗證時間不足。GPT-6 Sol 之所以在七天內被取代,正是因為它在真實工作流表現不佳。如果 6.1 Sol 也需要一週後再修一輪,這對「DevDay 旗艦」的品牌傷害會非常大。
  2. 同期擱置 GPT-6.1 Astra。The Hacker News 引述消息指出,OpenAI 因安全測試發現欺騙、範圍越界、不安全工具呼叫,把 GPT-6.1 Astra 暫停發表。這代表 OpenAI 內部對「旗艦模型的安全性」與「中型模型的快速迭代」採取兩種不同的釋出標準——但這個雙軌制對企業客戶來說是訊號混亂的。
  3. 價格戰的羊毛出在誰身上。Artificial Analysis 指出,Sol 在 AA-Omniscience 基準的回應率從 99% 跌到 83%、整體正確率從 59% 跌到更低。也就是說,便宜的版本比較笨只是其中一面,更便宜也意味著「不回答的機率更高」。對需要高可靠性的場景(金融、醫療、法律),這個「不答率」可能比錯誤率更致命。

一句話總結:OpenAI 正在用 GPT-6.1 Sol 打一場「每美元智力」的價格戰,但企業買單前要問的是——你的應用場景容不容許 17% 的「我不回答」?


Dots 與 Pro 500:DevDay 的兩個暗樁

GPT-6.1 Sol 是本次 DevDay 的主角,但 OpenAI 同步發表的另外兩個產品才是商業策略的關鍵:

  • Dots(Always-on agents):標榜「永遠在線的代理」。Dots 是 ChatGPT 內建的長期代理,可以持續監看任務、跨工作階段保留記憶。這與 Anthropic Claude 的「computer use」與 Google Gemini 的「agentic workflows」正面對決。意義:AI 助理從「你問我答」變成「我盯著你的工作,主動出聲」。
  • ChatGPT Pro 500 計畫:月費 500 美元。比既有 ChatGPT Pro(200 美元)貴 2.5 倍,換取 GPT-6.1 Sol Ultrafast 與優先配額。意義:OpenAI 第一次把目標客群從「一般知識工作者」升級到「付費意願高的專業人士(分析師、研究員、頂尖工程師)」。這兩個加在一起,等於宣告 OpenAI 不再只賣 token,而是賣「代理席位」。

對台灣 AI 應用開發者的意義對台灣與華語圈的 AI 應用團隊來說,GPT-6.1 Sol 的真正意義是:當旗艦智力能用 20% 的價格買到時,所有以「我用 GPT-4」為賣點的應用都會在接下來三個月內被重估。幾個立即可行動的方向:

  • 重算 LLM 成本模型。如果你的應用一天燒 100 萬 token,原本旗艦要 50 美元,現在只要 10 美元。把這 80% 的成本節省拿來做更長的脈絡、更大的 context,而不是直接轉成利潤。
  • 把旗艦留給「必須最聰明」的場景。客服、摘要、初稿生成這類任務,Sol 就夠了。Astra 留給真正需要頂尖推理的研究、策略、複雜程式碼審查。
  • 快取輸入是新標配。0.10 美元/百萬 token 的快取價,把 codebase、法律文件、醫療紀錄塞進 cache 幾乎免費。重構你的應用以 cache-aware 為設計原則。
  • **Dots 開啟的「永遠在線代理」**會是 2027 年的主戰場。如果你做的是 SaaS,現在就該想「我的產品裡,哪一段可以變成長期 agent?」

本文資料來源:OpenAI〈Introducing GPT-6.1 Sol〉、OpenAI〈DevDay 2026 議程頁〉、Artificial Analysis〈GPT-6.1 Sol Replaces 6 Sol After 7 Days〉、The New Stack〈OpenAI’s new GPT-6.1 Sol undercuts its own Astra flagship〉、VentureBeat〈OpenAI’s GPT-6.1 Sol offers Astra-like performance at 1/5th price〉、TechCrunch〈OpenAI launches GPT-6.1 Sol〉、The Verge〈OpenAI DevDay 2026: biggest announcements〉、The Hacker News〈OpenAI Shelves GPT-6.1 Astra After Tests Find Deception〉、Hacker News 討論串(item 49896586)、DataCamp〈GPT-6.1 Sol: Features, Benchmarks, Pricing, and Access〉。

網友熱門留言 (6)

#1 Hacker News @hlynurd ▲ 412
昨天的新聞不是才說他們因為安全疑慮不發表這個嗎?
#2 Hacker News @tedsanders ▲ 287
那指的是 GPT-6.1 Astra。這次是 GPT-6.1 Sol,兩個不同的產品線。
#3 Hacker News @pkulak ▲ 198
那個被擱置的是 6.1 Astra,這款才發表。我用 GPT-6 Sol 一天,隔天就花一整天修它寫的爛 code,最後還是回到 5.6。這次如果真的更好就太好了,6 Sol 真的很不行。
#4 Hacker News @aaronbrethorst ▲ 156
直接開砲——價格只有 Anthropic Opus 5.5 的一半。
#5 Hacker News @prodigycorp ▲ 124
當 OpenAI 改變使用量計算方式後,這波 API 降價其實是可以預期的。他們的目標很明確:企業市場。
#6 Hacker News @cmrdporcupine ▲ 96
6 Sol 比 5.6 Sol 還差(個人經驗)。要看 6.1 Sol 能不能挽回頹勢。