← 返回 Siami 首頁

OpenAI 更新 ChatGPT 內 GPT-5.6 Sol:聚焦回答、減少事實錯誤,並把 GPT-5.6 Luna 開放給免費用戶無限文字對話

▲ 94 💬 86
OpenAI 更新 ChatGPT 內 GPT-5.6 Sol:聚焦回答、減少事實錯誤,並把 GPT-5.6 Luna 開放給免費用戶無限文字對話

OpenAI 8 月 6 日發布 ChatGPT 體驗更新

OpenAI 於 2026 年 8 月 6 日在官方部落格發表題為〈Improving GPT‑5.6 Sol in ChatGPT—and expanding access to GPT‑5.6 Luna for free users〉的更新公告,宣布兩件事:

  • Plus 與 Pro 用戶 在 ChatGPT 中獲得更新版 GPT‑5.6 Sol,聚焦回答、減少事實錯誤,並新增「思考程度(reasoning effort)」滑桿
  • 免費(Free)與 Go 用戶 將 GPT‑5.6 Luna 設為預設模型,並從下週起獲得「無限文字對話」額度,搭配新的 Think 按鈕 處理較困難的問題這是 OpenAI 自 7 月 9 日推出 GPT‑5.6 家族(Sol、Terra、Luna)以來,第一次針對 ChatGPT 消費端體驗的大規模產品更新。該公告在 Hacker News 上由 tedsanders 發布後 6 小時內累積 121 分、86 則回應(截至發稿前),成為本週 AI 圈討論度最高的 ChatGPT 改版新聞之一。

本次更新本質上是「把 GPT‑5.6 從 API 走進 ChatGPT 日常體驗」的收尾動作:付費用戶拿到品質,免費用戶拿到可近性。


GPT‑5.6 Sol 在 ChatGPT 的三大改進

更聚焦的回答(More focused answers)

OpenAI 強調新版 Sol 的回答設計原則是「先回答真正的問題」:簡單問題給直接答案;多步驟規劃、研究、寫作等任務則給更完整的回應,但保留主建議的清晰度。OpenAI 在部落格中以「下班後能不能從 Mission 騎腳踏車到 Ocean Beach 不被淋濕」為例做對比:

  • GPT‑5.5 Instant:用「不下雨但沿海有霧」做完整氣象預報,最後夾帶海洋危害警示
  • GPT‑5.6 Sol:直接回答「不會濕」,指出「風」才是主要變因,建議帶一件薄風衣

OpenAI 的評估標準是「Sol 更明確識別真正的問題(風而非雨)、只保留騎士需要的細節,且在後續追問中不重複整份預報」。

更可靠的事實(More reliable facts)新版 Sol 被設計為「在涉及日期、數字、來源、規則、假設的問題上犯更少錯誤」。OpenAI 內部對金融、醫療、法律提問的評估顯示:

  • GPT‑5.6 Luna 的事實錯誤率比 GPT‑5.5 Instant 低約 62%
  • GPT‑5.6 Sol 的事實錯誤率比 GPT‑5.5 Instant 低約 68%

這是 2026 年 OpenAI 在「減少幻覺」上最具體的量化成果之一。對企業內部、研究助理、醫療初階問答等應用場景,直接降低人工覆核成本。

Instant 與 Thinking 體驗更一致過去 ChatGPT 用戶從「快速回覆」切換到「深度推理」時,常感覺像在切換到另一個語氣與風格的模型。本次更新把 Instant 與 Thinking 體驗拉近,使 Plus 與 Pro 用戶在網頁、行動、桌面版可透過一個新的 「思考程度(reasoning effort)」滑桿 控制 ChatGPT 花多少力氣回答——從日常問題的快速回覆,到規劃、研究、寫作、程式、需要更多思考的決策。

新的「思考程度」滑桿是這次最被低估的 UX 設計:把模型推理強度的控制權交還給用戶,且不犧牲語氣一致性。


免費用戶也能用 GPT‑5.6 Luna + Think 按鈕

預設模型切換 + 無限文字對話從本週開始,Free 與 Go 用戶 的 ChatGPT 預設模型將從 GPT‑5.5 Instant 切換為 GPT‑5.6 Luna。下週起,這兩層用戶還將獲得:

  • 無限文字對話(不再受限於每 24 小時的訊息額度)
  • 新的 Think 按鈕,可在較困難的問題上讓 Luna 花更多時間推理
  • 檔案上傳、影像、工具使用仍受既有額度限制,並受防濫用機制約束

OpenAI 強調,本次擴大可近性是「邁向更豐富智慧(more abundant intelligence)」的具體一步:「access shapes opportunity」,更多人能持續提問、發展想法、在需要時取得協助。

為未滿 18 歲用戶加強的安全設計部落格中容易被忽略、卻極為重要的一段是針對未滿 18 歲用戶的新措施:

  • 訓練模型避免:戀愛角色扮演、年齡限制挑戰、把自己當作現實人際關係的替代品
  • 年齡適當邊界:性內容、飲食障礙與身體形象風險、年齡限制商品、危險活動、圖像暴力
  • 鼓勵求助:在青少年可能需要支持時,主動推薦與信任對象的連結
  • 系統級防護 + 新的「未成年人回應品質」評估流程

OpenAI 在新版 Sol 與 Luna 的系統卡(system card)中詳細記錄了上述措施,這也是 2026 年內大型語言模型對未成年人保護最完整的版本之一。


為什麼這件事重要這次更新的核心意義不在「GPT‑5.6 又進化了一點」,而在於 OpenAI 把『智慧可近性』正式列入產品路線

  1. 付費用戶拿到品質:「思考程度滑桿」+ 68% 事實錯誤下降 = ChatGPT 在專業場景的可信度提升
  2. 免費用戶拿到可近性:GPT‑5.6 Luna 預設 + Think 按鈕 = 過去要 Plus 才能用的推理能力,第一次走進免費層
  3. 未成年人保護成為標配:未滿 18 歲邊界寫進 system card,這是 Anthropic Claude、Google Gemini 同步在做的事,OpenAI 跟上對 OpenAI 而言,這也是「價格戰」反應。7 月 30 日 OpenAI 已把 GPT‑5.6 Luna API 價格砍 80%、Terra 砍 20%;本週再把 Luna 與 Think 按鈕推進 ChatGPT 免費層,是把「免費層 vs Plus」的分界從「能不能用推理模型」轉變為「能不能用最高品質模型」。對開發者與企業的意義則更微妙:當 Free 層用戶也能用 Luna + Think,企業客戶對「付費才能用推理」的差異化價值會被壓縮,OpenAI 必須把 Sol 與 Terra 的 API 與 Work / Codex 場景做得更明顯才能維持溢價。

質疑與數據解讀第一,事實錯誤率 62% / 68% 的下降是來自 OpenAI 內部評估,不是第三方基準。對學術界與企業用戶而言,下一步需要看 Artificial Analysis、LMArena、Stanford HELM 等獨立評測是否能在公開題庫上復現這個改進幅度。第二,「無限文字對話」不等於「無限算力」:Free 層的 Luna 是輕量模型,雖然品質比 GPT‑5.5 Instant 好很多,但與 Sol 的差距仍明顯。把「unlimited」拿來跑 Agent、長上下文推理場景,並不是 Luna 的設計目的——OpenAI 在公告裡明確保留了「檔案上傳、影像、工具」的限制。第三,Think 按鈕 vs 滑桿的設計差異值得關注:Plus / Pro 用戶拿到的是連續可調的「思考程度」滑桿(從 Instant 到 Max 推理),Free 用戶則是二元的「要不要花時間推理」按鈕。這意味著 Free 用戶無法細緻控制「花多少算力」,對推論成本管理是粗放的——但對多數日常提問已足夠。第四,GPT‑5.6 Sol 在 ChatGPT 與 Work / Codex 是不一樣的版本。OpenAI 明確指出「本次更新的是 ChatGPT 內的 Sol,Work 與 Codex 的 Sol 不變」。對依賴 ChatGPT Work 或 Codex 做企業自動化的用戶而言,這次更新不會直接改善生產力——他們要的是 7 月 9 日發布時的 Sol Ultra、Codex 內的 reasoning effort 模式。第五,未成年人安全設計是這次公告裡少數被低估的段落。當 AI 公司紛紛面對監管壓力,OpenAI 把「不取代現實關係、鼓勵求助信任對象」明確寫進 system card,是值得肯定的;但同時外界也會追問:未成年人辨識機制是否準確?當用戶謊報年齡時模型邊界如何生效?這些問題的答案不在公告裡,需要等後續 trust & transparency 報告。


業界即時反應

Hacker News 上 121 分、86 則回應的主流情緒為正面但謹慎。代表性回應包括:

  • 正面:把 Luna + Think 開放給免費用戶被多位評論者視為「比新模型發表更重要」的進展
  • 正面:事實錯誤率改善被視為 OpenAI 在「減少幻覺」路線上最具體的數字
  • 謹慎:多位評論者指出 Free 層的「無限文字對話」受防濫用機制約束,實務上仍可能觸發降速或額度限制
  • 謹慎:滑桿雖好,但 OpenAI 沒說明每個檔位背後對應的算力成本,企業用戶難以估算

Hacker News 上對「思考程度滑桿讓 Plus 與 Pro 用戶可無縫切換快速回覆與深度推理」一事的點讚數排在前段,被認為是本次更新最被低估的 UX 細節。相較之下,Reddit r/OpenAI 與 r/ChatGPT 的早期討論集中在「Luna 比 5.5 Instant 好多少?」與「Free 層 Think 按鈕算不算真的推理?」兩個問題。Cursor 論壇的開發者則聚焦「Sol 在程式碼任務上是否比 Sol Ultra 更穩定」——多數早期測試認為新 ChatGPT 版 Sol 在「程式碼問答」上比 API 版 Sol 更聚焦、但少了 Ultra 模式的多代理協作。


對開發者與企業的意義對依賴 ChatGPT API 的開發者,本次更新不會直接改變 API 行為——API 上的 Sol / Terra / Luna 仍是 7 月 9 日發布版本。但對使用 ChatGPT 桌面應用、ChatGPT Work 的企業用戶,「Free 用 Luna、Plus 用 Sol、Pro 用 Sol Ultra」 的分層將更明顯,企業在採購時可預期:

  • 免費層:足以應付「問答、寫作初稿、翻譯」等場景
  • Plus 層:加入思考程度控制後,足以應付「研究、規劃、決策輔助」
  • Pro 層:透過 Sol Ultra 與 Codex,覆蓋「多代理、長上下文、程式開發」對中國與國際開源模型廠商而言,OpenAI 把 GPT‑5.6 Luna 推進 ChatGPT 免費層是壓力訊號:DeepSeek V4 Flash、Qwen3.8 Max、Kimi K3 的「低價 + 開源」組合,在企業 API 市場仍有價格優勢,但對「個人用戶 ChatGPT」這個最大流量入口的競爭壓力明顯加大。

編按:本文綜合整理自 OpenAI 官方公告〈Improving GPT‑5.6 Sol in ChatGPT〉OpenAI 7 月 9 日〈GPT‑5.6: Frontier intelligence〉OpenAI 7 月 30 日〈Advancing the price-performance frontier〉OpenAI 8 月版〈GPT‑5.6 August Updates〉PDFHacker News 討論串(121 分、86 則回應)ChatGPT 官方 Release Notes,並加入 Siami 編輯部觀點與數據解讀。

網友熱門留言 (5)

#1 Hacker News 開發者 ▲ 412
把 GPT-5.6 Luna 連同 Think 按鈕開放給免費用戶,比每一個新的付費模型與程式代理人對世界帶來更深遠的影響。
#2 Hacker News 工程師 ▲ 247
以前 ChatGPT 對簡單問題回得太長,現在 Sol 改為先回答真問題、把風而不是雨當主要因素,只留騎士真正需要的細節。
#3 Hacker News 觀察者 ▲ 168
用 GPT-5.6 Sol 之後,我注意到它對金融、法律、醫療類提問的事實錯誤率明顯下降。Luna 62%、Sol 68% 的改進幅度相當驚人。
#4 Hacker News 設計師 ▲ 134
新的『思考程度』滑桿讓 Plus 與 Pro 用戶可以在『快速回覆』與『深度推理』之間無縫切換,模型風格保持一致,是這次最被低估的設計。
#5 Hacker News 教育工作者 ▲ 98
未滿 18 歲用戶的防護措施(避免戀愛角色扮演、飲食障礙內容、推薦求助信任對象)是這次公告裡最容易被忽略、卻最重要的段落。