編按:本文綜合整理自 DeepSeek API 官方公告、DeepSeek 官方價目表、Computerworld 分析報導、Fortune 報導、Hacker News 討論串,並加入 Siami 編輯部觀點與分析。
DeepSeek 於 2026 年 8 月 13 日無預警上線 DeepSeek V4-Pro 正式版(build 0813),同步宣布全系列 V4 模型 API 改採「峰谷定價」機制:離峰時段價格為高峰時段的 50%,新價格於 2026 年 8 月 16 日 16:00 UTC 生效。這是 DeepSeek 從「低價屠夫」策略走向「成本可承受前提下的商業化」的最明確訊號。
一、峰谷時段定義
DeepSeek 官方這次給出的峰谷時段以 UTC 計算,台灣/香港/中國/日本/韓國開發者需特別注意時差:
- 高峰時段:01:00–04:00 UTC 與 06:00–10:00 UTC(合計 7 小時/日)
- 離峰時段:其餘 17 小時/日,包含所有週末時段
換算成亞洲時間(UTC+8):
- 高峰:09:00–12:00、14:00–18:00(北京/台北/香港時間)— 完整覆蓋白天上班時段
- 離峰:18:00–翌日 09:00、週末全日
換言之,對亞太地區開發者而言,傳統的白天工作時間幾乎全數落在高峰時段,只有深夜與週末才能享半價。對企業級 Agent 工作負載而言,這是一個結構性的成本衝擊。
二、V4-Pro 與 V4-Flash 新價格表
新機制同時適用於輸入(cache hit 與 cache miss)與輸出,單位為美元/百萬 token:
| 模型 | 時段 | 快取命中輸入 | 快取未命中輸入 | 輸出 |
|---|---|---|---|---|
| V4-Flash | 離峰 | $0.007 | $0.22 | $0.66 |
| V4-Flash | 高峰 | $0.014 | $0.44 | $1.32 |
| V4-Pro | 離峰 | $0.022 | $0.66 | $1.98 |
| V4-Pro | 高峰 | $0.044 | $1.32 | $3.96 |
對比調整前的單一定價:
| 模型 | 舊輸入(miss) | 新離峰輸入 | 新高峰輸入 | 舊輸出 | 新離峰輸出 | 新高峰輸出 |
|---|---|---|---|---|---|---|
| V4-Flash | $0.14 | $0.22(1.6x) | $0.44(3.1x) | $0.28 | $0.66(2.4x) | $1.32(4.7x) |
| V4-Pro | $0.435 | $0.66(1.5x) | $1.32(3.0x) | $0.87 | $1.98(2.3x) | $3.96(4.6x) |
最大漲幅其實不在主流程,而是 快取命中輸入:V4-Pro 的快取命中從原本的 $0.003625 升至離峰 $0.022(6.1 倍)、高峰 $0.044(12.1 倍)。InfoWorld 引述 DeepSeek 官方說法,指出「之前的快取命中定價顯著低於成本結構」,因此這次調整被視為修正補貼。
對重度依賴快取命中的 Agent 工作流(如 Claude Code、OpenCode 長時間對話)來說,成本模型需要整個重算。
三、與頭部閉源模型的對比
漲價後 DeepSeek V4 仍是國際頭部模型中最便宜的選項之一,但相對差距大幅縮窄。以「快取未命中」單一價比較:
| 模型 | 輸入(USD/M) | 輸出(USD/M) | 與 V4-Pro 高峰差距 |
|---|---|---|---|
| DeepSeek V4-Pro 高峰 | $1.32 | $3.96 | 基準 |
| DeepSeek V4-Pro 離峰 | $0.66 | $1.98 | — |
| Claude Sonnet 5 | $2.00 | $10.00 | 離峰仍便宜 3–5x |
| Claude Opus 5 | $5.00 | $25.00 | 高峰仍便宜 4–6x |
| GPT-5.6 Terra | $2.00 | $12.00 | 高峰仍便宜 1.5–3x |
| GPT-5.6 Sol | $5.00 | $30.00 | 高峰仍便宜 4–8x |
V4-Pro 高峰時段的輸出 $3.96/百萬 token,已逼近 Claude Sonnet 5 的 $10/百萬 — 雖然仍有 60% 價差,但「DeepSeek 比 Sonnet 便宜一個數量級」的舊敘事已不成立。V4-Pro 離峰時段則仍維持 5–10 倍價差,性價比紅利集中在非工作時段。
四、為什麼這件事重要
這是中國頭部 AI 廠商「價格屠夫時代」的正式終結點。
從 2025 年 1 月 DeepSeek R1 以極低定價震撼市場開始,DeepSeek 一直是「中國 AI 也能便宜」的代名詞。但這次峰谷定價的宣布,本質上是把「補貼搶市場」策略收進「按成本結構定價」的框架。三個值得關注的結構性訊號:
第一,這不是 DeepSeek 單家行為,而是中國大模型 API 市場的集體轉向。 早在 2026 年 8 月 6 日,DeepSeek 已在開發者後台預告「整體定價將有較大漲幅」。騰訊雲 2026 年內已兩次調價、智譜 AI 完成三次調價、阿里雲與百度智能雲陸續跟進。這次 DeepSeek 正式實施峰谷定價,等於為中國大模型 API 的「集體商業化」劃下時間點。
第二,定價錨點從「API」轉向「算力成本」。 高峰翻倍設計的核心邏輯是讓使用者主動把任務排程到離峰時段,這對 GPU 推論資源的負載平衡至關重要。隨著 V4 全系列模型 GA,DeepSeek 的 GPU 叢集需求暴增,必須用價格訊號引導開發者錯峰使用。
第三,DeepSeek 同時推進「開源 V4-Flash」與「閉源 V4-Pro」,對生態的影響是分裂的。 V4-Flash 採 MIT 授權,166.9 GB 權重開放下載,企業可以自架避開 API 定價;V4-Pro 仍未開源,所有使用者都必須透過 DeepSeek 官方 API 付費。峰谷定價機制對自架 V4-Flash 的企業沒有任何影響,但對依賴 V4-Pro 官方 API 的開發者而言,卻是結構性的成本衝擊。
對開發者的直接建議:把 V4-Pro 的工作負載排程到離峰時段、把可自架的部分遷移到 V4-Flash 本地部署、把「快取命中」當成新成本計算的核心指標。
五、數據解讀與質疑
雖然「漲價」是這次公告的主軸,但解讀時需要注意三個限制:
第一,「12 倍」漲幅的實際影響遠小於「3–4.6 倍」的主流程。 雖然快取命中輸入從 $0.003625 漲到高峰 $0.044(12.1x),但 V4-Pro 的快取命中在新價位下仍低於所有其他已知 LLM 業者。對大多數工作負載而言,主流程(快取未命中輸入與輸出)的 3–4.6 倍漲幅才是真正需要反應的數字。社群整理的對照表是目前最常被引用的版本。
第二,第三方的轉售價是否同步調漲仍是未知數。 Computerworld 報導指出,部分第三方路由(如 OpenRouter)目前對 DeepSeek V4-Flash 的轉售定價仍低於官方離峰價。OpenCode 對外表示正在用自己的推論設法維持舊價。這代表開發者短期內仍有繞道空間,但若 DeepSeek 把官方 API 設為最低價或限制第三方配額,這些替代方案可能在幾週內消失。
第三,「高峰時段」對歐美開發者反而是甜蜜點。 換算成 UTC 之後,01:00–04:00 與 06:00–10:00 對應的美東時間為週二凌晨 21:00–00:00 與 02:00–06:00 — 兩段都落在深夜與清晨。對歐美獨立開發者而言,這反而是「睡覺順便跑訓練」的最佳時段;亞太地區開發者則完全相反。Hacker News 討論串中,歐美開發者普遍把這次定價視為「夜間便宜、配合作息更划算」,亞太開發者則視為「白天被漲價」。
第四,這次調整不影響 V4-Pro 0813 的核心能力升級。官方公告同步強調 V4-Pro 在生產環境 Agent 任務的顯著進步、原生支援 OpenAI Responses API(為 Codex 優化)、三檔思考強度(low / high / max)控制。價格漲幅是商業策略,能力升級則是技術里程碑,兩者並未綁定。對開發者而言,現在的決策不是「要不要繼續用 V4-Pro」,而是「怎麼排程才能在保持能力的同時壓低成本」。
六、接下來會發生什麼
V4-Pro 0813 峰谷定價的落地,會引發三個值得持續觀察的後續發展:
- 第三方轉售價是否跟進:OpenRouter、OpenCode、Together AI 等中間層會在 8 月 16 日之前決定是否同步調漲,或繼續用自有推論維持低價
- 企業級 Agent 平台的反應:Claude Code、Cursor、Continue.dev 等重度使用 DeepSeek 快取的客戶,是否會調整定價傳導給終端使用者
- OpenAI 與 Anthropic 的跟進動作:DeepSeek 漲價會不會讓美方重新把價格拉回去?目前 OpenAI 與 Anthropic 都尚未對 DeepSeek 漲價做出公開回應
編按:本文綜合整理自 DeepSeek API 官方公告、DeepSeek 官方價目表、Computerworld 分析報導、Fortune 報導、Hacker News 討論串,並加入 Siami 編輯部觀點與分析。價格對照表整理自 DeepSeek 官方價目表與社群流通版本,最終以 DeepSeek 官方公告為準。
網友熱門留言 (4)