如果你在8月17日醒來時發現DeepSeek API帳單突然看起來不一樣了,那不是你的錯覺。DeepSeek已正式推出尖峰定價——這是一種依時間計價的尖峰/離峰計費模式,會根據你的請求何時送達API,來改變每個token的計費價格。
簡單來說:在繁忙時段執行工作負載,就要支付全額費用;把工作移到離峰時段,則只需支付一半的費用。本指南將詳細說明DeepSeek尖峰定價的具體內容、API在哪些時段費用較高、各等級的收費差異,以及你應該注意的事項。
什麼是 DeepSeek 尖峰定價?DeepSeek 剛將其 API 改為尖峰/離峰定價。了解 API 何時費用較高、高出多少,以及如何讓帳單減半。

如果你在8月17日醒來時發現DeepSeek API帳單突然看起來不一樣了,那不是你的錯覺。DeepSeek已正式推出尖峰定價——這是一種依時間計價的尖峰/離峰計費模式,會根據你的請求何時送達API,來改變每個token的計費價格。
簡單來說:在繁忙時段執行工作負載,就要支付全額費用;把工作移到離峰時段,則只需支付一半的費用。本指南將詳細說明DeepSeek尖峰定價的具體內容、API在哪些時段費用較高、各等級的收費差異,以及你應該注意的事項。
DeepSeek 尖峰定價是 DeepSeek API 的一種動態分時計費系統。它不是全天採用單一固定費率,而是將每天劃分為兩個時段:
尖峰時段——最繁忙的時段,按全額(較高)費率計費。
離峰時段——其他所有時段,按尖峰費率的 一半 計費。
新定價已於 2026年8月17日北京時間(UTC+8)00:00 生效,適用於 DeepSeek 目前的整個模型系列,包括 DeepSeek-V4-Flash 和 DeepSeek-V4-Pro。
如果你用過提供「spot」或「離峰」折扣的雲端服務,就會覺得這個概念很熟悉:供應商透過降低價格,把非緊急流量導向較不繁忙的時段,藉此平穩基礎設施上的需求。
這是最需要記住的重點。尖峰定價適用於每天以下兩個時段:
| 時段 | 北京時間(UTC+8) | 費率 |
|---|---|---|
| 尖峰(上午) | 09:00 – 12:00 | 全價 |
| 尖峰(下午) | 14:00 – 18:00 | 全價 |
| 離峰(其他所有時段) | 18:00 – 隔日 09:00,以及 12:00 – 14:00 | 半價 |
換句話說,API 每天合計有 7 小時費用較高(北京時間 09:00–12:00 與 14:00–18:00)。其餘的 17 小時為半價,包括兩個尖峰區塊之間的午休時段。
給全球使用者的快速提示:請將這些時段換算成你當地的時區。北京 09:00–12:00 / 14:00–18:00 大約是中國的標準工作時段。如果你在美國或歐洲,你的工作時間有相當大的比例可能正好落在 DeepSeek 的 離峰 時段——也就是說,你什麼都不用改,就可能正在享有折扣費率。
下列所有價格均為 每 1M tokens,由 DeepSeek 官方人民幣費率換算為約略美元(≈ $1 = ¥7.2)。離峰定價永遠是尖峰費率的 一半。
輕量、高速的服務層級——最適合大量且對延遲敏感的任務。
| Token 類型 | 離峰(每 1M) | 尖峰(每 1M) |
|---|---|---|
| 輸入(快取命中) | ~$0.007 | ~$0.014 |
| 輸入(快取未命中) | ~$0.21 | ~$0.42 |
| 輸出 | ~$0.63 | ~$1.25 |
👉 在 GPT Proto 上探索 DeepSeek-V4-Flash →
旗艦級推理服務層級——專為複雜、高準確度的工作負載打造。
| Token 類型 | 離峰(每 1M) | 尖峰(每 1M) |
|---|---|---|
| 輸入(快取命中) | ~$0.021 | ~$0.042 |
| 輸入(快取未命中) | ~$0.63 | ~$1.25 |
| 輸出 | ~$1.88 | ~$3.75 |
👉 在 GPT Proto 上探索 DeepSeek-V4-Pro →
(美元數字為約略值,僅供方便參考;DeepSeek 官方定價以人民幣計價,可能隨匯率變動。)
坦白說:完全取決於你在什麼時候執行請求。
如果你的流量落在尖峰時段 → 比起與舊式固定費率的單純比較,你支付的費用更高,因為尖峰是完整(較高)費率等級。
如果你的流量落在離峰時段 → 你只需支付尖峰費率的 一半,這是實實在在的折扣。
尖峰定價不是偽裝成功能的全面漲價,而是一種 重新分配:相同的工作量,純粹取決於執行時機,成本可能高達尖峰費率的 2 倍,或比尖峰費率少 50%。對於任何執行批次作業、離線資料處理、夜間摘要或非緊急管線的人來說,離峰時段基本上就是白省的錢——把工作排在北京時間 09:00–12:00 與 14:00–18:00 之外,帳單就能砍半。
尖峰定價解決了一個經典的基礎設施問題:需求不均。在中國的工作時間,API 流量會暴增;到了夜間,伺服器則相對閒置。單一固定費率迫使 DeepSeek 必須為尖峰時段準備資源,並在離峰低谷時承受浪費。
透過降低離峰時段的價格,DeepSeek 可以:
平滑需求——鼓勵彈性工作負載移到較不繁忙的時段,減少尖峰期間的壅塞。
提升可靠性——尖峰時段負載降低,意味著在關鍵時刻有更穩定的延遲與可用性。
降低彈性使用者的成本——不需要即時回應的團隊,只要重新安排時間,就能獲得內建的 50% 折扣。
確保高階容量可用——真正需要在尖峰時段處理量的人仍可使用,只是反映較高需求的費率。
這背後的邏輯與離峰電價和雲端 Spot 實例相同——讓價格與實際需求對齊,每個人都能據此最佳化。
在你以為費用會自動變便宜之前,請先記住以下幾點:
時區混淆是頭號陷阱。尖峰時段是以 北京時間(UTC+8) 定義,而不是你的當地時間。一旦算錯,你可能會把「便宜」的批次作業正好排進尖峰時段。永遠先換算時區。
午休空檔(12:00–14:00)屬於離峰。它位於兩個尖峰區塊之間,所以 13:00 開始的任務享有折扣——但 11:30 到 14:30 的任務則會跨越尖峰 → 離峰 → 尖峰。請留意任務的起訖時間。
快取命中的價格便宜非常多——但在尖峰時段仍會加倍。快取命中的輸入 token 是迄今最便宜的計費項目。重複使用提示詞與上下文(prompt caching)仍是影響帳單金額的最大槓桿之一,無論在哪個時段都一樣。
即時/面向使用者的流量不一定能轉移。如果你的產品在中國工作時間服務線上使用者,這部分流量就必須承擔尖峰費率。只有 可延後 的工作負載才能從離峰排程中受益。
模型選擇仍然最重要。尖峰定價是時間上的槓桿;選對模型是更大的槓桿。如果 V4-Flash 符合你的品質標準,它在任何時段的成本都只是 V4-Pro 的一小部分。在最佳化時間安排之前,先讓模型與任務匹配。
一份快速實用的檢查清單:
✅ 批次處理與排程:把非緊急任務(embeddings、摘要、評估、資料清理)安排到 17 小時的離峰時段。
✅ 將尖峰時段換算成你的當地時區,並標記在團隊的行事曆上。
✅ 善用 prompt caching,讓快取命中的輸入 token 成為你主要的成本項目。
✅ 為你的模型選擇合適規模——使用 DeepSeek-V4-Flash 來處理大量與速度需求,並把 DeepSeek-V4-Pro 留給真正需要額外推理能力的任務。
✅ 監控並分流流量——依需求路由即時請求,但所有可以等待的工作都盡量延後。
DeepSeek 尖峰定價不是單純漲價,而是以時間計價的模式,獎勵靈活調度。API 只有在北京時間 09:00–12:00 與 14:00–18:00 費用較高,而一天當中的其他 17 小時為半價。搞懂時段、留意時區、積極使用快取,並選對模型,你就能輕鬆站到比較便宜的那一邊。
準備好使用最新的 DeepSeek 模型來開發了嗎?直接比較規格與價格:
DeepSeek-V4-Flash →——快速、輕量、高吞吐量。
DeepSeek-V4-Pro →——旗艦級推理能力,適合高要求的工作負載。

搜尋結果仍將 GLM-5.3 描述為尚未發布的傳聞。Z.ai' 自家的文件如今已說明情況並非如此——但資訊仍不完整。 截至 2026 年 8 月 14 日, GLM-5.3 已在 Z.ai GLM Coding Plan 中上線 。官方設定指南將 glm-5.3 列為目前模型,支援選用 100 萬 token 的上下文,並記錄低、高和最高推理強度等級。然而,Z.ai 尚未發布具體日期的上市公告、完整模型卡、開放權重、標準按 token 計費的 API 價格,或此版本的基準測試結果。 這項區別很重要。GLM-5.3 已不再只是社群暱稱,但它也尚未成為完整文件化的公開版本。 我分別查閱了 Coding Plan 指南、一般模型目錄、價格頁面、版本更新說明與公開模型儲存庫。這些資訊目前尚未完全同步,因此簡單回答「已發布或未發布」會產生誤導。
Michael Johnson | 2026-08-14

rok 4.6 和 DeepSeek V4 Pro 都是為複雜推理與程式編寫工作而設計,但兩者並不能互相取代。當任務涉及螢幕截圖、介面雛形、視覺化除錯,或最具挑戰性的代理式程式編寫問題時,Grok 4.6 是更強的選擇。當成本、長上下文,以及大量文字型程式編寫最為重要時,DeepSeek V4 Pro 則更具吸引力。 簡短答案很簡單: Grok 4.6 是整體表現更佳的模型,而 DeepSeek V4 Pro 則是更具成本效益的程式編寫模型。 這篇 Grok 4.6 與 DeepSeek V4 Pro 比較文章涵蓋程式編寫、前端開發、上下文視窗、公開基準測試證據、API 定價,以及最新的 DeepSeek V4 Pro 升級內容,也會說明哪個模型更適合不同的開發者工作負載。 快速結論: 若要進行視覺化前端工作、困難除錯及高風險程式編寫任務,請選擇 Grok 4.6。若要處理大型程式碼庫、文字密集型工作流程及較低的 API 成本,請選擇 DeepSeek V4 Pro。在生產環境路由中,DeepSeek V4 Pro 可處理預設工作負載,而 Grok 4.6 則負責視覺化或高難度升級任務。
Tiffany Layne | 2026-08-13

DeepSeek V4 Pro 與 Kimi K3 的比較在 2026 年 8 月 13 日發生了變化。DeepSeek 將原本由既有 API 別名提供的 V4 Pro 預覽版替換為 DeepSeek V4 Pro 0813,同時保留開發者目前使用的模型名稱。 簡短答案是:Kimi K3 在整體測得的智慧能力方面仍然領先,並支援視覺輸入。DeepSeek V4 Pro 0813 在文字型程式設計與代理工作負載上速度更快,價格也大幅降低。對大多數需要處理程式碼庫、執行程式碼審查或運行大量代理的團隊而言,DeepSeek 現在是更好的預設選擇。當多模態輸入或最高可用的推理上限比成本更重要時,Kimi 才值得其較高的價格。 有一項實作細節很容易被忽略:在 GPTProto 上,您不需要使用 0813 後綴。繼續呼叫 deepseek-v4-pro 即可,路由會自動使用目前版本。
Tiffany Layne | 2026-08-13

兩款前沿模型在四週內相繼發布,目標買家也高度重疊:執行代理程式、而非聊天機器人的開發者。Moonshot AI 於 2026 年 7 月 16 日推出 Kimi K3,xAI 則於 8 月 12 日以 Grok 4.6 回應。今天搜尋 "Grok 4.6 vs Kimi K3",您會看到雙方陣營的發布報導,以及大量規格表——但幾乎沒有人從建構者的角度將兩者並列比較。這正是本文要填補的空白。 以下是簡短版,因為您是來做決策,而不是看回顧。 Grok 4.6 在代理式執行效率與免操心託管方面勝出。 它能以更少的迴圈和更少的 token 完成長時間、多步驟的任務,而且您完全不必接觸基礎架構。 Kimi K3 則在上下文、原生影片支援與控制權方面勝出 ——具備 100 萬 token 的上下文視窗、影像 and 影片輸入,以及可下載的開放權重;如果您需要自行託管或隔離網路環境,這些特點非常重要。在大家都引用的那個數字上,兩者幾乎打成平手:Artificial Analysis 將兩者的單任務成本都估在約 $0.84 。因此, intelligence index 只差一分並不是您做決定的關鍵。兩個模型以相反的路徑達到相同的成本,而 that 正是您真正需要選擇的分岔點。 如果您執行的是重視成本、高流量的代理工作流程,並希望使用託管端點,請選 Grok 4.6。如果您需要將整個儲存庫或影片放入單一上下文視窗,或因合規要求而必須自行持有權重,請選 Kimi K3。本文其餘內容將展示這項判斷背後的依據。
Schuyler Stacy | 2026-08-13