# 影片筆記:DeepSeek 为什么突然涨价? ## 一句話總結 DeepSeek 於 7 月 31 日發布 V4 Flash 正式版後,因打破「便宜、強、快」的不可能三角導致 API 調用量暴增,算力面臨極大壓力,因此於 8 月初通知用戶整體調漲價格,以透過價格機制暫時調節算力需求。 ## 核心重點 1. **價格策略轉變**:DeepSeek 過去以極低單價(每百萬 Token 輸入輸出僅 1-6 元)及極低的緩存命中價格著稱,給人「只降價」的印象。此次 V4 Flash 發布後,通知全部 API 用戶近期整體調漲價格,且漲幅較大,與過去印象形成強烈對比。 2. **V4 Flash 的性能突破**:該模型被稱為史上最強,跑分超越參數量更大的 JRM 5.2,且具備高速特性(每秒 100+ Token),打破了市場上「便宜、強、快」的不可能三角。 3. **用量激增的數據佐證**:透過最大客戶 OpenCode 的數據推算,V4 Flash 發布後 Token 消耗量從日消耗 8T 激增至 17T,單一模型用量遠超全球最大模型主軟 OpenRooter 的全平台總和。 4. **漲價原因推測**:主要歸因於算力不足。V4 Flash 吸引大量 Agent 重度用戶,Token 持續大量消耗,而算力無法在一週內增加 4 倍,因此透過價格進行暫時調節。 ## 詳細大綱 ### 1. DeepSeek API 漲價通知與背景 * **時間點**:V4 Flash 發布一周後(8 月初)。 * **現象**:DeepSeek 通知全部 API 用戶近期將整體調漲價格,漲幅較大。 * **歷史對比**: * 過去 DeepSeek 的印象為「只降價」。 * 最近一次類似漲價發生在今年 6 月上旬,當時因「風股的定價」高峰時段出現雙倍價格。 ### 2. DeepSeek 原有價格優勢分析 * **單價優勢**: * Flash 版本:輸入輸出每百萬 Token 分別為 1 塊和 2 塊。 * Pro 版本:輸入輸出每百萬 Token 分別為 3 塊和 6 塊。 * 評價:屬國產模型中偏低價格。 * **特色功能與成本**: * 100 萬上下文不額外收費。 * 緩存命中價格極低,僅為輸入價格的 1/50(約 2 分錢)。 * 技術細節:代碼場景緩存命中率達 95% 以上。 * 綜合成本:100 萬 Token 綜合單價約 6 分錢,1 億 Token 約 6 塊錢。 ### 3. V4 Flash 正式版發布後表現 * **發布時間**:7 月 31 日。 * **性能表現**: * 跑分超過參數量大好幾倍的 JRM 5.2。 * 推理速度(土字速度)每秒 100 個 Token 以上,適合 Agent 任務。 * **市場反應**:打破「不可能三角」(便宜、強、快),導致 API 調用量翻數倍。 ### 4. 透過 OpenCode 推算用量激增 * **OpenCode 背景**: * 提供大模型調用服務的 Agent 工具,也是 DeepSeek 的官方提供開源項目。 * 不限制接入其他工具,是 DeepSeek 的最大客戶。 * 套餐情況:提供免費版(有調用次數限制)和付費套餐 Go(有折扣)。 * **數據變化**: * 8 月 1 日(發布第二天):免費版燒 5T Token,收費版燒 3T Token,合計 8T。 * 8 月 5 日:收費 Token 日消耗量漲至 6.3T,為正式版發布前的 4 倍。 * 推算:若按比例推算,免費部分一天約燒 10.5T Token,總計一天約 17T Token。 * **對比 OpenRooter**: * OpenRooter 被描述為全球最大模型主軟,擁有幾百個模型、800 萬用戶。 * 全平台一天總和僅 3T 多 Token。 * OpenCode 單一模型用量為其 5 倍。 ### 5. 漲價原因推測 * **核心原因**:算力不足。 * **邏輯推導**:V4 Flash 吸引 Agent 重度用戶,Token 持續大量消耗,算力無法在一週內增加 4 倍,因此透過價格進行暫時調節。 ## 工具 / 模型 / 名詞整理 * **DeepSeek**:模型開發商及 API 服務提供方。 * **V4 Flash / VisFlash**:DeepSeek 發布的正式版模型名稱,被稱為史上最強模型。 * **Pro**:DeepSeek 的另一個模型版本。 * **JRM 5.2**:被提及作為跑分對比對象的模型,參數量比 V4 Flash 大。 * **OpenCode**:提供大模型調用服務的 Agent 工具,DeepSeek 的官方提供開源項目,也是 DeepSeek 的最大客戶。 * **OpenRooter / OpenRoot**:被描述為全球最大的模型主軟,擁有幾百個模型和 800 萬用戶。 * **Go**:OpenCode 中的付費套餐名稱。 * **Token**:計費單位,文中提及消耗量以 T(Trillion,兆)為單位。 ## 操作流程整理 1. **發布模型**:DeepSeek 於 7 月 31 日發布 V4 Flash 正式版。 2. **用戶接入**:用戶(如 OpenCode 平台)接入 V4 Flash 模型,提供免費版與付費版(Go 套餐)服務。 3. **用量監控**: * 8 月 1 日:免費版消耗 5T,收費版消耗 3T,總計 8T。 * 8 月 5 日:收費版消耗增至 6.3T,推算免費版消耗約 10.5T,總計達 17T。 4. **對比分析**:將單一模型(OpenCode 上的 V4 Flash)的日消耗量(17T)與全球最大平台(OpenRooter)的全平台總和(3T+)進行對比,確認用量激增。 5. **發布漲價通知**:DeepSeek 於 8 月初通知全部 API 用戶近期整體調漲價格,以應對算力不足的問題。 ## 值得注意的限制或風險 * **算力瓶頸**:V4 Flash 的高效能與低價格導致需求遠超供給,算力無法在一週內增加 4 倍,顯示基礎設施擴張可能滯後於市場需求。 * **價格波動風險**:DeepSeek 過去給用戶「只降價」的印象,此次漲價幅度較大,且曾出現高峰時段雙倍價格的情況,用戶需留意價格不穩定性。 * **單一模型依賴風險**:OpenCode 單一模型(V4 Flash)的用量已超過擁有 800 萬用戶的全球最大平台總和,顯示對單一模型的高度依賴可能帶來運營風險。 ## 逐字稿辨識疑點 * **VisFlash**:逐字稿開頭提到「Deepseek发布了VisFlash正式版」,後文均稱「V4 Flash」,疑為聽寫錯誤或口誤,實際應指 V4 Flash。 * **土字速度**:形容速度時使用「土字速度」,疑為「推理速度」或「吞吐速度」的聽寫錯誤。 * **風股的定價**:提到「今年6月的上旬,風股的定價」,疑為「風控定價」或特定術語的聽寫錯誤,需查證。 * **OpenRoot / OpenRooter**:逐字稿中交替出現「OpenRoot」與「OpenRooter」,疑為同一產品名稱的不同聽寫。 * **沉吊的燒起來**:形容 Token 消耗時使用「沉吊的燒起來」,疑為「成堆」或「持續」的聽寫錯誤。 * **干到 17T**:形容用量達到 17T 時使用「干到」,疑為「達到」或「幹到」的口語化表達。 ## 可延伸追問 * DeepSeek 預計何時能解決算力不足的問題?漲價是永久性的還是暫時性的調節手段? * 「風股的定價」具體指什麼?是否為 DeepSeek 內部特定的定價策略術語? * OpenCode 作為 DeepSeek 的最大客戶,其免費版與付費版的用戶結構如何影響 DeepSeek 的整體營收與算力分配? * JRM 5.2 的參數量具體是多少?為何 V4 Flash 能在跑分上超越參數量更大的模型?