實際影片長度:3:15.000。原文、繁中、雙語可點擊句子跳轉影片。
0:00.000–0:05.167
7月31號,Deepseek发布了VisFlash正式版,這是它史上最強的模型。
0:05.167–0:12.012
一周之後的今天,Deepseek給全部的API用戶都發了一個通知,計劃近期整體上調價格,而且預計漲幅較大。
0:12.012–0:16.662
我第一反應是看錯了,因為Deepseek在文印象裡面一直只發降價的新聞。
0:16.662–0:22.474
我翻了一下,最接近漲價的一次是今年6月的上旬,風股的定價,高峰時段的雙倍的價格,僅此而已。
0:22.474–0:25.574
所以很多小伙伴來問,這次憑什麼漲,是要收割了嗎?
0:25.574–0:27.124
所以我來跟大家分析一下。
0:27.124–0:29.320
先說它原來有多便宜,真的非常便宜。
0:29.320–0:33.022
很多人沒用過Deepseek的按量集費,所以沒有這個感覺。
0:33.022–0:40.937
我們先來看單價,就是每百萬Token的輸入輸出,Flash的價格是一塊和兩塊,Pro是三塊和六塊,在國產模型裡面就是偏低的。
0:40.937–0:46.682
然後它還有兩個別家沒有的東西,第一個就是一個million的100萬的上下文,不額外收費。
0:46.682–0:51.788
第二個就是緩存命中只有輸入價格的五十分之一,相當於只有兩分錢,遠低於其他的廠商。
0:51.788–0:58.299
而且還有一個細節,就是Deepseek的緩存優化做得非常好,寫代碼的場景裡面,命中率基本上95%以上。
0:58.299–0:59.320
這樣算下來,其實
0:59.320–1:03.638
100萬Token的綜合單價只要六分錢,1億Token只要六塊錢。
1:03.638–1:07.694
前幾天7月31號,V4Flash正式版本一發,能力大幅度增強。
1:07.694–1:11.227
光看跑分已經超過了,參數量比它大好幾倍的JRM5.2。
1:11.227–1:12.404
又便宜,然後又強。
1:12.404–1:13.320
關鍵的它還快。
1:13.320–1:18.320
關鍵的它還快,土字速度大概在每秒100個Token以上,甩開其他大模型一大截。
1:18.320–1:23.448
所以跑那些agent任務的時候特別絲滑,便宜,能力又強,速度又快,三樣都湊起來。
1:23.448–1:26.525
可以說在某種程度上來說,打破了一個不可能的三角。
1:26.525–1:33.320
結果就是API的調用量翻了好幾倍,官方沒公布具體的調用數據,但可以從它最大的客戶OpenCode上去推算。
1:33.320–1:39.618
OpenCode不光是個agent工具,它還提供這種大模型的調用的服務,裡面的DeepSeek就是官方提供的。
1:39.618–1:43.396
套餐會有一些折扣,所以比DeepSeek官方去安量收費要便宜一點。
1:43.396–1:46.602
而且它又是個開源的項目,所以它不限制去接什麼其他的工具。
1:46.602–1:50.725
所以很多人,包括我在內,都從OpenCode裡面去使用DeepSeek。
1:50.725–1:54.961
OpenCode裡面提供免費的V4Flash,付費套餐Go裡面也有收費版。
1:54.961–2:00.343
我自己訂了這個套餐,實際用下來,免費版跟收費版其實沒有太大差別,只是免費版它有調用次數的限制。
2:00.343–2:01.946
然後接著我們來看具體的數字。
2:01.946–2:03.320
OpenCode的工具,
2:03.320–2:10.879
官方說,8月1日,V4Flash發布的第二天,免費版燒了5T的Token,收費版燒了3T的Token,第二天就是8T。
2:10.879–2:15.876
這還只是開始,OpenCode有一個實時的數據頁面,收費Token的日消耗量。
2:15.876–2:19.719
8月5日已經漲到了6.3T,是Flash正式版發布前的4倍。
2:19.719–2:28.431
如果我們再去按照免費跟收費版的比例來推算一下,免費部分一天還要再燒10.5T左右的Token,加起來一天大概要燒17T左右的Token。
2:28.431–2:29.713
17T是個什麼概念?
2:29.713–2:33.320
就是OpenRoot,我們知道它是全球最大的模型的主軟,
2:33.320–2:38.859
基本上沒有質疑,幾百個大模型,800萬的用戶,全平台加起來一天也就3T多的Token。
2:38.859–2:45.944
OpenCode在DeepSeek一個模型上就要燒的量,是整個OpenRooter幾百個模型用量的總和的5倍。
2:45.944–2:51.613
所以我們來推測一下,官方沒有說漲價的原因,但我認為最有可能的解釋就是,算力真的不太夠了。
2:51.613–2:58.182
於是Flash變強之後,吸引來的是Agent的重度用戶,工具一接上之後,Token就是沉吊的燒起來了。
2:58.182–3:02.820
光是OpenCode這一個客戶一天就能干到17T,用量一周直接漲了4倍。
3:02.820–3:06.695
但是背後這個卡這個算力不會一周之內就多出4倍,能立刻的去見效。
3:06.695–3:08.695
所以只能拿價格去來做暫時的調節。
3:08.695–3:11.070
好了,接下來趕緊跟大家來分享一下快訊。
3:11.070–3:14.820
然後,今天視頻就到這裡,我是Dizon黑心李少,我們下次見。
3:14.820–3:15.000
謝謝。
0:00.000–0:05.167
7月31日,Deepseek發布了VisFlash正式版,這是它史上最強的模型。
0:05.167–0:12.012
一周後的今天,Deepseek向所有API用戶發送了一則通知,計劃近期整體上調價格,且預計漲幅較大。
0:12.012–0:16.662
我的第一反應是看錯了,因為在Deepseek的印象裡,它一直只發布降價的新聞。
0:16.662–0:22.474
我查了一下,最接近漲價的一次是今年6月上旬,風股的定價,高峰時段價格翻倍,僅此而已。
0:22.474–0:25.574
所以很多夥伴來問,這次憑什麼漲價,是要收割了嗎?
0:25.574–0:27.124
所以我來跟大家分析一下。
0:27.124–0:29.320
先說它原來有多便宜,真的非常便宜。
0:29.320–0:33.022
很多人沒用過Deepseek的按量計費,所以沒有這個感覺。
0:33.022–0:40.937
我們先來看單價,也就是每百萬Token的輸入輸出,Flash的價格是1塊和2塊,Pro是3塊和6塊,在國產模型中屬於偏低水平。
0:40.937–0:46.682
然後它還有兩個別家沒有的東西,第一個就是100萬的上下文,不額外收費。
0:46.682–0:51.788
第二個就是緩存命中只有輸入價格的五十分之一,相當於只有兩分錢,遠低於其他廠商。
0:51.788–0:58.299
而且還有一個細節,就是Deepseek的緩存優化做得非常好,在寫代碼的場景中,命中率基本上在95%以上。
0:58.299–0:59.320
這樣算下來,其實
0:59.320–1:03.638
100萬Token的綜合單價只要6分錢,1億Token只要6塊錢。
1:03.638–1:07.694
前幾天7月31日,V4Flash正式版一發布,能力大幅度增強。
1:07.694–1:11.227
光看跑分已經超過了參數量比它大好幾倍的JRM5.2。
1:11.227–1:12.404
又便宜,然後又強。
1:12.404–1:13.320
關鍵的是它還快。
1:13.320–1:18.320
關鍵的是它還快,土字速度大概在每秒100個Token以上,甩開其他大模型一大截。
1:18.320–1:23.448
所以跑那些agent任務的時候特別絲滑,便宜、能力又強、速度又快,三樣都湊齊了。
1:23.448–1:26.525
可以說在某種程度上來說,打破了一個不可能的三角。
1:26.525–1:33.320
結果就是API的調用量翻了好幾倍,官方沒公布具體的調用數據,但可以從它最大的客戶OpenCode上去推算。
1:33.320–1:39.618
OpenCode不光是個agent工具,它還提供這種大模型的調用服務,裡面的DeepSeek就是官方提供的。
1:39.618–1:43.396
套餐會有一些折扣,所以比Deepseek官方按量收費要便宜一點。
1:43.396–1:46.602
而且它又是個開源的項目,所以它不限制去接什麼其他的工具。
1:46.602–1:50.725
所以很多人,包括我在內,都從OpenCode裡面去使用DeepSeek。
1:50.725–1:54.961
OpenCode裡面提供免費的V4Flash,付費套餐Go裡面也有收費版。
1:54.961–2:00.343
我自己訂了這個套餐,實際用下來,免費版跟收費版其實沒有太大差別,只是免費版它有調用次數的限制。
2:00.343–2:01.946
然後接著我們來看具體的數字。
2:01.946–2:03.320
OpenCode的工具,
2:03.320–2:10.879
官方說,8月1日,V4Flash發布的第二天,免費版燒了5T的Token,收費版燒了3T的Token,第二天就是8T。
2:10.879–2:15.876
這還只是開始,OpenCode有一個實時的數據頁面,顯示收費Token的日消耗量。
2:15.876–2:19.719
8月5日已經漲到了6.3T,是Flash正式版發布前的4倍。
2:19.719–2:28.431
如果我們再去按照免費跟收費版的比例來推算一下,免費部分一天還要再燒10.5T左右的Token,加起來一天大概要燒17T左右的Token。
2:28.431–2:29.713
17T是個什麼概念?
2:29.713–2:33.320
就是OpenRoot,我們知道它是全球最大的模型的主站,
2:33.320–2:38.859
基本上沒有質疑,幾百個大模型,800萬的用戶,全平台加起來一天也就3T多的Token。
2:38.859–2:45.944
OpenCode在DeepSeek一個模型上就要燒的量,是整個OpenRooter幾百個模型用量的總和的5倍。
2:45.944–2:51.613
所以我們來推測一下,官方沒有說漲價的原因,但我認為最有可能的解釋就是,算力真的不太夠了。
2:51.613–2:58.182
於是Flash變強之後,吸引來的是Agent的重度用戶,工具一接上之後,Token就是成倍地燒起來了。
2:58.182–3:02.820
光是OpenCode這一家客戶,一天就能消耗17T,用量一週直接漲了4倍。
3:02.820–3:06.695
但背後的這張卡和算力不會在一週內就多出4倍,能立刻見效。
3:06.695–3:08.695
所以只能靠價格來做暫時的調節。
3:08.695–3:11.070
好了,接下來趕緊跟大家分享快訊。
3:11.070–3:14.820
然後,今天的影片就到這裡,我是Dizon黑心李少,我們下次見。
3:14.820–3:15.000
謝謝。
0:00.000–0:05.167
7月31號,Deepseek发布了VisFlash正式版,這是它史上最強的模型。
7月31日,Deepseek發布了VisFlash正式版,這是它史上最強的模型。
0:05.167–0:12.012
一周之後的今天,Deepseek給全部的API用戶都發了一個通知,計劃近期整體上調價格,而且預計漲幅較大。
一周後的今天,Deepseek向所有API用戶發送了一則通知,計劃近期整體上調價格,且預計漲幅較大。
0:12.012–0:16.662
我第一反應是看錯了,因為Deepseek在文印象裡面一直只發降價的新聞。
我的第一反應是看錯了,因為在Deepseek的印象裡,它一直只發布降價的新聞。
0:16.662–0:22.474
我翻了一下,最接近漲價的一次是今年6月的上旬,風股的定價,高峰時段的雙倍的價格,僅此而已。
我查了一下,最接近漲價的一次是今年6月上旬,風股的定價,高峰時段價格翻倍,僅此而已。
0:22.474–0:25.574
所以很多小伙伴來問,這次憑什麼漲,是要收割了嗎?
所以很多夥伴來問,這次憑什麼漲價,是要收割了嗎?
0:25.574–0:27.124
所以我來跟大家分析一下。
所以我來跟大家分析一下。
0:27.124–0:29.320
先說它原來有多便宜,真的非常便宜。
先說它原來有多便宜,真的非常便宜。
0:29.320–0:33.022
很多人沒用過Deepseek的按量集費,所以沒有這個感覺。
很多人沒用過Deepseek的按量計費,所以沒有這個感覺。
0:33.022–0:40.937
我們先來看單價,就是每百萬Token的輸入輸出,Flash的價格是一塊和兩塊,Pro是三塊和六塊,在國產模型裡面就是偏低的。
我們先來看單價,也就是每百萬Token的輸入輸出,Flash的價格是1塊和2塊,Pro是3塊和6塊,在國產模型中屬於偏低水平。
0:40.937–0:46.682
然後它還有兩個別家沒有的東西,第一個就是一個million的100萬的上下文,不額外收費。
然後它還有兩個別家沒有的東西,第一個就是100萬的上下文,不額外收費。
0:46.682–0:51.788
第二個就是緩存命中只有輸入價格的五十分之一,相當於只有兩分錢,遠低於其他的廠商。
第二個就是緩存命中只有輸入價格的五十分之一,相當於只有兩分錢,遠低於其他廠商。
0:51.788–0:58.299
而且還有一個細節,就是Deepseek的緩存優化做得非常好,寫代碼的場景裡面,命中率基本上95%以上。
而且還有一個細節,就是Deepseek的緩存優化做得非常好,在寫代碼的場景中,命中率基本上在95%以上。
0:58.299–0:59.320
這樣算下來,其實
這樣算下來,其實
0:59.320–1:03.638
100萬Token的綜合單價只要六分錢,1億Token只要六塊錢。
100萬Token的綜合單價只要6分錢,1億Token只要6塊錢。
1:03.638–1:07.694
前幾天7月31號,V4Flash正式版本一發,能力大幅度增強。
前幾天7月31日,V4Flash正式版一發布,能力大幅度增強。
1:07.694–1:11.227
光看跑分已經超過了,參數量比它大好幾倍的JRM5.2。
光看跑分已經超過了參數量比它大好幾倍的JRM5.2。
1:11.227–1:12.404
又便宜,然後又強。
又便宜,然後又強。
1:12.404–1:13.320
關鍵的它還快。
關鍵的是它還快。
1:13.320–1:18.320
關鍵的它還快,土字速度大概在每秒100個Token以上,甩開其他大模型一大截。
關鍵的是它還快,土字速度大概在每秒100個Token以上,甩開其他大模型一大截。
1:18.320–1:23.448
所以跑那些agent任務的時候特別絲滑,便宜,能力又強,速度又快,三樣都湊起來。
所以跑那些agent任務的時候特別絲滑,便宜、能力又強、速度又快,三樣都湊齊了。
1:23.448–1:26.525
可以說在某種程度上來說,打破了一個不可能的三角。
可以說在某種程度上來說,打破了一個不可能的三角。
1:26.525–1:33.320
結果就是API的調用量翻了好幾倍,官方沒公布具體的調用數據,但可以從它最大的客戶OpenCode上去推算。
結果就是API的調用量翻了好幾倍,官方沒公布具體的調用數據,但可以從它最大的客戶OpenCode上去推算。
1:33.320–1:39.618
OpenCode不光是個agent工具,它還提供這種大模型的調用的服務,裡面的DeepSeek就是官方提供的。
OpenCode不光是個agent工具,它還提供這種大模型的調用服務,裡面的DeepSeek就是官方提供的。
1:39.618–1:43.396
套餐會有一些折扣,所以比DeepSeek官方去安量收費要便宜一點。
套餐會有一些折扣,所以比Deepseek官方按量收費要便宜一點。
1:43.396–1:46.602
而且它又是個開源的項目,所以它不限制去接什麼其他的工具。
而且它又是個開源的項目,所以它不限制去接什麼其他的工具。
1:46.602–1:50.725
所以很多人,包括我在內,都從OpenCode裡面去使用DeepSeek。
所以很多人,包括我在內,都從OpenCode裡面去使用DeepSeek。
1:50.725–1:54.961
OpenCode裡面提供免費的V4Flash,付費套餐Go裡面也有收費版。
OpenCode裡面提供免費的V4Flash,付費套餐Go裡面也有收費版。
1:54.961–2:00.343
我自己訂了這個套餐,實際用下來,免費版跟收費版其實沒有太大差別,只是免費版它有調用次數的限制。
我自己訂了這個套餐,實際用下來,免費版跟收費版其實沒有太大差別,只是免費版它有調用次數的限制。
2:00.343–2:01.946
然後接著我們來看具體的數字。
然後接著我們來看具體的數字。
2:01.946–2:03.320
OpenCode的工具,
OpenCode的工具,
2:03.320–2:10.879
官方說,8月1日,V4Flash發布的第二天,免費版燒了5T的Token,收費版燒了3T的Token,第二天就是8T。
官方說,8月1日,V4Flash發布的第二天,免費版燒了5T的Token,收費版燒了3T的Token,第二天就是8T。
2:10.879–2:15.876
這還只是開始,OpenCode有一個實時的數據頁面,收費Token的日消耗量。
這還只是開始,OpenCode有一個實時的數據頁面,顯示收費Token的日消耗量。
2:15.876–2:19.719
8月5日已經漲到了6.3T,是Flash正式版發布前的4倍。
8月5日已經漲到了6.3T,是Flash正式版發布前的4倍。
2:19.719–2:28.431
如果我們再去按照免費跟收費版的比例來推算一下,免費部分一天還要再燒10.5T左右的Token,加起來一天大概要燒17T左右的Token。
如果我們再去按照免費跟收費版的比例來推算一下,免費部分一天還要再燒10.5T左右的Token,加起來一天大概要燒17T左右的Token。
2:28.431–2:29.713
17T是個什麼概念?
17T是個什麼概念?
2:29.713–2:33.320
就是OpenRoot,我們知道它是全球最大的模型的主軟,
就是OpenRoot,我們知道它是全球最大的模型的主站,
2:33.320–2:38.859
基本上沒有質疑,幾百個大模型,800萬的用戶,全平台加起來一天也就3T多的Token。
基本上沒有質疑,幾百個大模型,800萬的用戶,全平台加起來一天也就3T多的Token。
2:38.859–2:45.944
OpenCode在DeepSeek一個模型上就要燒的量,是整個OpenRooter幾百個模型用量的總和的5倍。
OpenCode在DeepSeek一個模型上就要燒的量,是整個OpenRooter幾百個模型用量的總和的5倍。
2:45.944–2:51.613
所以我們來推測一下,官方沒有說漲價的原因,但我認為最有可能的解釋就是,算力真的不太夠了。
所以我們來推測一下,官方沒有說漲價的原因,但我認為最有可能的解釋就是,算力真的不太夠了。
2:51.613–2:58.182
於是Flash變強之後,吸引來的是Agent的重度用戶,工具一接上之後,Token就是沉吊的燒起來了。
於是Flash變強之後,吸引來的是Agent的重度用戶,工具一接上之後,Token就是成倍地燒起來了。
2:58.182–3:02.820
光是OpenCode這一個客戶一天就能干到17T,用量一周直接漲了4倍。
光是OpenCode這一家客戶,一天就能消耗17T,用量一週直接漲了4倍。
3:02.820–3:06.695
但是背後這個卡這個算力不會一周之內就多出4倍,能立刻的去見效。
但背後的這張卡和算力不會在一週內就多出4倍,能立刻見效。
3:06.695–3:08.695
所以只能拿價格去來做暫時的調節。
所以只能靠價格來做暫時的調節。
3:08.695–3:11.070
好了,接下來趕緊跟大家來分享一下快訊。
好了,接下來趕緊跟大家分享快訊。
3:11.070–3:14.820
然後,今天視頻就到這裡,我是Dizon黑心李少,我們下次見。
然後,今天的影片就到這裡,我是Dizon黑心李少,我們下次見。
3:14.820–3:15.000
謝謝。
謝謝。

影片筆記:DeepSeek 为什么突然涨价?

一句話總結

DeepSeek 於 7 月 31 日發布 V4 Flash 正式版後,因打破「便宜、強、快」的不可能三角導致 API 調用量暴增,算力面臨極大壓力,因此於 8 月初通知用戶整體調漲價格,以透過價格機制暫時調節算力需求。

核心重點

  1. 價格策略轉變:DeepSeek 過去以極低單價(每百萬 Token 輸入輸出僅 1-6 元)及極低的緩存命中價格著稱,給人「只降價」的印象。此次 V4 Flash 發布後,通知全部 API 用戶近期整體調漲價格,且漲幅較大,與過去印象形成強烈對比。
  2. V4 Flash 的性能突破:該模型被稱為史上最強,跑分超越參數量更大的 JRM 5.2,且具備高速特性(每秒 100+ Token),打破了市場上「便宜、強、快」的不可能三角。
  3. 用量激增的數據佐證:透過最大客戶 OpenCode 的數據推算,V4 Flash 發布後 Token 消耗量從日消耗 8T 激增至 17T,單一模型用量遠超全球最大模型主軟 OpenRooter 的全平台總和。
  4. 漲價原因推測:主要歸因於算力不足。V4 Flash 吸引大量 Agent 重度用戶,Token 持續大量消耗,而算力無法在一週內增加 4 倍,因此透過價格進行暫時調節。

詳細大綱

1. DeepSeek API 漲價通知與背景

  • 時間點:V4 Flash 發布一周後(8 月初)。
  • 現象:DeepSeek 通知全部 API 用戶近期將整體調漲價格,漲幅較大。
  • 歷史對比
  • 過去 DeepSeek 的印象為「只降價」。
  • 最近一次類似漲價發生在今年 6 月上旬,當時因「風股的定價」高峰時段出現雙倍價格。

2. DeepSeek 原有價格優勢分析

  • 單價優勢
  • Flash 版本:輸入輸出每百萬 Token 分別為 1 塊和 2 塊。
  • Pro 版本:輸入輸出每百萬 Token 分別為 3 塊和 6 塊。
  • 評價:屬國產模型中偏低價格。
  • 特色功能與成本
  • 100 萬上下文不額外收費。
  • 緩存命中價格極低,僅為輸入價格的 1/50(約 2 分錢)。
  • 技術細節:代碼場景緩存命中率達 95% 以上。
  • 綜合成本:100 萬 Token 綜合單價約 6 分錢,1 億 Token 約 6 塊錢。

3. V4 Flash 正式版發布後表現

  • 發布時間:7 月 31 日。
  • 性能表現
  • 跑分超過參數量大好幾倍的 JRM 5.2。
  • 推理速度(土字速度)每秒 100 個 Token 以上,適合 Agent 任務。
  • 市場反應:打破「不可能三角」(便宜、強、快),導致 API 調用量翻數倍。

4. 透過 OpenCode 推算用量激增

  • OpenCode 背景
  • 提供大模型調用服務的 Agent 工具,也是 DeepSeek 的官方提供開源項目。
  • 不限制接入其他工具,是 DeepSeek 的最大客戶。
  • 套餐情況:提供免費版(有調用次數限制)和付費套餐 Go(有折扣)。
  • 數據變化
  • 8 月 1 日(發布第二天):免費版燒 5T Token,收費版燒 3T Token,合計 8T。
  • 8 月 5 日:收費 Token 日消耗量漲至 6.3T,為正式版發布前的 4 倍。
  • 推算:若按比例推算,免費部分一天約燒 10.5T Token,總計一天約 17T Token。
  • 對比 OpenRooter
  • OpenRooter 被描述為全球最大模型主軟,擁有幾百個模型、800 萬用戶。
  • 全平台一天總和僅 3T 多 Token。
  • OpenCode 單一模型用量為其 5 倍。

5. 漲價原因推測

  • 核心原因:算力不足。
  • 邏輯推導:V4 Flash 吸引 Agent 重度用戶,Token 持續大量消耗,算力無法在一週內增加 4 倍,因此透過價格進行暫時調節。

工具 / 模型 / 名詞整理

  • DeepSeek:模型開發商及 API 服務提供方。
  • V4 Flash / VisFlash:DeepSeek 發布的正式版模型名稱,被稱為史上最強模型。
  • Pro:DeepSeek 的另一個模型版本。
  • JRM 5.2:被提及作為跑分對比對象的模型,參數量比 V4 Flash 大。
  • OpenCode:提供大模型調用服務的 Agent 工具,DeepSeek 的官方提供開源項目,也是 DeepSeek 的最大客戶。
  • OpenRooter / OpenRoot:被描述為全球最大的模型主軟,擁有幾百個模型和 800 萬用戶。
  • Go:OpenCode 中的付費套餐名稱。
  • Token:計費單位,文中提及消耗量以 T(Trillion,兆)為單位。

操作流程整理

  1. 發布模型:DeepSeek 於 7 月 31 日發布 V4 Flash 正式版。
  2. 用戶接入:用戶(如 OpenCode 平台)接入 V4 Flash 模型,提供免費版與付費版(Go 套餐)服務。
  3. 用量監控
  • 8 月 1 日:免費版消耗 5T,收費版消耗 3T,總計 8T。
  • 8 月 5 日:收費版消耗增至 6.3T,推算免費版消耗約 10.5T,總計達 17T。
  1. 對比分析:將單一模型(OpenCode 上的 V4 Flash)的日消耗量(17T)與全球最大平台(OpenRooter)的全平台總和(3T+)進行對比,確認用量激增。
  2. 發布漲價通知:DeepSeek 於 8 月初通知全部 API 用戶近期整體調漲價格,以應對算力不足的問題。

值得注意的限制或風險

  • 算力瓶頸:V4 Flash 的高效能與低價格導致需求遠超供給,算力無法在一週內增加 4 倍,顯示基礎設施擴張可能滯後於市場需求。
  • 價格波動風險:DeepSeek 過去給用戶「只降價」的印象,此次漲價幅度較大,且曾出現高峰時段雙倍價格的情況,用戶需留意價格不穩定性。
  • 單一模型依賴風險:OpenCode 單一模型(V4 Flash)的用量已超過擁有 800 萬用戶的全球最大平台總和,顯示對單一模型的高度依賴可能帶來運營風險。

逐字稿辨識疑點

  • VisFlash:逐字稿開頭提到「Deepseek发布了VisFlash正式版」,後文均稱「V4 Flash」,疑為聽寫錯誤或口誤,實際應指 V4 Flash。
  • 土字速度:形容速度時使用「土字速度」,疑為「推理速度」或「吞吐速度」的聽寫錯誤。
  • 風股的定價:提到「今年6月的上旬,風股的定價」,疑為「風控定價」或特定術語的聽寫錯誤,需查證。
  • OpenRoot / OpenRooter:逐字稿中交替出現「OpenRoot」與「OpenRooter」,疑為同一產品名稱的不同聽寫。
  • 沉吊的燒起來:形容 Token 消耗時使用「沉吊的燒起來」,疑為「成堆」或「持續」的聽寫錯誤。
  • 干到 17T:形容用量達到 17T 時使用「干到」,疑為「達到」或「幹到」的口語化表達。

可延伸追問

  • DeepSeek 預計何時能解決算力不足的問題?漲價是永久性的還是暫時性的調節手段?
  • 「風股的定價」具體指什麼?是否為 DeepSeek 內部特定的定價策略術語?
  • OpenCode 作為 DeepSeek 的最大客戶,其免費版與付費版的用戶結構如何影響 DeepSeek 的整體營收與算力分配?
  • JRM 5.2 的參數量具體是多少?為何 V4 Flash 能在跑分上超越參數量更大的模型?

尚未產生學習筆記

請在 Telegram 指令最後加上「學習」,例如:videonote 網址 英文 雙語 學習