WEBVTT

00:00.000 --> 00:29.320
7月31號,Deepseek发布了VisFlash正式版,這是它史上最強的模型。一周之後的今天,Deepseek給全部的API用戶都發了一個通知,計劃近期整體上調價格,而且預計漲幅較大。我第一反應是看錯了,因為Deepseek在文印象裡面一直只發降價的新聞。我翻了一下,最接近漲價的一次是今年6月的上旬,風股的定價,高峰時段的雙倍的價格,僅此而已。所以很多小伙伴來問,這次憑什麼漲,是要收割了嗎?所以我來跟大家分析一下。先說它原來有多便宜,真的非常便宜。

00:29.320 --> 00:59.320
很多人沒用過Deepseek的按量集費,所以沒有這個感覺。我們先來看單價,就是每百萬Token的輸入輸出,Flash的價格是一塊和兩塊,Pro是三塊和六塊,在國產模型裡面就是偏低的。然後它還有兩個別家沒有的東西,第一個就是一個million的100萬的上下文,不額外收費。第二個就是緩存命中只有輸入價格的五十分之一,相當於只有兩分錢,遠低於其他的廠商。而且還有一個細節,就是Deepseek的緩存優化做得非常好,寫代碼的場景裡面,命中率基本上95%以上。這樣算下來,其實

00:59.320 --> 01:13.320
100萬Token的綜合單價只要六分錢,1億Token只要六塊錢。前幾天7月31號,V4Flash正式版本一發,能力大幅度增強。光看跑分已經超過了,參數量比它大好幾倍的JRM5.2。又便宜,然後又強。關鍵的它還快。

01:13.320 --> 01:33.320
關鍵的它還快,土字速度大概在每秒100個Token以上,甩開其他大模型一大截。所以跑那些agent任務的時候特別絲滑,便宜,能力又強,速度又快,三樣都湊起來。可以說在某種程度上來說,打破了一個不可能的三角。結果就是API的調用量翻了好幾倍,官方沒公布具體的調用數據,但可以從它最大的客戶OpenCode上去推算。

01:33.320 --> 02:03.320
OpenCode不光是個agent工具,它還提供這種大模型的調用的服務,裡面的DeepSeek就是官方提供的。套餐會有一些折扣,所以比DeepSeek官方去安量收費要便宜一點。而且它又是個開源的項目,所以它不限制去接什麼其他的工具。所以很多人,包括我在內,都從OpenCode裡面去使用DeepSeek。OpenCode裡面提供免費的V4Flash,付費套餐Go裡面也有收費版。我自己訂了這個套餐,實際用下來,免費版跟收費版其實沒有太大差別,只是免費版它有調用次數的限制。然後接著我們來看具體的數字。OpenCode的工具,

02:03.320 --> 02:33.300
官方說,8月1日,V4Flash發布的第二天,免費版燒了5T的Token,收費版燒了3T的Token,第二天就是8T。這還只是開始,OpenCode有一個實時的數據頁面,收費Token的日消耗量。8月5日已經漲到了6.3T,是Flash正式版發布前的4倍。如果我們再去按照免費跟收費版的比例來推算一下,免費部分一天還要再燒10.5T左右的Token,加起來一天大概要燒17T左右的Token。17T是個什麼概念?就是OpenRoot,我們知道它是全球最大的模型的主軟,

02:33.320 --> 03:02.820
基本上沒有質疑,幾百個大模型,800萬的用戶,全平台加起來一天也就3T多的Token。OpenCode在DeepSeek一個模型上就要燒的量,是整個OpenRooter幾百個模型用量的總和的5倍。所以我們來推測一下,官方沒有說漲價的原因,但我認為最有可能的解釋就是,算力真的不太夠了。於是Flash變強之後,吸引來的是Agent的重度用戶,工具一接上之後,Token就是沉吊的燒起來了。光是OpenCode這一個客戶一天就能干到17T,用量一周直接漲了4倍。

03:02.820 --> 03:14.820
但是背後這個卡這個算力不會一周之內就多出4倍,能立刻的去見效。所以只能拿價格去來做暫時的調節。好了,接下來趕緊跟大家來分享一下快訊。然後,今天視頻就到這裡,我是Dizon黑心李少,我們下次見。

03:14.820 --> 03:16.820
謝謝。

