WEBVTT

00:00.360 --> 00:01.040
各位朋友大家好

00:01.040 --> 00:01.860
欢迎来关注昆蓬套

00:01.860 --> 00:03.220
那今天给大家介绍一个

00:03.220 --> 00:04.760
Deepseek V4 Flash 0731

00:04.760 --> 00:06.920
携带多摩泰的一个版本

00:06.920 --> 00:09.140
那这个是社区的大佬他们做的

00:09.140 --> 00:10.560
它是怎么实现的

00:10.560 --> 00:13.320
其实它是把Deepseek V4 Flash 0731

00:13.320 --> 00:15.080
这个模型在前面套了一层

00:15.080 --> 00:16.320
然后套的是什么呢

00:16.320 --> 00:17.780
我去扒了一下

00:17.780 --> 00:20.040
它应该是套的是

00:20.040 --> 00:25.580
千问3.535B的模型

00:25.580 --> 00:27.320
然后把它的多摩泰的那部分

00:27.320 --> 00:29.500
就是MUN VIT这个模块

00:29.500 --> 00:30.800
然后把它移植到

00:30.800 --> 00:32.780
Deepseek V4 Flash上来

00:32.780 --> 00:33.260
这样的话

00:33.260 --> 00:34.120
Deepseek V4 Flash

00:34.120 --> 00:35.960
就可以实现多摩泰的一个效果

00:35.960 --> 00:37.960
那其实前几期的视频

00:37.960 --> 00:38.800
我也给大家讲了一下

00:38.800 --> 00:39.800
怎么样把

00:39.800 --> 00:41.940
比如说通过Skill方式

00:41.940 --> 00:44.820
把那个节约的多摩泰

00:44.820 --> 00:46.300
或者是千问的多摩泰

00:46.300 --> 00:47.980
移植到Deepseek V4 Flash上来

00:47.980 --> 00:49.080
在Agent里面实现

00:49.080 --> 00:50.420
一个多摩泰的一个效果

00:50.420 --> 00:52.280
那那个是通过后期进行合成的

00:52.280 --> 00:52.980
那这个项目

00:52.980 --> 00:53.900
他们是通过

00:53.900 --> 00:56.340
大模型本身的能力上面

00:56.340 --> 00:56.960
进行合成的

00:56.960 --> 00:57.500
它相当于在

00:57.500 --> 00:59.240
上面套了一层视觉编码器

00:59.240 --> 01:01.060
当然它这个模型

01:01.060 --> 01:02.580
也支持Deepseek V4 Flash

01:02.580 --> 01:03.580
然后进行推理

01:03.580 --> 01:05.360
目前它的整个一个

01:05.360 --> 01:06.580
基准测试的一个速度

01:06.580 --> 01:09.600
还是非常成功的

01:09.600 --> 01:10.160
它这种合并

01:10.160 --> 01:11.140
就是达到了一个

01:11.140 --> 01:12.760
就是6.5的一个效果

01:12.760 --> 01:13.640
那说明了

01:13.640 --> 01:15.800
它的整个的一个模型的能力

01:15.800 --> 01:17.240
还是非常不错的

01:17.240 --> 01:18.160
那当然它这个的话

01:18.160 --> 01:20.180
对Deepseek V4 Flash本身的模型的

01:20.180 --> 01:21.380
损失是很小的

01:21.380 --> 01:22.300
几乎是可以忽略不尽

01:22.300 --> 01:23.500
就是它对模型本身

01:23.500 --> 01:24.420
没有做改造

01:24.420 --> 01:25.820
只是在它前面套了一层

01:25.820 --> 01:26.680
就是如果判断是

01:26.680 --> 01:28.560
图片的话就路由到

01:28.560 --> 01:30.640
它的视频编码器

01:30.640 --> 01:32.760
解码器上面去做一些工作

01:32.760 --> 01:34.700
那这个其实

01:34.700 --> 01:36.400
它的这个模型的能力

01:36.400 --> 01:38.740
虽然说不是很官方

01:38.740 --> 01:40.960
前段时间好像也给大家说过

01:40.960 --> 01:42.520
当然在我的群里面说过

01:42.520 --> 01:45.460
就是说JM5.2给它加上多摩泰的一个效果

01:45.460 --> 01:46.920
那Deepseek V4加上多摩泰

01:46.920 --> 01:48.760
它的那个使用的场景更多

01:48.760 --> 01:49.680
那这个模型呢

01:49.680 --> 01:50.080
目前呢

01:50.080 --> 01:52.440
我在网上看到有人在两台DGXBAR上跑

01:52.440 --> 01:53.880
有一个不错的一个效果

01:53.880 --> 01:55.040
就相当于它完全本地

01:55.040 --> 01:57.340
然后呢推你的成本极低的情况下

01:57.340 --> 01:58.640
还能实现一个多摩泰

01:58.640 --> 01:59.960
然后一照上下文的一个效果

01:59.960 --> 02:01.760
那这个模型还是非常非常不错的

02:01.760 --> 02:03.400
那我们其实呢

02:03.400 --> 02:06.680
社区呢有这样的说明

02:06.680 --> 02:09.160
这些还是有非常多的一个需求

02:09.160 --> 02:10.060
那目前呢

02:10.060 --> 02:11.340
它这个参数还是305B

02:11.340 --> 02:13.520
就是本身没有增加太多

02:13.520 --> 02:13.920
然后呢

02:13.920 --> 02:16.420
它目前是168G的一个大小

02:16.420 --> 02:17.340
所以说呢

02:17.340 --> 02:19.380
两台DGXBAR肯定是可以把它跑起来的

02:19.380 --> 02:20.180
当然在麦克上也能跑

02:20.180 --> 02:21.560
我目前并没有把它跑起来

02:21.560 --> 02:22.920
因为我对这样的一个

02:22.920 --> 02:24.780
就是本地去跑的需求不是很大

02:24.780 --> 02:26.220
因为如果有这样的话

02:26.220 --> 02:27.980
我已经通过我的那个Skills进行合并了

02:27.980 --> 02:28.720
那感兴趣的话呢

02:28.720 --> 02:29.480
大家可以来尝试一下

02:29.480 --> 02:30.760
那我觉得这种的话

02:30.760 --> 02:31.680
是一个非常有价值

02:31.680 --> 02:32.520
当然我们更希望

02:32.520 --> 02:34.340
Deepseek V4官方能够推出

02:34.340 --> 02:35.560
在多摩泰的一个效果

02:35.560 --> 02:37.160
那我们再期待一下吧

02:37.160 --> 02:37.640
那好的

02:37.640 --> 02:38.640
今天就介绍到这

02:38.640 --> 02:39.000
谢谢大家

02:39.000 --> 03:08.980
谢谢大家

