WEBVTT
Kind: captions
Language: zh-Hans

00:00:00.000 --> 00:00:01.066
昨天晚上呢

00:00:01.066 --> 00:00:05.733
月之暗面把Kimi K3呢正式开放了

00:00:05.733 --> 00:00:06.700
那这个模型呢

00:00:06.700 --> 00:00:10.066
干了两件非常非常有冲击力的事情

00:00:10.166 --> 00:00:10.966
第一呢

00:00:10.966 --> 00:00:14.766
它把全球开源模型的参数记录

00:00:14.766 --> 00:00:16.066
直接翻了一个倍

00:00:16.133 --> 00:00:20.500
K3模型的参数呢是2.8万亿

00:00:20.500 --> 00:00:21.533
什么概念呢

00:00:21.566 --> 00:00:23.900
在之前的开源阵营里面

00:00:23.900 --> 00:00:25.433
最大的是DeepSeek

00:00:25.500 --> 00:00:26.900
只有1.6万亿

00:00:26.900 --> 00:00:28.266
那么K3的大小呢

00:00:28.266 --> 00:00:29.766
差不多是它的两倍

00:00:29.900 --> 00:00:30.700
第二点

00:00:30.700 --> 00:00:31.466
在一项

00:00:31.466 --> 00:00:34.766
衡量真实知识工作的评测里面呢

00:00:34.766 --> 00:00:37.033
它排到了全球第三

00:00:37.033 --> 00:00:38.466
第一名和第二名呢

00:00:38.466 --> 00:00:42.466
分别是Claude Fable 5和GPT-5.6 Sol

00:00:42.633 --> 00:00:46.133
而且要注意的是Claude Opus 4.8

00:00:46.133 --> 00:00:47.866
被它挤到了后面一名

00:00:48.033 --> 00:00:49.133
开源模型呢

00:00:49.133 --> 00:00:50.133
第一次站到了

00:00:50.133 --> 00:00:52.966
闭源次旗舰模型的前面

00:00:53.066 --> 00:00:54.266
那么这期视频呢

00:00:54.266 --> 00:00:57.166
我们就来详细地了解一下Kimi K3

00:00:57.166 --> 00:00:58.666
它到底强在哪

00:00:58.666 --> 00:01:00.033
价格又有多狠

00:01:00.166 --> 00:01:02.033
先来看一下时间线

00:01:02.066 --> 00:01:03.933
其实在7月15号

00:01:03.933 --> 00:01:07.300
Kimi的开放平台的一个促销页面

00:01:07.300 --> 00:01:08.966
已经提前泄露了

00:01:08.966 --> 00:01:11.900
大家就知道可能有新的模型要上了

00:01:11.900 --> 00:01:12.933
那么在十六号

00:01:12.933 --> 00:01:14.500
也就是昨天的晚上

00:01:14.500 --> 00:01:16.666
Kimi K3呢正式上线

00:01:16.766 --> 00:01:18.500
分别在Kimi的APP

00:01:18.500 --> 00:01:20.966
以及Kimi Code里面都可以使用了

00:01:20.966 --> 00:01:23.066
现在只要进入网站APP

00:01:23.066 --> 00:01:25.333
包括如果你是Kimi Code的会员

00:01:25.333 --> 00:01:27.500
都可以正式使用Kimi K3了

00:01:27.500 --> 00:01:28.466
这个时间点呢

00:01:28.466 --> 00:01:29.866
也非常的微妙

00:01:29.866 --> 00:01:30.866
正好卡在

00:01:30.866 --> 00:01:33.933
上海的世界人工智能大会前面

00:01:33.966 --> 00:01:34.666
而且呢

00:01:34.666 --> 00:01:37.666
月之暗面也正在谈新的一轮融资

00:01:37.666 --> 00:01:40.500
估值呢大约是315亿美元

00:01:40.533 --> 00:01:43.100
Kimi K3这个成绩单是给谁看的

00:01:43.100 --> 00:01:44.433
就不用我多说了

00:01:44.500 --> 00:01:46.233
然后来看一下规格

00:01:46.333 --> 00:01:48.033
2.8万亿这个参数呢

00:01:48.033 --> 00:01:49.933
肯定是非常吸引眼球的

00:01:49.966 --> 00:01:51.733
但是我觉得比大更值得

00:01:51.733 --> 00:01:54.300
看的是它怎么样把这么大的模型

00:01:54.300 --> 00:01:55.466
给它跑起来

00:01:55.666 --> 00:01:58.033
看官方放的这张结构图呢

00:01:58.033 --> 00:02:00.466
我们也可以看到有两个新的东西

00:02:00.500 --> 00:02:03.733
一个叫KDA，Kimi Delta Attention

00:02:03.733 --> 00:02:05.500
混合线性注意力

00:02:05.533 --> 00:02:07.066
简单解释就是

00:02:07.066 --> 00:02:08.733
传统注意力的计算量呢

00:02:08.733 --> 00:02:12.266
会随着上下文长度平方级上涨

00:02:12.300 --> 00:02:14.033
越长呢就越贵

00:02:14.166 --> 00:02:15.466
那么K3的做法是呢

00:02:15.466 --> 00:02:17.500
是每四层里面

00:02:17.500 --> 00:02:20.233
三层用便宜的线性注意力

00:02:20.233 --> 00:02:23.033
然后一层用完整的全注意力

00:02:23.033 --> 00:02:25.500
这里省下来的算力换成一个东西

00:02:25.500 --> 00:02:27.366
100万Token的上下文

00:02:27.433 --> 00:02:29.500
之前Kimi K2的上下文长度呢

00:02:29.500 --> 00:02:32.633
只有256K直接翻了4倍

00:02:32.766 --> 00:02:35.666
另外一个新的东西叫Attention Residuals

00:02:35.766 --> 00:02:39.166
让深层网络把浅层的注意力信息呢

00:02:39.166 --> 00:02:40.633
直接接力上来

00:02:40.700 --> 00:02:42.533
官方说这套组合

00:02:42.533 --> 00:02:44.466
让整体的训练效率

00:02:44.466 --> 00:02:46.933
做到了Kimi K2的2.5倍

00:02:46.966 --> 00:02:49.566
然后就是混合专家系统这块

00:02:49.566 --> 00:02:51.333
做的也非常非常的激进

00:02:51.566 --> 00:02:54.266
整个模型呢有896个专家

00:02:54.266 --> 00:02:56.833
每次推理呢只激活16个

00:02:56.933 --> 00:03:00.500
也就是说虽然总参数量是2.8万亿

00:03:00.500 --> 00:03:02.333
但是真正干活的每次呢

00:03:02.333 --> 00:03:04.266
只是里面很小的一部分

00:03:04.300 --> 00:03:05.866
再来看一下成绩单

00:03:05.866 --> 00:03:09.366
我挑三个重点的在视频里面说一下

00:03:09.433 --> 00:03:09.933
第一个呢

00:03:09.933 --> 00:03:12.933
是刚才视频开头提到的GDPval

00:03:13.033 --> 00:03:14.666
它测的呢不是做题

00:03:14.733 --> 00:03:18.266
是44个职业里面真实的工作任务

00:03:18.266 --> 00:03:21.766
那么K3呢是拿了1,687分

00:03:21.766 --> 00:03:23.033
全球第三名

00:03:23.133 --> 00:03:23.700
第二个呢

00:03:23.700 --> 00:03:25.866
是GPQA Diamond

00:03:25.933 --> 00:03:28.133
研究生级别的科学题

00:03:28.133 --> 00:03:30.800
它的得分呢是93.5%

00:03:30.866 --> 00:03:33.366
是目前所有开源模型里面

00:03:33.366 --> 00:03:34.466
得分最高的

00:03:34.566 --> 00:03:35.300
第三个呢

00:03:35.300 --> 00:03:37.866
我觉得是最实在的BrowseComp

00:03:37.866 --> 00:03:40.300
在网上检索问题的答案

00:03:40.300 --> 00:03:43.100
得分呢是91.2%

00:03:43.100 --> 00:03:46.633
也是当时公开成绩里面最高的

00:03:46.633 --> 00:03:47.466
那么这一项呢

00:03:47.466 --> 00:03:50.666
很明显是吃到了100万上下文的红利

00:03:50.733 --> 00:03:53.066
当然测评呢也只能说明一半

00:03:53.066 --> 00:03:56.266
另一半呢我们还要真实上手去测试

00:03:56.266 --> 00:03:58.233
这里呢我测试了两个案例

00:03:58.300 --> 00:03:59.133
第一个测试呢

00:03:59.133 --> 00:04:02.466
是让它根据官方的报道

00:04:02.466 --> 00:04:05.000
以及我自己整理的文件

00:04:05.033 --> 00:04:08.766
让它直接帮我生成一份Kimi K3

00:04:08.766 --> 00:04:12.366
不低于12页的一个PPT幻灯片

00:04:12.366 --> 00:04:14.933
并且直接以网页的形式展现

00:04:15.033 --> 00:04:15.666
那么这个呢

00:04:15.666 --> 00:04:18.933
就是它一次性完成的任务

00:04:18.933 --> 00:04:20.966
可以先从第一屏看一下

00:04:20.966 --> 00:04:22.500
Kimi K3开源模型

00:04:22.500 --> 00:04:24.700
第一次摸到了闭源模型

00:04:24.700 --> 00:04:25.966
次旗舰的门槛

00:04:25.966 --> 00:04:28.500
这是等于是PPT的封面

00:04:28.633 --> 00:04:30.833
然后它最主要的几个参数

00:04:30.933 --> 00:04:31.966
它的配色

00:04:31.966 --> 00:04:33.100
它的布局

00:04:33.100 --> 00:04:34.566
还有这些数据的提取哈

00:04:34.566 --> 00:04:37.966
全部是Kimi K3呢自动去完成的

00:04:38.033 --> 00:04:40.100
我觉得这个版面的布局

00:04:40.100 --> 00:04:41.333
以及参数的提取

00:04:41.333 --> 00:04:43.266
配色其实都做的非常好

00:04:43.266 --> 00:04:45.433
而且内容呢非常的详尽

00:04:45.433 --> 00:04:46.666
非常的丰富

00:04:46.700 --> 00:04:49.166
还有关于它的这个架构拆解

00:04:49.166 --> 00:04:50.466
这种图表设计

00:04:50.466 --> 00:04:52.733
也全部是它一次性完成的

00:04:52.766 --> 00:04:56.266
目前看下来没有找到很明显的错误

00:04:56.300 --> 00:04:56.766
基本上

00:04:56.766 --> 00:04:59.733
可以达到一个直接使用的水平了

00:04:59.766 --> 00:05:02.900
而且是没有创建任何skill的前提下

00:05:02.900 --> 00:05:05.366
只是给它发了一个简单的报告

00:05:05.366 --> 00:05:06.433
以及一个prompt

00:05:06.433 --> 00:05:07.733
让他生成PPT啊

00:05:07.733 --> 00:05:08.666
就完成了

00:05:08.666 --> 00:05:09.933
这能力我觉得还是不错的

00:05:09.966 --> 00:05:11.500
然后我在测试过程当中呢

00:05:11.500 --> 00:05:13.566
发现一个比较明显的问题

00:05:13.666 --> 00:05:16.533
就是不知道是现在使用的人比较多

00:05:16.533 --> 00:05:17.866
还是什么的哈

00:05:17.900 --> 00:05:20.533
就是我发送了这样一条prompt过去

00:05:20.533 --> 00:05:23.833
它整个完成这个任务的耗时

00:05:23.833 --> 00:05:25.000
时间非常的长

00:05:25.033 --> 00:05:27.166
至少花费了十几分钟

00:05:27.166 --> 00:05:27.833
那这个任务

00:05:27.833 --> 00:05:31.066
如果以往是用GPT或者用Claude去完成

00:05:31.066 --> 00:05:31.833
我觉得这时间

00:05:31.833 --> 00:05:33.300
肯定是在10分钟以内的

00:05:33.300 --> 00:05:35.300
因为任务并不是特别的难

00:05:35.333 --> 00:05:37.166
然后它的内容也不是很多

00:05:37.266 --> 00:05:38.233
用Kimi K3呢

00:05:38.233 --> 00:05:39.500
生成任务的时间呢

00:05:39.500 --> 00:05:41.100
是超出了我的预期的

00:05:41.233 --> 00:05:42.700
然后第二个任务呢

00:05:42.700 --> 00:05:46.833
是我让它基于我前面两期视频

00:05:46.833 --> 00:05:49.666
我是创建了一个体感游戏

00:05:49.666 --> 00:05:51.366
用谷歌的模型

00:05:51.366 --> 00:05:55.033
它可以监控我们人体的关节部位

00:05:55.033 --> 00:05:57.866
首先我是做了一个体感监视器

00:05:57.866 --> 00:05:59.766
这个在上期视频已经讲过了

00:05:59.833 --> 00:06:01.433
包括它的项目

00:06:01.433 --> 00:06:03.233
我已经开源到GitHub上面去了

00:06:03.300 --> 00:06:03.733
后面呢

00:06:03.733 --> 00:06:08.033
我又用GPT-5.6 Sol添加了几个体感游戏

00:06:08.066 --> 00:06:09.533
比如有体感穿墙

00:06:09.533 --> 00:06:10.833
星球互联

00:06:10.833 --> 00:06:13.066
还有这个切水果的游戏

00:06:13.066 --> 00:06:14.866
以及双人对打的游戏啊

00:06:14.866 --> 00:06:16.433
这个是之前评测Claude Fable 5

00:06:16.433 --> 00:06:17.966
以及GPT-5.6 Sol生成的

00:06:18.033 --> 00:06:18.733
然后今天呢

00:06:18.733 --> 00:06:21.533
我是想用这个Kimi K3

00:06:21.566 --> 00:06:25.200
去做一个体感消消乐的游戏

00:06:25.233 --> 00:06:27.100
那其实像这套框架哈

00:06:27.100 --> 00:06:29.933
在我原来项目里面它它已经生成了

00:06:29.933 --> 00:06:31.300
也就是它的模型啊

00:06:31.300 --> 00:06:32.333
它的底层逻辑啊

00:06:32.333 --> 00:06:33.433
框架都有了

00:06:33.433 --> 00:06:34.900
只是让它在这个基础上

00:06:34.900 --> 00:06:37.000
去增加一个体感消消乐的游戏

00:06:37.066 --> 00:06:38.466
那么今天用Kimi K3呢

00:06:38.466 --> 00:06:39.633
出现了两个问题

00:06:39.633 --> 00:06:40.233
第一个问题呢

00:06:40.233 --> 00:06:43.300
就是刚才我提到的它的耗时呢

00:06:43.300 --> 00:06:44.733
非常非常的久

00:06:44.733 --> 00:06:46.866
运行了差不多十几二十分钟

00:06:46.866 --> 00:06:48.300
都没有完成

00:06:48.366 --> 00:06:49.300
然后第二个问题呢

00:06:49.300 --> 00:06:52.333
就是我目前开通的是

00:06:52.333 --> 00:06:54.733
Kimi的第二个等级的套餐

00:06:54.733 --> 00:06:57.433
也就是一个月是99块钱

00:06:57.500 --> 00:06:59.500
那么是可以在Kimi Code里面

00:06:59.500 --> 00:07:02.366
去使用这个Kimi K3的模型

00:07:02.466 --> 00:07:04.500
如果你开通的是第一个等级的套餐

00:07:04.500 --> 00:07:05.733
目前在Kimi Code里面

00:07:05.733 --> 00:07:08.633
是使用不了这个K3的模型的

00:07:08.700 --> 00:07:10.466
完事呢我在测试第二个任务的

00:07:10.466 --> 00:07:11.566
时候可以看到

00:07:11.566 --> 00:07:13.500
它给我罗列的TODO里面

00:07:13.500 --> 00:07:14.733
有这么多步骤

00:07:14.733 --> 00:07:15.633
我觉得这个步骤

00:07:15.633 --> 00:07:18.100
是设计得有点过于冗余的

00:07:18.100 --> 00:07:20.133
然后在做第二个任务的时候

00:07:20.133 --> 00:07:22.400
仅仅只是完成了第一条TODO

00:07:22.433 --> 00:07:24.666
它五个小时的用量限制

00:07:24.666 --> 00:07:26.100
就已经达到了

00:07:26.100 --> 00:07:26.333
然后

00:07:26.333 --> 00:07:29.633
并且呢周用量也达到了20%的使用

00:07:29.700 --> 00:07:30.166
也就是说

00:07:30.166 --> 00:07:32.666
我开通99块钱一个月的会员

00:07:32.666 --> 00:07:35.100
仅仅只是完成了一个多的任务

00:07:35.100 --> 00:07:36.466
第二个任务还没有完成

00:07:36.500 --> 00:07:38.466
有可能是因为这个模型太大

00:07:38.466 --> 00:07:40.066
然后现在用的人太多

00:07:40.066 --> 00:07:42.500
所以它整体的一个使用量限制

00:07:42.500 --> 00:07:43.000
比较少

00:07:43.033 --> 00:07:45.766
包括我开通的这个第二等级的会员

00:07:45.766 --> 00:07:49.233
啊它并不支持100万的上下文

00:07:49.233 --> 00:07:50.733
只有256K那么

00:07:50.733 --> 00:07:53.566
你必须是开通这个200块钱一个月的

00:07:53.566 --> 00:07:53.733
啊

00:07:53.733 --> 00:07:56.300
才可以享受100万的上下文

00:07:56.300 --> 00:07:57.766
长度给我的感觉

00:07:57.766 --> 00:07:59.366
还是不知道因为算力

00:07:59.366 --> 00:08:00.766
还是什么其他原因啊

00:08:00.766 --> 00:08:02.700
诚意不是特别的够

00:08:02.766 --> 00:08:03.366
接下来呢

00:08:03.366 --> 00:08:04.766
说一下价格

00:08:04.766 --> 00:08:06.266
这个可能是对使用者

00:08:06.266 --> 00:08:08.766
开发者杀伤力最大的部分

00:08:08.833 --> 00:08:11.666
输入呢是3美元每100万TOKEN

00:08:11.666 --> 00:08:13.166
输出呢是15美元

00:08:13.266 --> 00:08:15.066
如果是缓存命中的话

00:08:15.066 --> 00:08:16.300
输入只要3毛

00:08:16.300 --> 00:08:16.766
这一块呢

00:08:16.766 --> 00:08:19.166
一直是Kimi做的比较好的地方

00:08:19.266 --> 00:08:19.866
OK

00:08:19.966 --> 00:08:21.166
那么强的地方呢

00:08:21.166 --> 00:08:22.333
已经说完了

00:08:22.333 --> 00:08:22.833
接下来呢

00:08:22.833 --> 00:08:24.700
来泼两盆冷水

00:08:24.833 --> 00:08:25.633
第一盆呢

00:08:25.633 --> 00:08:28.500
全球最大开源模型的这个说法呢

00:08:28.500 --> 00:08:31.033
它现在还只是一个期货模型

00:08:31.033 --> 00:08:32.033
能用是真的

00:08:32.033 --> 00:08:33.866
但是呢权重还没有开放

00:08:33.933 --> 00:08:36.766
官方是承诺在7月27号之前

00:08:36.766 --> 00:08:39.466
放出完整的权重和技术报告

00:08:39.500 --> 00:08:40.133
第二盆呢

00:08:40.133 --> 00:08:42.033
就算是权重开放了

00:08:42.033 --> 00:08:43.433
我们自己本地电脑呢

00:08:43.433 --> 00:08:44.533
也是跑不动的

00:08:44.633 --> 00:08:46.500
2.8万亿参数呢

00:08:46.533 --> 00:08:49.933
就算你有1.5TB内存的Mac Studio集群

00:08:49.933 --> 00:08:51.333
跑起来都够呛

00:08:51.333 --> 00:08:53.566
这是一个数据中心级别的模型

00:08:53.633 --> 00:08:55.533
所以开源对于个人的意义呢

00:08:55.533 --> 00:08:57.233
更多是让第三方平台

00:08:57.233 --> 00:08:58.966
能便宜的把它跑起来

00:08:58.966 --> 00:09:01.433
而不是说把它下载到本地自己去跑

