1
00:00:00,166 --> 00:00:02,866
据说 DeepSeek Harness 这个 AI 工具

2
00:00:02,866 --> 00:00:04,266
刚发布两天

3
00:00:04,333 --> 00:00:05,866
就有高手挖出了

4
00:00:05,866 --> 00:00:08,300
一个核弹级邪修玩法

5
00:00:08,500 --> 00:00:10,166
只要切换到极简模式

6
00:00:10,333 --> 00:00:13,433
DeepSeek 模型的性能就会瞬间暴增

7
00:00:13,566 --> 00:00:16,133
甚至做到了 Fable 5 级别的效果

8
00:00:16,433 --> 00:00:17,500
真的假的

9
00:00:17,566 --> 00:00:18,666
你们信吗

10
00:00:18,966 --> 00:00:21,366
有评论区的朋友叫我试试看

11
00:00:21,700 --> 00:00:22,833
试试就逝世

12
00:00:23,466 --> 00:00:25,100
打开 DeepSeek Harness

13
00:00:25,100 --> 00:00:27,266
默认使用的是标准模式

14
00:00:27,300 --> 00:00:30,333
会给模型提供 AI 工具该有的能力

15
00:00:30,400 --> 00:00:32,300
你就把它当 Codex 用

16
00:00:32,400 --> 00:00:34,666
而极简模式就朴素多了

17
00:00:34,666 --> 00:00:37,866
只给模型提供一个能持续运行的终端

18
00:00:37,933 --> 00:00:39,733
加一个文件编辑器

19
00:00:39,800 --> 00:00:41,766
其他的能力全部关掉

20
00:00:42,166 --> 00:00:44,066
我先让 DeepSeek V4 Pro

21
00:00:44,066 --> 00:00:46,666
开发 3D 第一人称射击游戏

22
00:00:46,933 --> 00:00:48,133
同一套提示词

23
00:00:48,133 --> 00:00:50,100
我先用标准模式跑了一遍

24
00:00:50,133 --> 00:00:52,100
再用极简模式跑了一遍

25
00:00:52,600 --> 00:00:53,600
标准模式下

26
00:00:53,600 --> 00:00:55,000
AI 调用了技能

27
00:00:55,066 --> 00:00:56,800
中间有很多文字输出

28
00:00:56,800 --> 00:00:59,066
会告诉你 AI 在想什么

29
00:00:59,066 --> 00:01:00,166
准备干什么

30
00:01:00,300 --> 00:01:03,400
就是我们日常使用 AI 编程工具的那种感觉

31
00:01:03,933 --> 00:01:06,433
而极简模式只有思考 终端

32
00:01:06,433 --> 00:01:09,133
和字符串替换这个工具调用

33
00:01:09,266 --> 00:01:11,533
中间没有任何多余的输出

34
00:01:11,866 --> 00:01:14,166
AI 就像个哑巴一样

35
00:01:14,933 --> 00:01:17,366
标准模式跑完用了 50 步

36
00:01:17,566 --> 00:01:19,800
AI 自己检测并修复了 Bug

37
00:01:19,933 --> 00:01:21,900
总共花了 33 分钟

38
00:01:22,366 --> 00:01:24,766
极简模式跑完用了 77 步

39
00:01:24,966 --> 00:01:27,266
总共只花了 23 分钟

40
00:01:27,600 --> 00:01:30,000
比标准模式快了 10 分钟

41
00:01:30,333 --> 00:01:34,500
但是输入 Tokens 反而比标准模式多了 70 万

42
00:01:34,966 --> 00:01:36,400
再看看成品效果

43
00:01:36,600 --> 00:01:39,500
标准模式做出来的游戏体验非常顺畅

44
00:01:39,733 --> 00:01:43,333
移动 跳跃 疾跑 射击 杀敌都是 OK 的

45
00:01:43,400 --> 00:01:45,900
甚至还可以用 CF 里的二段跳

46
00:01:46,366 --> 00:01:48,666
但是敌人不能发射子弹

47
00:01:48,666 --> 00:01:49,933
只能追着你跑

48
00:01:49,966 --> 00:01:51,366
没有什么压迫感

49
00:01:51,400 --> 00:01:52,700
而且还有个 Bug

50
00:01:52,966 --> 00:01:54,766
敌人追着我跑了一会之后

51
00:01:54,766 --> 00:01:56,266
就被我吓跑了

52
00:01:56,666 --> 00:01:59,066
我提示词里好像没有这么要求啊

53
00:01:59,100 --> 00:02:00,300
这合理吗

54
00:02:00,666 --> 00:02:02,566
如果你被人机给锤死了

55
00:02:02,566 --> 00:02:04,500
还会触发倒地效果

56
00:02:04,666 --> 00:02:07,366
视角跟真人倒在地上一模一样

57
00:02:07,500 --> 00:02:09,200
哎 这个细节做的不错

58
00:02:09,733 --> 00:02:11,166
再看看极简模式

59
00:02:11,366 --> 00:02:13,966
它的界面比标准模式做得更简洁

60
00:02:14,266 --> 00:02:15,866
背景墙也更真实

61
00:02:16,000 --> 00:02:18,366
各种功能同样都是正常的

62
00:02:18,566 --> 00:02:20,600
而且敌人能够发射子弹

63
00:02:20,800 --> 00:02:22,100
感觉更智能

64
00:02:22,133 --> 00:02:23,933
游玩的压迫感也更强

65
00:02:24,500 --> 00:02:26,000
不过被击倒的时候

66
00:02:26,000 --> 00:02:27,933
我的身体还是站立着的

67
00:02:27,933 --> 00:02:31,866
跟标准模式那个倒地视角相比就差点意思了

68
00:02:32,400 --> 00:02:33,866
从成品效果来看

69
00:02:33,866 --> 00:02:35,466
两者半斤八两吧

70
00:02:35,466 --> 00:02:36,400
各有优缺

71
00:02:36,700 --> 00:02:38,466
但是从耗时来看

72
00:02:38,533 --> 00:02:40,966
极简模式快了整整 10 分钟

73
00:02:41,333 --> 00:02:43,533
虽然输入 Tokens 多了一点

74
00:02:43,533 --> 00:02:46,266
可缓存命中率接近 100%

75
00:02:46,300 --> 00:02:48,933
这点差距的费用基本可以忽略

76
00:02:49,300 --> 00:02:50,366
所以这一局

77
00:02:50,366 --> 00:02:52,966
我会觉得极简模式略胜一筹

78
00:02:53,533 --> 00:02:54,566
第二轮测试

79
00:02:54,566 --> 00:02:58,100
我让 AI 开发一个 AI 宠物领养系统

80
00:02:58,400 --> 00:03:00,200
这个任务需要从电脑文件中

81
00:03:00,200 --> 00:03:02,433
获取 DeepSeek 的模型密钥

82
00:03:02,566 --> 00:03:04,866
还需要联网搜索图片并下载

83
00:03:04,933 --> 00:03:06,766
开发完整的前端和后端

84
00:03:06,866 --> 00:03:08,500
调用 AI 模型能力

85
00:03:08,900 --> 00:03:09,900
看看结果

86
00:03:09,966 --> 00:03:11,933
标准模式跑了 59 步

87
00:03:11,966 --> 00:03:13,800
总共耗时 49 分钟

88
00:03:14,166 --> 00:03:17,866
关键是它成功找到了我电脑上的模型密钥

89
00:03:18,066 --> 00:03:19,600
全程没让我插手

90
00:03:19,600 --> 00:03:21,100
直接交付了成品

91
00:03:21,766 --> 00:03:23,666
极简模式跑了 87 步

92
00:03:23,700 --> 00:03:26,066
总共只耗时不到 28 分钟

93
00:03:26,133 --> 00:03:28,700
比标准模式快了 21 分钟

94
00:03:28,933 --> 00:03:30,666
Tokens 消耗也差不多

95
00:03:31,000 --> 00:03:34,166
但是它没能从我电脑上找到模型密钥

96
00:03:34,266 --> 00:03:35,933
最后还是得我自己填

97
00:03:36,000 --> 00:03:37,933
可交付性就差了一些

98
00:03:38,400 --> 00:03:40,100
看看标准模式的成果

99
00:03:40,266 --> 00:03:41,933
整体布局还是不错的

100
00:03:42,000 --> 00:03:43,800
宠物卡片的排版很舒服

101
00:03:44,100 --> 00:03:46,000
嗯 但也没有到惊艳的程度

102
00:03:46,200 --> 00:03:49,700
而且右上方那行提示文字的位置没有对齐

103
00:03:50,166 --> 00:03:53,266
不过 AI 顺利完成了抓取鲸鱼娘图片

104
00:03:53,333 --> 00:03:56,533
并且调用 AI 大模型来生成文案的任务

105
00:03:57,266 --> 00:04:00,100
点击就可以领养你想要的鲸鱼娘了

106
00:04:00,333 --> 00:04:03,400
被领养走的小鲸鱼卡片样式会发生变化

107
00:04:03,500 --> 00:04:05,166
还可以通过筛选功能

108
00:04:05,166 --> 00:04:07,166
快速找到已领养的宠物

109
00:04:07,766 --> 00:04:09,666
再来看看极简模式的效果

110
00:04:09,733 --> 00:04:13,000
我得先手动填写模型密钥来运行程序

111
00:04:13,500 --> 00:04:15,266
主页面效果也还 OK

112
00:04:15,366 --> 00:04:17,900
看起来跟标准模式做的差不多

113
00:04:17,966 --> 00:04:19,366
毕竟是同一种模型

114
00:04:20,100 --> 00:04:22,400
功能也都是可以正常使用的

115
00:04:22,533 --> 00:04:24,733
但是实用性上差了一截

116
00:04:24,900 --> 00:04:26,766
没有做任何筛选功能

117
00:04:26,800 --> 00:04:29,600
你看不到自己到底领养过哪些宠物

118
00:04:30,100 --> 00:04:33,900
而且卡片上的信息也比标准模式简陋很多

119
00:04:34,000 --> 00:04:37,766
还有右上角那个「AI 文案 DeepSeek 已生成」

120
00:04:38,133 --> 00:04:41,266
怎么看都不像是面向用户的正经产品吧

121
00:04:41,733 --> 00:04:43,133
OK 就测试到这里

122
00:04:43,166 --> 00:04:46,300
大家猜一猜上面 4 次任务加起来

123
00:04:46,300 --> 00:04:48,100
总共花了多少米呢

124
00:04:48,766 --> 00:04:50,466
答案是 3 块

125
00:04:50,666 --> 00:04:52,066
你觉得贵不贵

126
00:04:52,533 --> 00:04:54,366
涨价前最后的倔强啊

127
00:04:58,433 --> 00:04:59,333
整体来看

128
00:04:59,333 --> 00:05:02,133
极简模式最大的优点是执行速度快

129
00:05:02,166 --> 00:05:04,233
说话直截了当不绕弯子

130
00:05:04,333 --> 00:05:07,766
这是因为不需要装载太多工具到上下文

131
00:05:07,966 --> 00:05:11,600
AI 也不用纠结选择哪些工具来执行任务

132
00:05:11,800 --> 00:05:13,966
AI 的注意力可以保持集中

133
00:05:14,300 --> 00:05:16,233
从执行速度的角度来看

134
00:05:16,233 --> 00:05:17,533
说是性能暴增

135
00:05:17,533 --> 00:05:19,000
我觉得没啥问题

136
00:05:19,233 --> 00:05:21,300
但它的短板也很明显

137
00:05:21,433 --> 00:05:24,100
整个过程 AI 几乎不跟你汇报

138
00:05:24,133 --> 00:05:25,800
你不知道它在干什么

139
00:05:26,033 --> 00:05:28,133
没办法直接通过工具联网

140
00:05:28,133 --> 00:05:30,533
还要通过终端脚本另辟蹊径

141
00:05:30,900 --> 00:05:33,700
如果你的任务强依赖某个特定工具

142
00:05:33,800 --> 00:05:35,133
比如理解图片

143
00:05:35,300 --> 00:05:38,033
那么整个差距会被进一步放大

144
00:05:38,433 --> 00:05:41,166
其实官方对极简模式的定位也很清楚

145
00:05:41,333 --> 00:05:44,200
就是专门来跑模型基准测试的

146
00:05:44,333 --> 00:05:46,700
所以把环境削到最干净

147
00:05:46,733 --> 00:05:50,433
好让不同的模型能在同一个标准下公平比较

148
00:05:51,000 --> 00:05:51,933
也就是说

149
00:05:51,966 --> 00:05:54,900
极简模式根本不是给人干活用的

150
00:05:54,900 --> 00:05:56,966
是给模型考试用的

151
00:05:57,233 --> 00:06:00,133
虽然它最后交出来的功能可以正常运行

152
00:06:00,233 --> 00:06:02,966
但是细节和完整度都差了一截

153
00:06:03,100 --> 00:06:04,900
说是能对标 Fable 5

154
00:06:04,900 --> 00:06:06,500
我觉得还是有点夸张了

155
00:06:07,200 --> 00:06:09,766
本来我以为故事到这里就结束了

156
00:06:09,900 --> 00:06:11,766
极简模式跑分虽然猛

157
00:06:11,933 --> 00:06:13,300
但是并不实用

158
00:06:13,400 --> 00:06:15,100
想要好的交付质量

159
00:06:15,133 --> 00:06:17,566
还是得老老实实用标准模式

160
00:06:18,133 --> 00:06:21,333
但是某位大神自己写了一个插件

161
00:06:21,433 --> 00:06:23,966
能做到在完整保留标准模式

162
00:06:23,966 --> 00:06:26,300
那 20 多个工具的前提下

163
00:06:26,366 --> 00:06:29,500
跑分还略微反超了极简模式

164
00:06:30,033 --> 00:06:32,800
作者发现 DeepSeek V4 Pro

165
00:06:32,800 --> 00:06:35,066
对首轮请求的工具结构极其敏感

166
00:06:35,566 --> 00:06:38,233
你第一轮就把 20 多个工具全甩给它

167
00:06:38,400 --> 00:06:39,600
它就会犯迷糊

168
00:06:39,833 --> 00:06:42,333
但如果第一轮沿用极简模式

169
00:06:42,333 --> 00:06:43,800
那句系统提示词

170
00:06:44,133 --> 00:06:47,166
并且只给终端和读文件这两个工具

171
00:06:47,300 --> 00:06:51,166
让模型先用极简模式的思维链进入状态

172
00:06:51,433 --> 00:06:53,766
等第一次工具调用完成之后

173
00:06:53,800 --> 00:06:56,633
再立刻把全部工具恢复回来

174
00:06:56,700 --> 00:06:58,133
跑分就上来了

175
00:06:58,300 --> 00:07:00,800
这大概也是为什么 DeepSeek Harness

176
00:07:01,000 --> 00:07:03,300
被称为 DeepSeek 的角色专武

177
00:07:03,500 --> 00:07:05,600
能让它发挥出更好的效果

178
00:07:06,100 --> 00:07:08,000
我觉得这个发现很有价值

179
00:07:08,133 --> 00:07:10,166
它揭示了一个更深的问题

180
00:07:10,366 --> 00:07:12,166
像 V4 Pro 这样的模型

181
00:07:12,300 --> 00:07:14,166
能力能不能被释放出来

182
00:07:14,200 --> 00:07:17,033
很大程度上取决于你给它的接口

183
00:07:17,033 --> 00:07:19,733
跟它训练时见过的那套像不像

184
00:07:20,100 --> 00:07:21,766
未来 Harness 的优化方向

185
00:07:21,766 --> 00:07:23,900
可能不是给 AI 更多工具

186
00:07:23,933 --> 00:07:25,300
或者砍掉工具

187
00:07:25,500 --> 00:07:29,333
而是搞清楚怎么在启动阶段对齐训练分布

188
00:07:29,733 --> 00:07:32,133
唤醒模型最强的执行状态

189
00:07:32,233 --> 00:07:34,533
然后再释放完整能力

190
00:07:34,933 --> 00:07:36,400
学会了 学废了

191
00:07:36,400 --> 00:07:38,433
感兴趣的同学可以试试看

192
00:07:39,233 --> 00:07:40,633
OK 就分享到这里

193
00:07:40,633 --> 00:07:41,900
本期视频的文字版

194
00:07:41,900 --> 00:07:45,200
会收录到我免费开源的 AI 编程零基础入门教程

195
00:07:45,300 --> 00:07:46,000
上千张图

196
00:07:46,000 --> 00:07:46,433
几十万字

197
00:07:46,433 --> 00:07:47,333
带你从 0 开始

198
00:07:47,333 --> 00:07:48,600
快速学会 AI 编程

199
00:07:48,600 --> 00:07:49,500
做出自己的产品

200
00:07:49,500 --> 00:07:50,700
跑通变现全流程

201
00:07:50,700 --> 00:07:51,500
一次拿捏

202
00:07:51,833 --> 00:07:54,233
我是持续分享 AI 编程干货的鱼皮

203
00:07:54,233 --> 00:07:55,400
欢迎点赞关注

204
00:07:55,400 --> 00:07:57,633
助力俺冲击百万哦 感谢
