WEBVTT
Kind: captions
Language: zh

00:00:00.000 --> 00:00:02.120
Hello 大家好，这里是王帅真

00:00:02.120 --> 00:00:06.920
今天这一期视频呢，想跟大家分享一下Hermes Agent 的模型配置问题

00:00:06.920 --> 00:00:13.600
在前面两期视频发布之后，就会有很多朋友在评论区私信里面来问我

00:00:13.600 --> 00:00:18.320
包括我身边也会有一些最近才开始用Hermes Agent 的朋友

00:00:18.320 --> 00:00:22.000
就会来问我说，那我安装完这Hermes Agent 之后

00:00:22.000 --> 00:00:24.920
然后呢，然后我们就要选模型了嘛

00:00:24.920 --> 00:00:27.800
就比方说我们来看一下官方的QuickStart

00:00:27.960 --> 00:00:30.080
它第一步，Install Hermes Agent

00:00:30.080 --> 00:00:34.080
完了之后呢，Choose a Provider，就我们要选一个模型的服务提供商

00:00:34.080 --> 00:00:39.360
OK，然后输入Hermes Model，你就会发现，哇靠，有这么多的模型对吧，一连串

00:00:39.360 --> 00:00:44.120
有他们官方的，然后有我们国内的模型，有国外的模型，哇，琳琅满目

00:00:44.120 --> 00:00:48.440
就你会有点迷失了，你会不知道要选什么

00:00:48.440 --> 00:00:51.280
你也不知道，比如说会有人问说，开销怎么样啊

00:00:51.280 --> 00:00:56.840
怎么样的比较好用啊，这一期视频呢，就是想给大家一套方案

00:00:56.960 --> 00:01:00.120
主要是针对于小白，或者说刚开始用的人

00:01:00.120 --> 00:01:05.040
希望大家能以一个较低的成本的方式，甚至是白嫖的方式

00:01:05.040 --> 00:01:08.520
先上车再说，我们先用起来，先看看好不好用嘛

00:01:08.520 --> 00:01:11.400
不要，一上来就有人会说，啊，你就得用GPT

00:01:11.400 --> 00:01:14.000
然后你还要开那个Pro，那肯定是不对的嘛

00:01:14.000 --> 00:01:16.200
你这个东西你都没有尝过啥滋味

00:01:16.200 --> 00:01:20.240
你开始就投这么大成本，去用其实是不太合理的

00:01:20.240 --> 00:01:24.320
包括有人会说，哎呀，你要用Gemini，你要用什么什么什么

00:01:24.400 --> 00:01:28.760
我们先从更实际的方向去考虑这个问题

00:01:28.760 --> 00:01:33.120
主要呢，就是我不太希望看到大家去花一些冤枉钱

00:01:33.120 --> 00:01:36.920
就本着这样一个初心，然后有了这期视频

00:01:36.920 --> 00:01:39.040
所以这个是一个比较新手向的

00:01:39.040 --> 00:01:42.960
OK，然后我先给出来我的方案的一个核心的公式

00:01:42.960 --> 00:01:46.680
其实就是主模型用DeepSeek 的 Flash

00:01:46.680 --> 00:01:48.040
V4 Flash

00:01:48.040 --> 00:01:51.440
然后再加上一个多模态的模型去进行一个补位

00:01:51.440 --> 00:01:54.400
比如说DeepSeek它其实是自己不能闭环的

00:01:54.400 --> 00:01:56.320
它只能生成一些文字

00:01:56.320 --> 00:01:59.400
虽然它有开源的多模态的论文

00:01:59.400 --> 00:02:03.360
但是目前就官方来说，确实没有多模态能力

00:02:03.360 --> 00:02:05.600
然后我们就需要有个多模态模型来补位

00:02:05.600 --> 00:02:08.440
那这个详细的呢，我们后面再来聊

00:02:08.440 --> 00:02:11.680
然后我们也可以利用各家云厂商给的一些免费额度

00:02:11.680 --> 00:02:13.600
就一些羊毛，先用起来

00:02:13.600 --> 00:02:17.560
反正先跑，我们觉得好用再说嘛，对不对

00:02:17.600 --> 00:02:22.120
那为什么我选择DeepSeek来做我们的主模型呢

00:02:22.120 --> 00:02:25.680
首先DeepSeek它是非常便宜的

00:02:25.680 --> 00:02:28.480
我们可以来看一下DeepSeek V4 Flash

00:02:28.480 --> 00:02:31.480
跟DeepSeek V4 Pro大概的一个价格

00:02:31.480 --> 00:02:35.480
我们直接来看下面的这个这块我们先不看缓存

00:02:35.480 --> 00:02:38.800
百万 TOKen 输入缓存未命中的情况

00:02:38.800 --> 00:02:42.280
一块钱100 万 TOKen 的输入

00:02:42.280 --> 00:02:46.280
相当于你可以塞一本《红楼梦》塞一本《三体》进去

00:02:46.280 --> 00:02:48.640
都是没问题的，就大概这么个长度

00:02:48.640 --> 00:02:52.000
然后你要说，那我来回对话，它上下文长了怎么办呢

00:02:52.000 --> 00:02:54.280
呃，这一部分就会走到它的缓存上面

00:02:54.280 --> 00:02:58.680
我们就可以看到DeepSeek它每百万 TOKen的缓存命中是

00:02:58.680 --> 00:03:01.760
两分钱，你未命中是一块钱

00:03:01.760 --> 00:03:05.000
那DeepSeek它的缓存命中率大概能有多少呢

00:03:05.000 --> 00:03:09.280
得益于他们V4的时候做了一个缓存策略的优化

00:03:09.280 --> 00:03:12.760
是一个大的进步，他们的命中率能达到90%

00:03:12.760 --> 00:03:14.760
当然是建立在你多了几轮上嘛

00:03:14.760 --> 00:03:17.600
就是你的命中率一般就能达到90%

00:03:17.600 --> 00:03:20.720
而且它的缓存能给你保留时间比较长

00:03:20.720 --> 00:03:24.640
所以你整个下来的成本其实是相对比较低的

00:03:24.640 --> 00:03:28.080
包括它百万输出也才两元

00:03:28.080 --> 00:03:31.240
你用到Pro 的话，大概贵三倍的程度吧

00:03:31.240 --> 00:03:34.080
其实这个是非常便宜的

00:03:34.080 --> 00:03:37.000
跟国外的GPT Claude差了几十倍

00:03:37.000 --> 00:03:38.520
我们后面会来看

00:03:38.520 --> 00:03:40.120
呃，那现在我先跟你说

00:03:40.120 --> 00:03:41.960
大概成本是差几十倍的

00:03:41.960 --> 00:03:44.400
我们来看一下它的缓存命中情况

00:03:44.400 --> 00:03:48.960
我的输入命中缓存的是1500 万 TOKen

00:03:48.960 --> 00:03:51.960
输入未命中缓存的是100 万都不到

00:03:51.960 --> 00:03:54.560
就发现它很多都走到缓存上面了其实

00:03:54.560 --> 00:03:57.160
然后输出的话也不到100 万

00:03:57.160 --> 00:03:58.920
就十几万的样子

00:03:58.920 --> 00:04:01.400
也就是说它大概呢

00:04:01.400 --> 00:04:06.320
也就是个16分之15走到了缓存上

00:04:06.320 --> 00:04:08.600
其实就是90%多了

00:04:08.600 --> 00:04:11.760
这个比例是非常非常高的

00:04:11.760 --> 00:04:14.640
那这一天的消耗大概是多少钱呢

00:04:14.640 --> 00:04:16.640
我们可以看到也就一块多

00:04:16.640 --> 00:04:18.240
你每一天这么用

00:04:18.240 --> 00:04:20.000
那可能你再用凶一点

00:04:20.000 --> 00:04:21.520
三块五块

00:04:21.520 --> 00:04:23.200
反正它不会贵的

00:04:23.200 --> 00:04:25.160
除非你真的像我评论区里面有个人

00:04:25.160 --> 00:04:26.560
他用的很凶啊

00:04:26.560 --> 00:04:29.640
疯狂调教往里面加了一堆上下文啊

00:04:29.640 --> 00:04:32.240
或者一些Hermes的东西

00:04:32.240 --> 00:04:34.680
那可能要一二十块钱

00:04:34.680 --> 00:04:35.960
如果你用的没那么凶

00:04:35.960 --> 00:04:36.840
你就是日常用

00:04:36.840 --> 00:04:39.280
那一天就是就是几块钱

00:04:39.320 --> 00:04:40.680
那像我这一天啊

00:04:40.680 --> 00:04:42.520
就是一块四毛七

00:04:42.520 --> 00:04:43.560
那你去充一个

00:04:43.560 --> 00:04:46.040
比如说什么Kimi的Plan

00:04:46.040 --> 00:04:47.600
一个月都两百块了

00:04:47.600 --> 00:04:48.880
而且这个还是按量付费

00:04:48.880 --> 00:04:51.520
因为我们不可能每天都用这么凶的

00:04:51.520 --> 00:04:53.760
这个需要大家自己实际用的时候去

00:04:53.760 --> 00:04:55.440
这个用量信息里面

00:04:55.440 --> 00:04:57.200
自己去点一点看一看

00:04:57.200 --> 00:04:58.400
那这个

00:04:58.400 --> 00:05:00.960
我们就先不过多做介绍了

00:05:00.960 --> 00:05:02.200
反正在这里呢

00:05:02.200 --> 00:05:04.640
就必须的给我们的梁胜良、文风

00:05:04.640 --> 00:05:06.720
风仙圣仙刻一个

00:05:06.720 --> 00:05:08.640
整活整活

00:05:08.640 --> 00:05:11.600
就我们能用上这么便宜的大模型

00:05:11.600 --> 00:05:13.800
效果还能做到不错

00:05:13.800 --> 00:05:14.920
真的感谢

00:05:14.920 --> 00:05:15.680
梁胜

00:05:15.680 --> 00:05:16.960
真是梁胜了

00:05:16.960 --> 00:05:17.240
OK

00:05:17.240 --> 00:05:19.040
那我们现在就来实操演示一下

00:05:19.040 --> 00:05:20.840
我们怎么先把这个主模型

00:05:20.840 --> 00:05:22.200
DeepSeek Flash

00:05:22.200 --> 00:05:23.480
先给配上去

00:05:23.480 --> 00:05:24.240
OK

00:05:24.240 --> 00:05:27.240
我们还是回到这个

00:05:27.240 --> 00:05:29.720
DeepSeek的这个官网这边

00:05:29.720 --> 00:05:31.360
就是deepseek.com

00:05:31.360 --> 00:05:33.480
你用的搜索已经都给进去

00:05:33.480 --> 00:05:33.960
OK

00:05:33.960 --> 00:05:36.080
我们不要点这开始对话

00:05:36.080 --> 00:05:38.240
点这个API开放平台

00:05:38.240 --> 00:05:38.760
OK

00:05:38.760 --> 00:05:40.400
点进来之后会看到我们前面

00:05:40.400 --> 00:05:42.520
看到这个用量信息界面

00:05:42.520 --> 00:05:43.480
这个时候呢

00:05:43.480 --> 00:05:45.720
我们去点API Keys

00:05:45.720 --> 00:05:48.040
那我这边就已经有一些

00:05:48.040 --> 00:05:50.080
创建好的了

00:05:50.080 --> 00:05:50.920
这边已经有了

00:05:50.920 --> 00:05:51.600
那我没事

00:05:51.600 --> 00:05:52.600
我给他删掉

00:05:52.600 --> 00:05:54.600
然后我们现在重新来一遍

00:05:54.600 --> 00:05:55.520
我带大家来一遍

00:05:55.520 --> 00:05:58.600
我们先命名好我们的API Key

00:05:58.600 --> 00:06:00.040
比如说我们这边是Hermes要用

00:06:00.040 --> 00:06:01.480
那我们就给他一个Hermes

00:06:01.480 --> 00:06:01.960
OK

00:06:01.960 --> 00:06:03.080
我们去创建

00:06:03.080 --> 00:06:03.400
OK

00:06:03.400 --> 00:06:05.520
然后创建好了之后呢

00:06:05.520 --> 00:06:07.360
我们就点击这个复制

00:06:07.400 --> 00:06:10.480
为了避免我们等我可能会配错

00:06:10.480 --> 00:06:13.000
这个页面可以先不要关

00:06:13.000 --> 00:06:14.160
我们就放着

00:06:14.160 --> 00:06:14.680
OK

00:06:14.680 --> 00:06:17.360
我们进入到终端界面

00:06:17.360 --> 00:06:19.520
我们就输入前面

00:06:19.520 --> 00:06:21.440
那边这官网说的嘛

00:06:21.440 --> 00:06:23.040
Hermes Model是吧

00:06:23.040 --> 00:06:24.160
Hermes Model

00:06:24.160 --> 00:06:24.400
OK

00:06:24.400 --> 00:06:26.440
我只跟大家确认一下

00:06:26.440 --> 00:06:26.880
OK

00:06:26.880 --> 00:06:29.720
我们输入Hermes Model

00:06:29.720 --> 00:06:32.440
看到琳琅满目的模型对吧

00:06:32.440 --> 00:06:34.440
无论是你在Hermes Model里面去配

00:06:34.440 --> 00:06:36.080
还是你Hermes的setup

00:06:36.080 --> 00:06:37.800
就你第一次装那个

00:06:37.800 --> 00:06:39.680
一样你都会到这个界面来

00:06:39.680 --> 00:06:39.960
OK

00:06:39.960 --> 00:06:42.160
然后我们就找到这个DeepSeek

00:06:42.160 --> 00:06:42.800
v3

00:06:42.800 --> 00:06:44.680
recode的这个什么

00:06:44.680 --> 00:06:46.520
直联API这边就这个

00:06:46.520 --> 00:06:46.880
OK

00:06:46.880 --> 00:06:49.600
然后我们敲击一下回车进来

00:06:49.600 --> 00:06:50.400
然后他会说

00:06:50.400 --> 00:06:53.440
No DeepSeek API Key configured

00:06:53.440 --> 00:06:54.720
那我这边就要去输入

00:06:54.720 --> 00:06:56.560
我的一个DeepSeek API Key

00:06:56.560 --> 00:06:58.680
然后这边我选择一下复制

00:06:58.680 --> 00:06:59.120
OK

00:06:59.120 --> 00:07:01.920
然后我就把我的这个东西给贴进来了

00:07:01.920 --> 00:07:02.840
回车

00:07:02.840 --> 00:07:03.760
然后就save 了

00:07:03.760 --> 00:07:04.600
他就跟你说

00:07:04.680 --> 00:07:06.000
你的Base URL 是什么

00:07:06.000 --> 00:07:07.160
就是你的主域名

00:07:07.160 --> 00:07:08.960
当然这个就是直接就是官网的了

00:07:08.960 --> 00:07:10.360
大家可以不用再去改了

00:07:10.360 --> 00:07:11.520
直接敲回车

00:07:11.520 --> 00:07:12.120
好

00:07:12.120 --> 00:07:12.680
那完了之后

00:07:12.680 --> 00:07:14.280
然后我悬问那个主要模型

00:07:14.280 --> 00:07:16.640
那默认就会选择最新的v4 Flash

00:07:16.640 --> 00:07:17.320
这个时候啊

00:07:17.320 --> 00:07:18.200
就可以了

00:07:18.200 --> 00:07:19.040
回车

00:07:19.040 --> 00:07:19.560
OK

00:07:19.560 --> 00:07:20.400
然后这个时候

00:07:20.400 --> 00:07:22.400
Default Model set to

00:07:22.400 --> 00:07:23.880
DeepSeek V4 Flash

00:07:23.880 --> 00:07:25.120
via DeepSeek

00:07:25.120 --> 00:07:26.120
这个时候我们已经成功

00:07:26.120 --> 00:07:27.760
切换到DeepSeek上面来了

00:07:27.760 --> 00:07:28.200
没错

00:07:28.200 --> 00:07:29.160
就这个过程呢

00:07:29.160 --> 00:07:30.480
就是这么快啊

00:07:30.480 --> 00:07:33.520
然后我们来做一个测试

00:07:33.560 --> 00:07:35.280
我们起个新会话啊

00:07:35.280 --> 00:07:36.280
其实我们已经看到

00:07:36.280 --> 00:07:37.320
可以看到了

00:07:37.320 --> 00:07:38.640
他能起会话成功

00:07:38.640 --> 00:07:41.240
他Model 已经是DeepSeek V4 Flash了

00:07:41.240 --> 00:07:42.480
那Provider 是DeepSeek

00:07:42.480 --> 00:07:43.280
然后Context

00:07:43.280 --> 00:07:44.720
可以看到他就是一个

00:07:44.720 --> 00:07:46.240
100 万 TOKen

00:07:46.240 --> 00:07:48.240
那我们可以跟他问个好

00:07:48.240 --> 00:07:48.760
你好

00:07:48.760 --> 00:07:51.960
你用的是什么模型

00:07:51.960 --> 00:07:52.680
OK

00:07:52.680 --> 00:07:53.520
我们来测试一下

00:07:53.520 --> 00:07:54.680
成不成功吗

00:07:54.680 --> 00:07:54.960
OK

00:07:54.960 --> 00:07:57.000
然后你可以看到他正常的

00:07:57.000 --> 00:07:57.600
回复你了

00:07:57.600 --> 00:08:00.040
那这个就是我们已经配置上了

00:08:00.040 --> 00:08:02.800
那这个时候就会有个问题

00:08:02.800 --> 00:08:05.320
那我们在对话里面去沟通的时候

00:08:05.320 --> 00:08:06.960
无论是我们在FaceboOK上面用啊

00:08:06.960 --> 00:08:08.040
在微信上面用啊

00:08:08.040 --> 00:08:08.720
还是什么

00:08:08.720 --> 00:08:10.280
我们有时候其实是会

00:08:10.280 --> 00:08:12.680
想要带一些图片上去问他嘛

00:08:12.680 --> 00:08:12.960
对吧

00:08:12.960 --> 00:08:15.880
我们会想要去跟他有一些

00:08:15.880 --> 00:08:16.720
比如说

00:08:16.720 --> 00:08:17.680
我拍一下

00:08:17.680 --> 00:08:19.480
我的哪里的一个什么照片啊

00:08:19.480 --> 00:08:21.960
然后问他这个啥情况嘛

00:08:21.960 --> 00:08:23.760
这都是很有可能的

00:08:23.760 --> 00:08:24.480
就比如我昨天

00:08:24.480 --> 00:08:27.040
我给我的房间拍了一个照片

00:08:27.040 --> 00:08:28.360
然后问他说

00:08:28.360 --> 00:08:30.160
我怎么整理比较好

00:08:30.160 --> 00:08:31.680
那现在可能有点乱

00:08:31.680 --> 00:08:33.480
对那这个时候他可能就

00:08:33.480 --> 00:08:34.520
你用DeepSeek的话

00:08:34.520 --> 00:08:36.640
他没有办法去做识别

00:08:36.640 --> 00:08:38.680
给大家示范一下

00:08:38.680 --> 00:08:40.280
比方说这个时候

00:08:40.280 --> 00:08:43.840
我去做一个截图来演示一下

00:08:43.840 --> 00:08:44.360
OK

00:08:44.360 --> 00:08:45.280
那我说

00:08:45.280 --> 00:08:49.960
你能看得见这张图片吗

00:08:49.960 --> 00:08:51.120
我可以直接跟大家说

00:08:51.120 --> 00:08:52.160
就这个DeepSeek

00:08:52.160 --> 00:08:53.720
他就不是多模态模型

00:08:53.720 --> 00:08:55.280
所以他是看不到的

00:08:55.280 --> 00:08:56.960
你看他就说看不见

00:08:56.960 --> 00:08:59.000
当前这个实例没有配置

00:08:59.000 --> 00:09:00.520
图像识别能力

00:09:00.520 --> 00:09:03.680
你需要先配置一个Vision Model Provider

00:09:03.680 --> 00:09:04.800
就可以看到这个时候

00:09:04.800 --> 00:09:07.240
他其实是没有这样的一个能力的

00:09:07.240 --> 00:09:09.200
DeepSeek是没有多模态的

00:09:09.200 --> 00:09:10.320
就包括我用官网

00:09:10.320 --> 00:09:11.280
你可以自己去试试

00:09:11.280 --> 00:09:12.520
你去官网给他发一个

00:09:12.520 --> 00:09:13.720
没有文字的图片

00:09:13.720 --> 00:09:16.040
你可能以前以前发可以

00:09:16.040 --> 00:09:16.960
但是你会发现

00:09:16.960 --> 00:09:19.640
他其实接的是一个OCR 的服务

00:09:19.640 --> 00:09:21.760
如果你的图片一旦没有文字

00:09:21.760 --> 00:09:22.640
他会直接说

00:09:22.640 --> 00:09:24.360
未提取到文字

00:09:24.360 --> 00:09:25.400
你们可以试试

00:09:25.400 --> 00:09:28.200
但是主播今天剪视频的时候

00:09:28.200 --> 00:09:29.960
发现DeepSeek官网

00:09:29.960 --> 00:09:32.120
已经在灰度识图模式了

00:09:32.120 --> 00:09:34.280
多模态不远了兄弟们

00:09:34.280 --> 00:09:37.040
但API 什么时候来还不知道

00:09:37.040 --> 00:09:39.640
所以仍然想和大家分享

00:09:39.640 --> 00:09:41.240
多模态的方案

00:09:41.240 --> 00:09:43.280
所以我们的解决方案呢

00:09:43.280 --> 00:09:44.040
就是说

00:09:44.040 --> 00:09:46.720
我们要在DeepSeek Flash的基础上

00:09:46.720 --> 00:09:47.920
我们再去配置一个

00:09:47.920 --> 00:09:49.960
可以支撑他图片理解

00:09:49.960 --> 00:09:52.480
能力的一个多模态的模型

00:09:52.480 --> 00:09:54.520
就我们主要还用DeepSeek

00:09:54.520 --> 00:09:56.720
但是我们就图片

00:09:56.720 --> 00:09:58.920
Vision Analyze这个部分

00:09:58.920 --> 00:10:00.920
接入一个多模态的模型

00:10:00.920 --> 00:10:02.360
到这一步要说明一下

00:10:02.360 --> 00:10:04.120
我没有接任何广告

00:10:04.120 --> 00:10:07.040
我将会用百炼里面的千问

00:10:07.040 --> 00:10:08.360
就阿里的千问来演示

00:10:08.360 --> 00:10:10.400
但是千问没有给我任何广告费

00:10:10.400 --> 00:10:12.720
就这个思路是通的

00:10:12.720 --> 00:10:13.960
你去用百炼

00:10:13.960 --> 00:10:15.200
你去用腾讯的混元

00:10:15.200 --> 00:10:17.640
你去用字节的豆包

00:10:17.640 --> 00:10:18.520
都一样

00:10:18.520 --> 00:10:20.360
并且他们都有羊毛可以好

00:10:20.360 --> 00:10:21.560
都有免费额度

00:10:21.560 --> 00:10:23.040
没关系随便用

00:10:23.040 --> 00:10:23.520
OK

00:10:23.520 --> 00:10:26.640
我们进入到百炼大模型的这个界面

00:10:26.640 --> 00:10:28.480
我这边选的是一个视觉模型

00:10:28.480 --> 00:10:30.200
我先给大家看一下

00:10:30.200 --> 00:10:32.400
就是你可以在这里面去找

00:10:32.400 --> 00:10:34.200
它有视觉能力的一些模型

00:10:34.200 --> 00:10:36.000
那最基础的比较

00:10:36.000 --> 00:10:38.200
最新可能有到千问3.7什么

00:10:38.200 --> 00:10:38.400
什么

00:10:38.400 --> 00:10:39.360
我们用不到这么好

00:10:39.360 --> 00:10:40.160
不需要

00:10:40.160 --> 00:10:41.840
我们可以直接

00:10:41.840 --> 00:10:43.600
选个千问 3.6-Flash

00:10:43.600 --> 00:10:45.280
我们就以这个来演示吧

00:10:45.280 --> 00:10:49.440
你要是想成本更低一点的用千问 3.5-Flash

00:10:49.440 --> 00:10:51.480
而且我们可以先不考虑成本问题

00:10:51.480 --> 00:10:53.720
因为它这些东西都有免费额度

00:10:53.720 --> 00:10:54.960
这个东西呢

00:10:54.960 --> 00:10:57.200
我们可以一样把这个东西复制过来

00:10:57.240 --> 00:10:58.400
我们就把图片贴过来

00:10:58.400 --> 00:10:59.320
那我们呢

00:10:59.320 --> 00:10:59.920
嗯

00:10:59.920 --> 00:11:01.120
你能看见这样图片吗

00:11:01.120 --> 00:11:03.480
我们可以试一下它的一个图片理解能力

00:11:03.480 --> 00:11:03.840
你看

00:11:03.840 --> 00:11:05.520
它马上就能夸夸夸

00:11:05.520 --> 00:11:06.720
然后都看到了

00:11:06.720 --> 00:11:07.600
都识别出来

00:11:07.600 --> 00:11:10.280
我看我验证了它的一个图片能力之后呢

00:11:10.280 --> 00:11:12.920
我们选择下面的这个用量

00:11:12.920 --> 00:11:14.440
N费用

00:11:14.440 --> 00:11:15.200
我们点一下之后

00:11:15.200 --> 00:11:17.120
可以看到它有个免费额度

00:11:17.120 --> 00:11:18.560
你用方舟

00:11:18.560 --> 00:11:19.400
一样的

00:11:19.400 --> 00:11:21.280
比如说我们进到方舟里面来

00:11:21.280 --> 00:11:23.400
也基本都有免费推理额度

00:11:23.400 --> 00:11:24.880
你去用豆包

00:11:24.880 --> 00:11:25.480
你去用

00:11:25.480 --> 00:11:27.120
甚至它DeepSeek Flash

00:11:27.120 --> 00:11:29.200
你看这个也给你提供了免费额度

00:11:29.200 --> 00:11:30.960
就这些东西你都可以去配

00:11:30.960 --> 00:11:33.240
反正这种送你个50 万100 万的

00:11:33.240 --> 00:11:33.920
就随便好

00:11:33.920 --> 00:11:35.280
像阿里这些都给100 万

00:11:35.280 --> 00:11:36.680
然后字节那边给50 万

00:11:36.680 --> 00:11:38.680
我们作为个人用户随便去好

00:11:38.680 --> 00:11:41.920
然后阿里可以看到它也有DeepSeek-VL Flash

00:11:41.920 --> 00:11:44.640
就是如果你想先用起来

00:11:44.640 --> 00:11:46.400
你就你就用这个就可以了

00:11:46.400 --> 00:11:49.040
当然那就不是我前面的那套配置方式了

00:11:49.040 --> 00:11:50.160
那新的配置方式呢

00:11:50.160 --> 00:11:51.520
我们现在来讲

00:11:51.520 --> 00:11:54.520
呃我们因为我用的是千问 3.6-Flash

00:11:54.560 --> 00:11:56.400
我们数一下3.6

00:11:56.400 --> 00:11:57.200
然后输

00:11:57.200 --> 00:11:57.960
OK

00:11:57.960 --> 00:12:01.400
呃我们来选择这个千问 3.6-Flash

00:12:01.400 --> 00:12:03.800
我们将会用的是这一个东西

00:12:03.800 --> 00:12:05.520
可以看到我已经用了一部分了

00:12:05.520 --> 00:12:07.760
如果你呃比较谨慎的话

00:12:07.760 --> 00:12:08.920
你怕多花一分钱

00:12:08.920 --> 00:12:10.000
你一分钱不想花啊

00:12:10.000 --> 00:12:12.200
你就点这个免费额度用完即停

00:12:12.200 --> 00:12:13.400
当你这个用完了之后呢

00:12:13.400 --> 00:12:15.480
你再去好别的模型

00:12:15.480 --> 00:12:16.760
到时候你再自己去换嘛

00:12:16.760 --> 00:12:20.040
反正这个都是很好很好都替换的

00:12:20.040 --> 00:12:22.680
OK 那我们接下来要做的是什么呢

00:12:22.680 --> 00:12:25.120
我们知道了要选择那个模型然后呢

00:12:25.120 --> 00:12:26.200
呃刚才看一个额度

00:12:26.200 --> 00:12:28.160
我们点这个 API Keys

00:12:28.160 --> 00:12:29.480
下面的这 API Keys

00:12:29.480 --> 00:12:31.880
在用量的下面两个格子呃

00:12:31.880 --> 00:12:33.640
然后在这边一样

00:12:33.640 --> 00:12:36.240
我们可以去创建 API Key啊

00:12:36.240 --> 00:12:38.120
一样我把这个东西给删了

00:12:38.120 --> 00:12:39.560
我们重来一遍

00:12:39.560 --> 00:12:40.880
权限就默认全部

00:12:40.880 --> 00:12:41.960
然后描述一样

00:12:41.960 --> 00:12:42.880
我们写个 Hermes

00:12:42.880 --> 00:12:43.280
确定

00:12:43.280 --> 00:12:44.040
然后也是一样

00:12:44.040 --> 00:12:45.160
停在这个页面

00:12:45.160 --> 00:12:46.840
然后我们点一个复制

00:12:46.840 --> 00:12:47.520
暂时到这里

00:12:47.520 --> 00:12:49.000
我们先先放着

00:12:49.000 --> 00:12:50.080
没关系呃

00:12:50.080 --> 00:12:53.040
我们再跳到这个 Hermes Agent

00:12:53.040 --> 00:12:55.800
在阿里云上面的一个文档

00:12:55.800 --> 00:12:58.400
找到这个接入客户端开发工具

00:12:58.400 --> 00:12:59.560
然后Hermes Agent这个

00:12:59.560 --> 00:13:01.640
但这个文档到时候会贴给大家

00:13:01.640 --> 00:13:03.280
我们直接选到这个

00:13:03.280 --> 00:13:04.920
按量计费这一块这边来

00:13:04.920 --> 00:13:07.240
因为我们是走的 API，API

00:13:07.240 --> 00:13:09.480
就是用多少付多少钱嘛

00:13:09.480 --> 00:13:12.040
然后我们刚刚不是已经

00:13:12.040 --> 00:13:14.120
有了 key 的那一部分吗

00:13:14.120 --> 00:13:16.160
我们可以根据这个

00:13:16.160 --> 00:13:18.360
Hermes config 来

00:13:18.360 --> 00:13:21.080
当然我们也可以不这么来

00:13:21.080 --> 00:13:22.440
因为我们已经接了

00:13:22.440 --> 00:13:23.680
DeepSeek Flash 了嘛

00:13:23.680 --> 00:13:23.920
对吧

00:13:23.920 --> 00:13:25.360
那我们就直接让DeepSeek

00:13:25.360 --> 00:13:26.520
那个 Hermes Agent

00:13:26.520 --> 00:13:28.080
帮我们配就可以了

00:13:28.080 --> 00:13:29.720
那我们就大概把这一段话

00:13:29.720 --> 00:13:30.280
发给他

00:13:30.280 --> 00:13:31.200
然后让他来配

00:13:31.200 --> 00:13:32.760
那配是会配在哪呢

00:13:32.760 --> 00:13:33.720
我们进到

00:13:33.720 --> 00:13:35.880
Hermes Agent 的 Dashboard 里面来

00:13:35.880 --> 00:13:37.040
我们去看

00:13:37.040 --> 00:13:38.080
我们这个 Main Model

00:13:38.080 --> 00:13:39.040
已经是DeepSeek了

00:13:39.040 --> 00:13:41.120
然后我们要去配他的一个

00:13:41.120 --> 00:13:42.280
呃 任务模型

00:13:42.280 --> 00:13:43.680
相对应的任务模型

00:13:43.680 --> 00:13:44.440
OK 我可以看到

00:13:44.440 --> 00:13:46.000
他默认的会全部都是 Auto

00:13:46.000 --> 00:13:47.160
就你主模型用哪个

00:13:47.160 --> 00:13:48.200
就是哪个

00:13:48.200 --> 00:13:50.600
那我们要配的其实就是这个 vision

00:13:50.600 --> 00:13:52.040
但是我们这边还没配上

00:13:52.040 --> 00:13:54.840
我们会以 Custom 的方式来配

00:13:54.840 --> 00:13:56.760
我们会 Custom 的方式来配

00:13:56.760 --> 00:13:57.640
可以看一下他这个

00:13:57.640 --> 00:13:59.720
config 一个典型的配置示例

00:13:59.720 --> 00:14:00.880
就最终配完

00:14:00.880 --> 00:14:02.560
大概是一个长这样的东西

00:14:02.560 --> 00:14:04.520
呃 那我们就复制复制复制

00:14:04.520 --> 00:14:05.640
全部都复制

00:14:05.640 --> 00:14:07.720
帮我配一下

00:14:07.720 --> 00:14:11.760
vision 的模型 key 是

00:14:11.760 --> 00:14:12.640
就这样就可以了

00:14:12.640 --> 00:14:14.280
你就像我这样说就行了

00:14:14.280 --> 00:14:16.240
前面那段话全部复制下来

00:14:16.240 --> 00:14:17.720
帮我配置一下什么什么

00:14:17.720 --> 00:14:18.880
key 是什么什么什么

00:14:18.880 --> 00:14:20.080
OK 发送

00:14:20.080 --> 00:14:21.680
就可以了

00:14:21.680 --> 00:14:24.680
呃 我们能发现他配的

00:14:24.680 --> 00:14:26.240
好像有一点翻车

00:14:26.240 --> 00:14:27.760
不太对不太对

00:14:27.760 --> 00:14:28.520
没事

00:14:28.520 --> 00:14:31.120
我们主打一个展示容错率

00:14:31.120 --> 00:14:33.040
一 你要

00:14:33.040 --> 00:14:34.320
我前面说的不完整啊

00:14:34.320 --> 00:14:38.680
你要用 Custom 的方式去配置

00:14:38.680 --> 00:14:39.680
参考啊

00:14:39.680 --> 00:14:42.680
其实这段也是他那个弄下来的嘛

00:14:42.680 --> 00:14:43.320
对吧

00:14:43.320 --> 00:14:46.520
然后模型是用

00:14:46.520 --> 00:14:49.480
千问三三点六

00:14:49.480 --> 00:14:51.680
-Flash

00:14:51.680 --> 00:14:53.760
啊 就说明他前面这个东西配错了

00:14:53.760 --> 00:14:55.800
怎么能配到 VL Plus

00:14:55.800 --> 00:14:57.840
vl 他其实是一个完整的

00:14:57.840 --> 00:14:59.320
呃 视觉模型

00:14:59.320 --> 00:15:01.040
就他除了理解

00:15:01.040 --> 00:15:02.960
我记得应该是还能生图的

00:15:02.960 --> 00:15:05.040
就如果大家有生图的那种需求

00:15:05.040 --> 00:15:08.600
然后再去另外找其他的模型

00:15:08.600 --> 00:15:11.240
啊 就可以看到他现在就开始夸夸夸一桶配了

00:15:11.240 --> 00:15:13.480
/reset 之后

00:15:13.480 --> 00:15:15.560
OK 那现在应该是好了

00:15:15.560 --> 00:15:18.360
我们先来这个看板这边看一眼吧

00:15:18.360 --> 00:15:21.400
OK 我们可以看到他这边应该是已经有了啊

00:15:21.400 --> 00:15:22.200
你看

00:15:22.200 --> 00:15:24.320
Vision Custom 千问3.6

00:15:24.320 --> 00:15:25.440
-Flash

00:15:25.440 --> 00:15:28.280
呃 那我们现在回来啊

00:15:28.280 --> 00:15:29.400
就说明他这边OK的嘛

00:15:29.400 --> 00:15:30.680
那我就/new

00:15:30.680 --> 00:15:32.520
那我们现在来把那个

00:15:32.520 --> 00:15:34.640
消息重新再来试一遍

00:15:34.640 --> 00:15:36.440
OK 一样的内容

00:15:36.440 --> 00:15:37.400
问他

00:15:37.400 --> 00:15:38.880
能不能看见这张图片

00:15:38.880 --> 00:15:40.040
OK 我问一下

00:15:40.040 --> 00:15:40.480
嗯

00:15:40.480 --> 00:15:43.280
然后就能发现他这个时候就读得出来了

00:15:43.280 --> 00:15:43.600
对吧

00:15:43.600 --> 00:15:45.360
就我们这边是一个步骤

00:15:45.360 --> 00:15:45.840
然后什么

00:15:45.840 --> 00:15:47.120
这是配置和默认模型

00:15:47.120 --> 00:15:48.800
为DeepSeek Flash 的步骤

00:15:48.800 --> 00:15:49.640
等等

00:15:49.640 --> 00:15:50.480
然后还反过来

00:15:50.480 --> 00:15:52.960
我说你是想让我帮你完成这些配置吗

00:15:52.960 --> 00:15:54.200
还是呃

00:15:54.200 --> 00:15:55.680
只是确认我能看到这个图片

00:15:56.680 --> 00:15:57.880
OK 就到这一步

00:15:57.880 --> 00:16:00.920
我们已经把那个图片的也配完了

00:16:00.920 --> 00:16:01.200
呃

00:16:01.200 --> 00:16:04.400
然后确实我们这个流程也走完了

00:16:04.400 --> 00:16:05.680
当然这个是

00:16:05.680 --> 00:16:07.440
Hermes Agent

00:16:07.440 --> 00:16:09.800
在百链上面的一个配置

00:16:09.800 --> 00:16:11.360
如果你去用呃

00:16:11.360 --> 00:16:13.280
腾讯的混元或者字节

00:16:13.280 --> 00:16:14.680
火山方舟

00:16:14.680 --> 00:16:17.280
理论上他们你也能找到他们的那个

00:16:17.280 --> 00:16:19.760
呃文档甚至说你自己都不要去找

00:16:19.760 --> 00:16:22.200
你直接让你的Hermes Agent

00:16:22.200 --> 00:16:24.640
自己去找文档来配

00:16:24.640 --> 00:16:27.520
因为他本身就自带呃Web 搜索

00:16:27.520 --> 00:16:29.200
Web 解析的能力没关系

00:16:29.200 --> 00:16:30.360
让他自己去找

00:16:30.360 --> 00:16:31.880
这都没有关系

00:16:31.880 --> 00:16:34.920
总之就是我们把这个多模态的能力

00:16:34.920 --> 00:16:36.280
哎给接上

00:16:36.280 --> 00:16:39.360
那我们这样的一个使用就很丝滑了嘛

00:16:39.400 --> 00:16:40.360
那你可能会说

00:16:40.360 --> 00:16:42.120
哎那他这个东西

00:16:42.120 --> 00:16:43.880
好像就是一个

00:16:43.880 --> 00:16:44.440
你会怀疑说

00:16:44.440 --> 00:16:45.640
哎那他是不是也是OCR

00:16:45.640 --> 00:16:47.040
我们来实验一下

00:16:47.040 --> 00:16:49.480
OK 我这边拍一个照片

00:16:49.480 --> 00:16:51.240
我们可以看到我拍了一张照片

00:16:51.240 --> 00:16:52.560
然后看到能不能解析出来

00:16:52.560 --> 00:16:54.600
就这这应该是没有文字了吧

00:16:54.600 --> 00:16:55.560
你不能说没文字

00:16:55.560 --> 00:16:58.440
但是这确实没什么文字啊

00:16:58.440 --> 00:17:00.080
他基本上就是一个物体

00:17:00.080 --> 00:17:01.280
这个可能不太好

00:17:01.280 --> 00:17:03.920
我刚刚应该找一个完全没文字的

00:17:03.920 --> 00:17:05.480
OK 你看他可以看出来

00:17:05.480 --> 00:17:07.240
看到了机械键盘

00:17:07.240 --> 00:17:10.640
加垂直鼠标的桌面setup

00:17:10.640 --> 00:17:12.800
然后可以看出来这个什么

00:17:12.800 --> 00:17:14.800
他他他倒是这个这个词别说

00:17:14.800 --> 00:17:16.600
这颗字是KJZi

00:17:16.600 --> 00:17:18.040
但大体

00:17:18.040 --> 00:17:20.280
其实大部分都能看得出来了

00:17:20.280 --> 00:17:22.800
那整个整个完整的闭环就是这样

00:17:22.800 --> 00:17:24.360
那这套方案呢

00:17:24.360 --> 00:17:26.000
大概要花多少钱

00:17:26.000 --> 00:17:27.400
我们可以试一下

00:17:27.400 --> 00:17:29.400
就就就这一轮

00:17:29.400 --> 00:17:31.920
会话来说啊

00:17:31.920 --> 00:17:32.960
我们可以这样

00:17:32.960 --> 00:17:34.760
/usage

00:17:34.760 --> 00:17:35.800
我们会发现啊

00:17:35.800 --> 00:17:38.120
其实很多都走到缓存上了

00:17:38.120 --> 00:17:39.320
然后输出的TOKen

00:17:39.320 --> 00:17:41.800
好啊也也没多少

00:17:41.800 --> 00:17:43.680
就我们可以用/usage

00:17:43.680 --> 00:17:46.240
去看你的使用情况

00:17:46.240 --> 00:17:47.560
单轮对话

00:17:47.560 --> 00:17:49.320
你要这么算的话

00:17:49.320 --> 00:17:52.160
比方说我就就就就拿这个来看吧

00:17:52.160 --> 00:17:53.760
56064

00:17:53.760 --> 00:17:54.880
这样吧这样吧

00:17:54.880 --> 00:17:55.680
OK

00:17:55.680 --> 00:17:57.080
然后我们这样一下

00:17:57.080 --> 00:17:59.080
56064

00:17:59.080 --> 00:18:02.960
当然这是单位要改成0.0

00:18:02.960 --> 00:18:04.920
因为你是你的单位是

00:18:04.960 --> 00:18:06.200
百万 TOKen嘛

00:18:06.200 --> 00:18:07.480
然后呃

00:18:07.480 --> 00:18:09.880
乘以0.02

00:18:09.880 --> 00:18:13.520
啊加上没有cache 的1388

00:18:13.520 --> 00:18:18.200
但是你得往前一0.0013啊

00:18:18.200 --> 00:18:21.960
乘以1加上401

00:18:21.960 --> 00:18:23.200
乘以2

00:18:23.200 --> 00:18:26.840
但是这前面要0.0000啊

00:18:26.840 --> 00:18:28.200
这才多少钱啊

00:18:28.200 --> 00:18:29.520
一分钱都不到对吧

00:18:29.520 --> 00:18:31.280
你这么聊完一分钱都不到

00:18:31.280 --> 00:18:32.440
但你平时用的话

00:18:32.440 --> 00:18:33.800
肯定是更频繁的

00:18:33.800 --> 00:18:34.880
那我这边都可以

00:18:34.880 --> 00:18:36.600
你那那那我估凶一点吧

00:18:36.600 --> 00:18:38.080
0.004好了

00:18:38.080 --> 00:18:39.920
然后你图片识别的话

00:18:39.920 --> 00:18:42.280
这样我们直接在这里面去问

00:18:42.280 --> 00:18:44.680
千问3.6

00:18:44.680 --> 00:18:47.200
Flash的价格

00:18:47.200 --> 00:18:48.520
怎么样

00:18:48.520 --> 00:18:50.240
一张图片

00:18:50.240 --> 00:18:53.320
我们精确点一张两照的图片

00:18:53.320 --> 00:18:55.480
大概要多少

00:18:55.480 --> 00:18:57.360
TOKen

00:18:57.360 --> 00:19:00.200
帮我算一下成本

00:19:00.200 --> 00:19:02.240
现在云平台都有

00:19:02.240 --> 00:19:03.520
都有这种啊

00:19:03.520 --> 00:19:05.280
哎呀我们反正就

00:19:05.280 --> 00:19:06.520
灵活运用嘛

00:19:06.520 --> 00:19:08.920
啊他这个有点蠢了

00:19:08.920 --> 00:19:10.760
OK你3.6-Flash 的话

00:19:10.760 --> 00:19:13.000
如果是1.44元

00:19:13.000 --> 00:19:14.240
没百万的话

00:19:14.240 --> 00:19:16.120
我可以直接给大家一个经验值

00:19:16.120 --> 00:19:18.400
基本上你一张图片就是

00:19:18.400 --> 00:19:20.120
呃可能是1000多

00:19:20.120 --> 00:19:21.440
也可能是2000多

00:19:21.440 --> 00:19:22.840
3000多4000多5000多

00:19:22.840 --> 00:19:23.480
都有可能

00:19:23.480 --> 00:19:25.960
我们假设我们一张就按3000

00:19:25.960 --> 00:19:27.120
TOKen 来算

00:19:27.120 --> 00:19:28.480
1.44元100 万

00:19:28.480 --> 00:19:29.840
那我们算一下

00:19:29.840 --> 00:19:30.680
100 万的话

00:19:30.680 --> 00:19:33.920
100 万除以3000

00:19:33.920 --> 00:19:36.440
也就是说我们1.44元

00:19:36.440 --> 00:19:38.920
可以用到这么多图片

00:19:38.920 --> 00:19:40.520
那一张图片多少钱呢

00:19:40.520 --> 00:19:46.120
1.44除以333333

00:19:46.120 --> 00:19:48.480
OK相当于一个图片

00:19:48.480 --> 00:19:50.520
就是呃0.004

00:19:50.520 --> 00:19:51.760
那我们啊

00:19:51.760 --> 00:19:53.640
好像这个也是0.004

00:19:53.640 --> 00:19:54.160
OK

00:19:54.160 --> 00:19:55.640
那我们一轮下来

00:19:55.640 --> 00:19:56.840
一分钱都不到

00:19:56.840 --> 00:19:57.960
往上加嘛

00:19:58.000 --> 00:19:58.920
10轮对话

00:19:58.920 --> 00:20:00.000
8分钱

00:20:00.000 --> 00:20:01.320
啊就是带图的

00:20:01.320 --> 00:20:03.280
还在往上加加加加加加

00:20:03.280 --> 00:20:04.280
20轮

00:20:04.280 --> 00:20:05.240
1.6

00:20:05.240 --> 00:20:06.240
那200轮

00:20:06.240 --> 00:20:07.120
1.6

00:20:07.120 --> 00:20:07.960
大概就

00:20:07.960 --> 00:20:08.640
就这样嘛

00:20:08.640 --> 00:20:11.160
当然你们可能涉及一些缓存的计算

00:20:11.160 --> 00:20:12.000
就是文本对话

00:20:12.000 --> 00:20:13.240
这边有一些cache

00:20:13.240 --> 00:20:14.320
那我们再订算了

00:20:14.320 --> 00:20:16.280
更何况这个图片识别

00:20:16.280 --> 00:20:19.320
你可以不停的去耗羊毛

00:20:19.320 --> 00:20:20.560
刚不是给你看了嘛

00:20:20.560 --> 00:20:21.880
这个大模型

00:20:21.880 --> 00:20:22.680
你就回

00:20:22.680 --> 00:20:24.200
你看免费额度这么多

00:20:24.200 --> 00:20:25.680
你回去那边视觉模型

00:20:25.680 --> 00:20:27.600
这边找哪些支持

00:20:27.640 --> 00:20:30.000
你一个一个给他耗干了再说

00:20:30.000 --> 00:20:31.560
啊那完了之后你火山了

00:20:31.560 --> 00:20:33.040
接着一个个好

00:20:33.040 --> 00:20:34.080
腾讯会员的

00:20:34.080 --> 00:20:34.440
一样

00:20:34.440 --> 00:20:35.920
那包括其他云平台

00:20:35.920 --> 00:20:38.600
都有这种呃免费额度

00:20:38.600 --> 00:20:39.800
使劲好

00:20:39.800 --> 00:20:41.200
反正我们我们

00:20:41.200 --> 00:20:42.200
个人

00:20:42.200 --> 00:20:43.920
就大家先把免费的用完

00:20:43.920 --> 00:20:46.080
你大概对你怎么用的情况

00:20:46.080 --> 00:20:47.240
有个底的啊

00:20:47.240 --> 00:20:48.920
那你有更高的要求

00:20:48.920 --> 00:20:49.560
比如说你能说

00:20:49.560 --> 00:20:50.520
哎我要用Gemini

00:20:50.520 --> 00:20:52.160
他可能识别效果更好

00:20:52.160 --> 00:20:53.240
我要用GPT怎么样

00:20:53.240 --> 00:20:54.240
那那再说

00:20:54.240 --> 00:20:55.760
我们把话聊回来了

00:20:55.760 --> 00:20:57.000
就前面有讲到这个

00:20:57.000 --> 00:20:59.520
那我们为什么不去用贵的模型呢

00:20:59.520 --> 00:21:00.840
就我们来看看

00:21:00.840 --> 00:21:01.960
这个模型的价格

00:21:01.960 --> 00:21:03.040
GPT-5.5

00:21:03.040 --> 00:21:06.000
啊就GPT 新的输入

00:21:06.000 --> 00:21:07.040
5 刀

00:21:07.040 --> 00:21:09.400
DeepSeek是1 元人民币

00:21:09.400 --> 00:21:10.880
这之前差了几倍

00:21:10.880 --> 00:21:11.200
五

00:21:11.200 --> 00:21:12.440
现在汇率应该6.8吧

00:21:12.440 --> 00:21:13.360
还多的

00:21:13.360 --> 00:21:14.480
五成一6.8

00:21:14.480 --> 00:21:16.080
大概就是34倍啊

00:21:16.080 --> 00:21:17.520
反正就差不多这样子

00:21:17.520 --> 00:21:18.440
这能比吗

00:21:18.440 --> 00:21:19.920
然后你缓存输入

00:21:19.920 --> 00:21:20.240
OK

00:21:20.240 --> 00:21:20.920
0.5 刀

00:21:20.920 --> 00:21:21.960
就是十分之一嘛

00:21:21.960 --> 00:21:22.560
0.5 刀

00:21:22.560 --> 00:21:23.680
0.5 刀

00:21:23.680 --> 00:21:24.520
然后DeepSeek

00:21:24.520 --> 00:21:26.960
那个可是2%

00:21:26.960 --> 00:21:28.440
那个很夸张的

00:21:28.440 --> 00:21:29.640
他这个只是十分之一

00:21:29.640 --> 00:21:30.600
就是10%

00:21:30.600 --> 00:21:32.160
DeepSeek 可是2%

00:21:32.160 --> 00:21:34.720
往那成本缓存成没有差几个量级

00:21:34.720 --> 00:21:36.040
然后输出更夸张了

00:21:36.040 --> 00:21:38.800
输出是输入的6倍

00:21:38.800 --> 00:21:39.840
用得起吗

00:21:39.840 --> 00:21:41.840
如果你还拿这个写代码

00:21:41.840 --> 00:21:44.800
我之前试过用API写代码

00:21:44.800 --> 00:21:46.360
我那天

00:21:46.360 --> 00:21:48.000
再做一个项目的重构

00:21:48.000 --> 00:21:49.320
写了大概两三个小时

00:21:49.320 --> 00:21:51.720
写完了就直接跑了我一千块人民币

00:21:51.720 --> 00:21:54.040
TOKen 量可能一亿多两亿吧

00:21:54.080 --> 00:21:55.040
很贵的

00:21:55.040 --> 00:21:56.040
刷不起的

00:21:56.040 --> 00:21:57.480
包括你看Claude 的

00:21:57.480 --> 00:21:58.760
就别说Opus了

00:21:58.760 --> 00:22:00.640
Opus用不上现在

00:22:00.640 --> 00:22:02.440
你就看都别说opus了

00:22:02.440 --> 00:22:03.480
别看opus

00:22:03.480 --> 00:22:04.560
你Claude 的 Sonnet

00:22:04.560 --> 00:22:06.080
哪怕是Sonnet

00:22:06.080 --> 00:22:08.360
你这个东西都要三刀

00:22:08.360 --> 00:22:09.160
就便宜点

00:22:09.160 --> 00:22:13.720
那你opus就是5 刀，跟这个GPT对齐吗

00:22:13.720 --> 00:22:14.320
很贵的

00:22:14.320 --> 00:22:15.200
用不起的

00:22:15.200 --> 00:22:17.560
哪怕你用的是kimi

00:22:17.560 --> 00:22:20.840
他的输入价格也要6.5

00:22:20.840 --> 00:22:23.080
输出价格27 块

00:22:23.120 --> 00:22:24.760
这都不是一个成本

00:22:24.760 --> 00:22:27.000
更何况kimi的上下文窗口

00:22:27.000 --> 00:22:28.640
还没有到百万

00:22:28.640 --> 00:22:31.880
就我对DeepSeek是有一点偏爱的

00:22:31.880 --> 00:22:33.920
就不仅他是国模

00:22:33.920 --> 00:22:36.360
而且就感谢他们确实是做了很大努力

00:22:36.360 --> 00:22:38.760
就他们能用很小的成本

00:22:38.760 --> 00:22:41.000
来做到很不错的成果

00:22:41.000 --> 00:22:43.400
特别是他在中文语境下

00:22:43.400 --> 00:22:44.960
他的洞察力更好

00:22:44.960 --> 00:22:47.240
我之前有个个人的问题

00:22:47.240 --> 00:22:48.720
是全用中文的

00:22:48.720 --> 00:22:50.280
然后我最后我发现

00:22:50.280 --> 00:22:51.440
就是我发给了

00:22:51.480 --> 00:22:53.480
御三家就GPT Claude

00:22:53.480 --> 00:22:54.200
Gemini

00:22:54.200 --> 00:22:55.840
然后包括DeepSeek

00:22:55.840 --> 00:22:57.800
这四个一起去用

00:22:57.800 --> 00:22:59.520
最后洞察效果最好就DeepSeek

00:22:59.520 --> 00:23:00.760
他在中文语境下

00:23:00.760 --> 00:23:03.120
等能力还真的确实没得说

00:23:03.120 --> 00:23:03.440
OK

00:23:03.440 --> 00:23:05.120
那我们来谈一下

00:23:05.120 --> 00:23:08.040
为什么Flash这个模型他就够用了

00:23:08.040 --> 00:23:10.840
不仅仅是价格的问题

00:23:10.840 --> 00:23:13.320
也不仅仅是速度的问题

00:23:13.320 --> 00:23:15.360
而且我们要谈的是效果

00:23:15.360 --> 00:23:17.520
就这个很很反直觉对吧

00:23:17.520 --> 00:23:18.920
一般说Pro呢

00:23:18.920 --> 00:23:20.120
都很牛逼吧

00:23:20.120 --> 00:23:21.040
就专家

00:23:21.080 --> 00:23:22.640
但其实不是的

00:23:22.640 --> 00:23:24.400
就是Flash 的话

00:23:24.400 --> 00:23:26.880
他的指令遵循会更强

00:23:26.880 --> 00:23:27.600
那Pro 的话

00:23:27.600 --> 00:23:29.840
他是thinking能力比较

00:23:29.840 --> 00:23:31.200
思考能力比较强

00:23:31.200 --> 00:23:33.960
Flash就好像是你给他一个指令

00:23:33.960 --> 00:23:35.760
他就会老老实实去执行

00:23:35.760 --> 00:23:37.760
他又快又便宜又稳定

00:23:37.760 --> 00:23:39.440
但是Pro 的话

00:23:39.440 --> 00:23:40.880
就人想的多嘛

00:23:40.880 --> 00:23:42.960
那就是你懂的

00:23:42.960 --> 00:23:44.720
他推理链就比较重

00:23:44.720 --> 00:23:46.120
然后还喜欢自我延伸

00:23:46.120 --> 00:23:48.040
甚至把自己推理出来的东西

00:23:48.040 --> 00:23:50.120
当成规则来用

00:23:50.120 --> 00:23:52.080
就这种就是 overthinking

00:23:52.080 --> 00:23:53.400
你过度思考之后

00:23:53.400 --> 00:23:55.800
反而他的结果不理想

00:23:55.800 --> 00:23:57.520
就你一件事情可能

00:23:57.520 --> 00:23:59.200
并没有这么难对吧

00:23:59.200 --> 00:24:01.120
你要让他在那边想什么呢

00:24:01.120 --> 00:24:02.960
还要给他这么大的思考空间

00:24:02.960 --> 00:24:03.840
干什么呢

00:24:03.840 --> 00:24:05.320
就大部分的Agent场景

00:24:05.320 --> 00:24:06.680
我不是说所有

00:24:06.680 --> 00:24:07.840
大部分的Agent场景里面

00:24:07.840 --> 00:24:08.920
你的指令遵循

00:24:08.920 --> 00:24:11.400
其实比你的推理深度要更重要

00:24:11.400 --> 00:24:13.240
这个观点可能偏主观

00:24:13.240 --> 00:24:15.000
但我就是这么认为的

00:24:15.000 --> 00:24:16.680
就好像你在公司里面带人的话

00:24:16.680 --> 00:24:19.640
Flash他就有点像是一线的执行者

00:24:19.680 --> 00:24:21.880
你给他具体的指令他就照着做

00:24:21.880 --> 00:24:23.480
他反而这样不容易出错

00:24:23.480 --> 00:24:24.320
但是Pro 的话

00:24:24.320 --> 00:24:26.480
他就像是一个高手一样的东西

00:24:26.480 --> 00:24:27.960
你给他一个方向

00:24:27.960 --> 00:24:29.160
他就自己在那边琢磨了

00:24:29.160 --> 00:24:30.960
就一直琢磨怎么达成这个目标

00:24:30.960 --> 00:24:32.000
他有时候确实吧

00:24:32.000 --> 00:24:33.760
能给你很不错的结果

00:24:33.760 --> 00:24:36.200
因为他琢磨的确实还可以

00:24:36.200 --> 00:24:37.480
质量很高

00:24:37.480 --> 00:24:39.520
那有的时候他就会跑偏

00:24:39.520 --> 00:24:40.400
然后越想越偏

00:24:40.400 --> 00:24:41.200
越想越便宜

00:24:41.200 --> 00:24:42.240
这句话不用管他

00:24:42.240 --> 00:24:44.800
这个应该是我掉了一个顺序

00:24:44.800 --> 00:24:46.160
然后这边忘改了

00:24:46.160 --> 00:24:48.000
那我们怎么做抉择呢

00:24:48.000 --> 00:24:49.480
就他们之前怎么选呢

00:24:49.520 --> 00:24:50.960
但主要大部分情况下

00:24:50.960 --> 00:24:51.600
我前面说完

00:24:51.600 --> 00:24:53.480
就你用Flash就行了

00:24:53.480 --> 00:24:55.000
基本上你去做

00:24:55.000 --> 00:24:56.440
tool use就调工具

00:24:56.440 --> 00:24:57.800
然后或者你去执行一个任务

00:24:57.800 --> 00:24:58.360
或者怎么样

00:24:58.360 --> 00:25:00.480
就你日常情况下用Flash就够了

00:25:00.480 --> 00:25:02.520
又便宜又快又指令遵循

00:25:02.520 --> 00:25:03.440
why not

00:25:03.440 --> 00:25:04.840
那Pro 的话

00:25:04.840 --> 00:25:07.640
你可以主动的去做切换

00:25:07.640 --> 00:25:08.920
比如你就

00:25:08.920 --> 00:25:10.640
/model

00:25:10.640 --> 00:25:12.480
你在这里面你就可以去

00:25:12.480 --> 00:25:14.000
看你有哪一些模型

00:25:14.000 --> 00:25:14.520
OK

00:25:14.520 --> 00:25:17.240
然后你就可以按照他给你的这个

00:25:17.240 --> 00:25:18.680
规范来去换

00:25:18.680 --> 00:25:19.480
/model

00:25:19.480 --> 00:25:20.160
然后什么怎么样

00:25:20.160 --> 00:25:21.240
然后就可以换了

00:25:21.240 --> 00:25:22.840
或者你要是实在不会换

00:25:22.840 --> 00:25:23.720
你不可以用这个指定

00:25:23.720 --> 00:25:24.200
你就是说

00:25:24.200 --> 00:25:25.960
请你帮我把模型切换成

00:25:25.960 --> 00:25:27.760
DeepSeek的Pro

00:25:27.760 --> 00:25:29.040
也是OK的

00:25:29.040 --> 00:25:30.520
比如说这个Pro呢

00:25:30.520 --> 00:25:32.560
他更适合你去用他来做一些

00:25:32.560 --> 00:25:34.280
有一定思考能力复杂度

00:25:34.280 --> 00:25:35.680
要深度的东西

00:25:35.680 --> 00:25:38.000
比如说你重新搭建一个系统框架

00:25:38.000 --> 00:25:40.480
或者说你要做系统性的分析复盘

00:25:40.480 --> 00:25:41.960
就本来就需要一些

00:25:41.960 --> 00:25:43.560
我们深入思考的东西

00:25:43.560 --> 00:25:45.880
或者说你去梳理一些复杂的逻辑

00:25:45.880 --> 00:25:47.640
你需要他去想这个东西

00:25:47.760 --> 00:25:49.640
你就请神吧

00:25:49.640 --> 00:25:49.960
对吧

00:25:49.960 --> 00:25:51.200
你就再请他出来

00:25:51.200 --> 00:25:52.560
请诸葛出山

00:25:52.560 --> 00:25:54.240
你再主动去切吧

00:25:54.240 --> 00:25:54.840
OK

00:25:54.840 --> 00:25:55.800
那这个视频

00:25:55.800 --> 00:25:57.200
很跟大家分享这么多

00:25:57.200 --> 00:25:58.880
那我们来做一个总结吧

00:25:58.880 --> 00:26:00.520
首先就是DeepSeek

00:26:00.520 --> 00:26:02.520
Flash做主模型

00:26:02.520 --> 00:26:04.360
然后因为他在

00:26:04.360 --> 00:26:05.200
多模态能力上

00:26:05.200 --> 00:26:06.240
缺失，所以我们要补一个

00:26:06.240 --> 00:26:08.800
多模态模型的能力

00:26:08.800 --> 00:26:10.160
然后在Agent场景下

00:26:10.160 --> 00:26:12.800
Flash其实是不输Pro的

00:26:12.800 --> 00:26:15.560
甚至他更加的稳定

00:26:15.560 --> 00:26:15.800
OK

00:26:15.800 --> 00:26:17.480
那本期视频就是这样了

00:26:17.480 --> 00:26:19.480
如果你想看到更多

00:26:19.480 --> 00:26:22.480
有关于AI 实战方面的东西

00:26:22.480 --> 00:26:23.960
或者想跟我讨论

00:26:23.960 --> 00:26:27.400
或者想在这方面能有更进一步的

00:26:27.400 --> 00:26:29.200
思考或者怎么样的话

00:26:29.200 --> 00:26:31.840
欢迎可以加入我最近

00:26:31.840 --> 00:26:34.200
刚开的一个知识星球

00:26:34.200 --> 00:26:35.760
就帅真 AI 实战圈

00:26:35.760 --> 00:26:37.960
目前的话我每天都会在

00:26:37.960 --> 00:26:39.960
群里面跟大家讨论

00:26:39.960 --> 00:26:41.560
AI 相关的问题

00:26:41.560 --> 00:26:42.640
包括星球里面

00:26:42.640 --> 00:26:45.800
我也会做很多的内容分享

00:26:45.800 --> 00:26:46.960
就实战方面的

00:26:46.960 --> 00:26:48.480
包括好内容都有

00:26:48.480 --> 00:26:50.960
然后我这里面就会有很多

00:26:50.960 --> 00:26:52.080
很多东西

00:26:52.080 --> 00:26:53.560
就反正这里面发了

00:26:53.560 --> 00:26:55.880
好多好多实战相关的

00:26:55.880 --> 00:26:58.160
就我自己的一些观点也好

00:26:58.160 --> 00:26:59.200
实战经验也好

00:26:59.200 --> 00:27:01.080
反正就发了很多很多

00:27:01.080 --> 00:27:03.800
然后群也是每天都在高强度冲浪这样

00:27:03.800 --> 00:27:04.400
好了

00:27:04.400 --> 00:27:05.880
视频就到这吧

00:27:05.880 --> 00:27:07.320
如果你喜欢本期视频的话

00:27:07.320 --> 00:27:08.320
欢迎留言点赞

00:27:08.320 --> 00:27:09.120
评论收藏

00:27:09.120 --> 00:27:09.800
谢谢

00:27:09.800 --> 00:27:10.400
拜拜

