20260623-10 | Hermes Agent 小白别花冤枉钱!这套模型配置就够了
來源:Youtube | 建立:2026-06-23T13:42:08 | HTML:2026-06-23T13:44:34
開啟原始影片 note.md transcript.txt transcript.vtt

影片筆記:Hermes Agent 小白别花冤枉钱!这套模型配置就够了

YouTube 影片框會固定在左上方;點擊右側逐字稿時間戳可跳到對應時間。

一句話總結

針對 Hermes Agent 新手,建議採用「DeepSeek V4 Flash 作為主模型」搭配「阿里百煉千問 3.6-Flash 作為視覺補位」的低成本配置方案,利用各家雲廠商免費額度與 DeepSeek 的高緩存命中率,將日常 Agent 使用成本降至極低(單輪對話可能不到一分錢),同時區分 Flash 與 Pro 版本的適用場景。

核心重點

低成本核心策略

多模態(圖片識別)補位方案

Flash 與 Pro 版本差異

操作流程

詳細大綱

一、 配置背景與核心理念

二、 主模型選擇:DeepSeek V4 Flash

三、 多模態能力補位方案

在阿里百煉創建 API Key。

在 Hermes Agent Dashboard 中,將 Vision 模型設為 Custom。

輸入千問 3.6-Flash 的 API Key 及配置信息。

若配置錯誤(如誤配為 VL Plus),可通過 /reset 或重新發送指令修正。

四、 成本估算與免費額度利用

五、 DeepSeek Flash 與 Pro 的效果對比

六、 實操演示步驟

配置主模型

測試主模型

配置多模態補位

最終測試

工具 / 模型 / 名詞整理

操作流程整理

準備工作

配置主模型(DeepSeek V4 Flash)

配置視覺補位模型(千問 3.6-Flash)

測試與驗證

值得注意的限制或風險

DeepSeek V4 Flash 的多模態限制:該模型目前官方無多模態能力,無法識別無文字圖片,僅支援 OCR 文字提取,因此必須搭配其他多模態模型使用。

Pro 版本的過度思考風險:使用 Pro 版本時,模型可能因推理鏈過重而產生「過度思考」(Overthinking),將推理結果誤認為規則,導致結果跑偏。

免費額度的消耗:雖然雲廠商提供免費推理額度,但用戶應注意額度限制,建議先耗盡免費額度再考慮付費或切換模型。

配置錯誤風險:在配置 Vision 模型時,若參數填寫錯誤(如誤配為 VL Plus),可能導致功能異常,需透過 /reset 修正。

逐字稿辨識疑點

可延伸追問

DeepSeek V4 Flash 的緩存命中率 90% 以上是否為穩定數據,還是特定場景下的測試結果?

阿里百煉千問 3.6-Flash 的免費額度具體包含哪些限制(如 QPS、每日上限等)?

若同時使用多個雲廠商的免費額度,Hermes Agent 是否支援自動切換或負載平衡?

DeepSeek V4 Flash 與 V3 版本在實際 Agent 任務中的具體性能差異為何?

如何監控 Hermes Agent 的實際 Token 消耗,以確保成本控制在預期範圍內?

逐字稿時間軸

右側可一路往下捲;左側影片框會固定。點擊時間戳會讓左側影片跳到對應秒數。

00:00:00.000 → 00:00:02.120
Hello 大家好,这里是王帅真
00:00:02.120 → 00:00:06.920
今天这一期视频呢,想跟大家分享一下Hermes Agent 的模型配置问题
00:00:06.920 → 00:00:13.600
在前面两期视频发布之后,就会有很多朋友在评论区私信里面来问我
00:00:13.600 → 00:00:18.320
包括我身边也会有一些最近才开始用Hermes Agent 的朋友
00:00:18.320 → 00:00:22.000
就会来问我说,那我安装完这Hermes Agent 之后
00:00:22.000 → 00:00:24.920
然后呢,然后我们就要选模型了嘛
00:00:24.920 → 00:00:27.800
就比方说我们来看一下官方的QuickStart
00:00:27.960 → 00:00:30.080
它第一步,Install Hermes Agent
00:00:30.080 → 00:00:34.080
完了之后呢,Choose a Provider,就我们要选一个模型的服务提供商
00:00:34.080 → 00:00:39.360
OK,然后输入Hermes Model,你就会发现,哇靠,有这么多的模型对吧,一连串
00:00:39.360 → 00:00:44.120
有他们官方的,然后有我们国内的模型,有国外的模型,哇,琳琅满目
00:00:44.120 → 00:00:48.440
就你会有点迷失了,你会不知道要选什么
00:00:48.440 → 00:00:51.280
你也不知道,比如说会有人问说,开销怎么样啊
00:00:51.280 → 00:00:56.840
怎么样的比较好用啊,这一期视频呢,就是想给大家一套方案
00:00:56.960 → 00:01:00.120
主要是针对于小白,或者说刚开始用的人
00:01:00.120 → 00:01:05.040
希望大家能以一个较低的成本的方式,甚至是白嫖的方式
00:01:05.040 → 00:01:08.520
先上车再说,我们先用起来,先看看好不好用嘛
00:01:08.520 → 00:01:11.400
不要,一上来就有人会说,啊,你就得用GPT
00:01:11.400 → 00:01:14.000
然后你还要开那个Pro,那肯定是不对的嘛
00:01:14.000 → 00:01:16.200
你这个东西你都没有尝过啥滋味
00:01:16.200 → 00:01:20.240
你开始就投这么大成本,去用其实是不太合理的
00:01:20.240 → 00:01:24.320
包括有人会说,哎呀,你要用Gemini,你要用什么什么什么
00:01:24.400 → 00:01:28.760
我们先从更实际的方向去考虑这个问题
00:01:28.760 → 00:01:33.120
主要呢,就是我不太希望看到大家去花一些冤枉钱
00:01:33.120 → 00:01:36.920
就本着这样一个初心,然后有了这期视频
00:01:36.920 → 00:01:39.040
所以这个是一个比较新手向的
00:01:39.040 → 00:01:42.960
OK,然后我先给出来我的方案的一个核心的公式
00:01:42.960 → 00:01:46.680
其实就是主模型用DeepSeek 的 Flash
00:01:48.040 → 00:01:51.440
然后再加上一个多模态的模型去进行一个补位
00:01:51.440 → 00:01:54.400
比如说DeepSeek它其实是自己不能闭环的
00:01:54.400 → 00:01:56.320
它只能生成一些文字
00:01:56.320 → 00:01:59.400
虽然它有开源的多模态的论文
00:01:59.400 → 00:02:03.360
但是目前就官方来说,确实没有多模态能力
00:02:03.360 → 00:02:05.600
然后我们就需要有个多模态模型来补位
00:02:05.600 → 00:02:08.440
那这个详细的呢,我们后面再来聊
00:02:08.440 → 00:02:11.680
然后我们也可以利用各家云厂商给的一些免费额度
00:02:11.680 → 00:02:13.600
就一些羊毛,先用起来
00:02:13.600 → 00:02:17.560
反正先跑,我们觉得好用再说嘛,对不对
00:02:17.600 → 00:02:22.120
那为什么我选择DeepSeek来做我们的主模型呢
00:02:22.120 → 00:02:25.680
首先DeepSeek它是非常便宜的
00:02:25.680 → 00:02:28.480
我们可以来看一下DeepSeek V4 Flash
00:02:28.480 → 00:02:31.480
跟DeepSeek V4 Pro大概的一个价格
00:02:31.480 → 00:02:35.480
我们直接来看下面的这个这块我们先不看缓存
00:02:35.480 → 00:02:38.800
百万 TOKen 输入缓存未命中的情况
00:02:38.800 → 00:02:42.280
一块钱100 万 TOKen 的输入
00:02:42.280 → 00:02:46.280
相当于你可以塞一本《红楼梦》塞一本《三体》进去
00:02:46.280 → 00:02:48.640
都是没问题的,就大概这么个长度
00:02:48.640 → 00:02:52.000
然后你要说,那我来回对话,它上下文长了怎么办呢
00:02:52.000 → 00:02:54.280
呃,这一部分就会走到它的缓存上面
00:02:54.280 → 00:02:58.680
我们就可以看到DeepSeek它每百万 TOKen的缓存命中是
00:02:58.680 → 00:03:01.760
两分钱,你未命中是一块钱
00:03:01.760 → 00:03:05.000
那DeepSeek它的缓存命中率大概能有多少呢
00:03:05.000 → 00:03:09.280
得益于他们V4的时候做了一个缓存策略的优化
00:03:09.280 → 00:03:12.760
是一个大的进步,他们的命中率能达到90%
00:03:12.760 → 00:03:14.760
当然是建立在你多了几轮上嘛
00:03:14.760 → 00:03:17.600
就是你的命中率一般就能达到90%
00:03:17.600 → 00:03:20.720
而且它的缓存能给你保留时间比较长
00:03:20.720 → 00:03:24.640
所以你整个下来的成本其实是相对比较低的
00:03:24.640 → 00:03:28.080
包括它百万输出也才两元
00:03:28.080 → 00:03:31.240
你用到Pro 的话,大概贵三倍的程度吧
00:03:31.240 → 00:03:34.080
其实这个是非常便宜的
00:03:34.080 → 00:03:37.000
跟国外的GPT Claude差了几十倍
00:03:37.000 → 00:03:38.520
我们后面会来看
00:03:38.520 → 00:03:40.120
呃,那现在我先跟你说
00:03:40.120 → 00:03:41.960
大概成本是差几十倍的
00:03:41.960 → 00:03:44.400
我们来看一下它的缓存命中情况
00:03:44.400 → 00:03:48.960
我的输入命中缓存的是1500 万 TOKen
00:03:48.960 → 00:03:51.960
输入未命中缓存的是100 万都不到
00:03:51.960 → 00:03:54.560
就发现它很多都走到缓存上面了其实
00:03:54.560 → 00:03:57.160
然后输出的话也不到100 万
00:03:57.160 → 00:03:58.920
就十几万的样子
00:03:58.920 → 00:04:01.400
也就是说它大概呢
00:04:01.400 → 00:04:06.320
也就是个16分之15走到了缓存上
00:04:06.320 → 00:04:08.600
其实就是90%多了
00:04:08.600 → 00:04:11.760
这个比例是非常非常高的
00:04:11.760 → 00:04:14.640
那这一天的消耗大概是多少钱呢
00:04:14.640 → 00:04:16.640
我们可以看到也就一块多
00:04:16.640 → 00:04:18.240
你每一天这么用
00:04:18.240 → 00:04:20.000
那可能你再用凶一点
00:04:21.520 → 00:04:23.200
反正它不会贵的
00:04:23.200 → 00:04:25.160
除非你真的像我评论区里面有个人
00:04:25.160 → 00:04:26.560
他用的很凶啊
00:04:26.560 → 00:04:29.640
疯狂调教往里面加了一堆上下文啊
00:04:29.640 → 00:04:32.240
或者一些Hermes的东西
00:04:32.240 → 00:04:34.680
那可能要一二十块钱
00:04:34.680 → 00:04:35.960
如果你用的没那么凶
00:04:35.960 → 00:04:36.840
你就是日常用
00:04:36.840 → 00:04:39.280
那一天就是就是几块钱
00:04:39.320 → 00:04:40.680
那像我这一天啊
00:04:40.680 → 00:04:42.520
就是一块四毛七
00:04:42.520 → 00:04:43.560
那你去充一个
00:04:43.560 → 00:04:46.040
比如说什么Kimi的Plan
00:04:46.040 → 00:04:47.600
一个月都两百块了
00:04:47.600 → 00:04:48.880
而且这个还是按量付费
00:04:48.880 → 00:04:51.520
因为我们不可能每天都用这么凶的
00:04:51.520 → 00:04:53.760
这个需要大家自己实际用的时候去
00:04:53.760 → 00:04:55.440
这个用量信息里面
00:04:55.440 → 00:04:57.200
自己去点一点看一看
00:04:58.400 → 00:05:00.960
我们就先不过多做介绍了
00:05:00.960 → 00:05:02.200
反正在这里呢
00:05:02.200 → 00:05:04.640
就必须的给我们的梁胜良、文风
00:05:04.640 → 00:05:06.720
风仙圣仙刻一个
00:05:08.640 → 00:05:11.600
就我们能用上这么便宜的大模型
00:05:11.600 → 00:05:13.800
效果还能做到不错
00:05:17.240 → 00:05:19.040
那我们现在就来实操演示一下
00:05:19.040 → 00:05:20.840
我们怎么先把这个主模型
00:05:24.240 → 00:05:27.240
我们还是回到这个
00:05:27.240 → 00:05:29.720
DeepSeek的这个官网这边
00:05:29.720 → 00:05:31.360
就是deepseek.com
00:05:31.360 → 00:05:33.480
你用的搜索已经都给进去
00:05:33.960 → 00:05:36.080
我们不要点这开始对话
00:05:36.080 → 00:05:38.240
点这个API开放平台
00:05:38.760 → 00:05:40.400
点进来之后会看到我们前面
00:05:40.400 → 00:05:42.520
看到这个用量信息界面
00:05:43.480 → 00:05:45.720
我们去点API Keys
00:05:45.720 → 00:05:48.040
那我这边就已经有一些
00:05:50.080 → 00:05:50.920
这边已经有了
00:05:52.600 → 00:05:54.600
然后我们现在重新来一遍
00:05:54.600 → 00:05:55.520
我带大家来一遍
00:05:55.520 → 00:05:58.600
我们先命名好我们的API Key
00:05:58.600 → 00:06:00.040
比如说我们这边是Hermes要用
00:06:00.040 → 00:06:01.480
那我们就给他一个Hermes
00:06:03.400 → 00:06:05.520
然后创建好了之后呢
00:06:05.520 → 00:06:07.360
我们就点击这个复制
00:06:07.400 → 00:06:10.480
为了避免我们等我可能会配错
00:06:10.480 → 00:06:13.000
这个页面可以先不要关
00:06:14.680 → 00:06:17.360
我们进入到终端界面
00:06:17.360 → 00:06:19.520
我们就输入前面
00:06:19.520 → 00:06:21.440
那边这官网说的嘛
00:06:21.440 → 00:06:23.040
Hermes Model是吧
00:06:24.400 → 00:06:26.440
我只跟大家确认一下
00:06:26.880 → 00:06:29.720
我们输入Hermes Model
00:06:29.720 → 00:06:32.440
看到琳琅满目的模型对吧
00:06:32.440 → 00:06:34.440
无论是你在Hermes Model里面去配
00:06:34.440 → 00:06:36.080
还是你Hermes的setup
00:06:36.080 → 00:06:37.800
就你第一次装那个
00:06:37.800 → 00:06:39.680
一样你都会到这个界面来
00:06:39.960 → 00:06:42.160
然后我们就找到这个DeepSeek
00:06:42.800 → 00:06:44.680
recode的这个什么
00:06:44.680 → 00:06:46.520
直联API这边就这个
00:06:46.880 → 00:06:49.600
然后我们敲击一下回车进来
00:06:50.400 → 00:06:53.440
No DeepSeek API Key configured
00:06:53.440 → 00:06:54.720
那我这边就要去输入
00:06:54.720 → 00:06:56.560
我的一个DeepSeek API Key
00:06:56.560 → 00:06:58.680
然后这边我选择一下复制
00:06:59.120 → 00:07:01.920
然后我就把我的这个东西给贴进来了
00:07:02.840 → 00:07:03.760
然后就save 了
00:07:04.680 → 00:07:06.000
你的Base URL 是什么
00:07:06.000 → 00:07:07.160
就是你的主域名
00:07:07.160 → 00:07:08.960
当然这个就是直接就是官网的了
00:07:08.960 → 00:07:10.360
大家可以不用再去改了
00:07:12.680 → 00:07:14.280
然后我悬问那个主要模型
00:07:14.280 → 00:07:16.640
那默认就会选择最新的v4 Flash
00:07:19.560 → 00:07:20.400
然后这个时候
00:07:20.400 → 00:07:22.400
Default Model set to
00:07:22.400 → 00:07:23.880
DeepSeek V4 Flash
00:07:25.120 → 00:07:26.120
这个时候我们已经成功
00:07:26.120 → 00:07:27.760
切换到DeepSeek上面来了
00:07:28.200 → 00:07:29.160
就这个过程呢
00:07:29.160 → 00:07:30.480
就是这么快啊
00:07:30.480 → 00:07:33.520
然后我们来做一个测试
00:07:33.560 → 00:07:35.280
我们起个新会话啊
00:07:35.280 → 00:07:36.280
其实我们已经看到
00:07:37.320 → 00:07:38.640
他能起会话成功
00:07:38.640 → 00:07:41.240
他Model 已经是DeepSeek V4 Flash了
00:07:41.240 → 00:07:42.480
那Provider 是DeepSeek
00:07:43.280 → 00:07:44.720
可以看到他就是一个
00:07:46.240 → 00:07:48.240
那我们可以跟他问个好
00:07:48.760 → 00:07:51.960
你用的是什么模型
00:07:52.680 → 00:07:53.520
我们来测试一下
00:07:54.960 → 00:07:57.000
然后你可以看到他正常的
00:07:57.600 → 00:08:00.040
那这个就是我们已经配置上了
00:08:00.040 → 00:08:02.800
那这个时候就会有个问题
00:08:02.800 → 00:08:05.320
那我们在对话里面去沟通的时候
00:08:05.320 → 00:08:06.960
无论是我们在FaceboOK上面用啊
00:08:06.960 → 00:08:08.040
在微信上面用啊
00:08:08.720 → 00:08:10.280
我们有时候其实是会
00:08:10.280 → 00:08:12.680
想要带一些图片上去问他嘛
00:08:12.960 → 00:08:15.880
我们会想要去跟他有一些
00:08:17.680 → 00:08:19.480
我的哪里的一个什么照片啊
00:08:19.480 → 00:08:21.960
然后问他这个啥情况嘛
00:08:21.960 → 00:08:23.760
这都是很有可能的
00:08:23.760 → 00:08:24.480
就比如我昨天
00:08:24.480 → 00:08:27.040
我给我的房间拍了一个照片
00:08:28.360 → 00:08:30.160
我怎么整理比较好
00:08:30.160 → 00:08:31.680
那现在可能有点乱
00:08:31.680 → 00:08:33.480
对那这个时候他可能就
00:08:33.480 → 00:08:34.520
你用DeepSeek的话
00:08:34.520 → 00:08:36.640
他没有办法去做识别
00:08:36.640 → 00:08:38.680
给大家示范一下
00:08:38.680 → 00:08:40.280
比方说这个时候
00:08:40.280 → 00:08:43.840
我去做一个截图来演示一下
00:08:45.280 → 00:08:49.960
你能看得见这张图片吗
00:08:49.960 → 00:08:51.120
我可以直接跟大家说
00:08:51.120 → 00:08:52.160
就这个DeepSeek
00:08:52.160 → 00:08:53.720
他就不是多模态模型
00:08:53.720 → 00:08:55.280
所以他是看不到的
00:08:55.280 → 00:08:56.960
你看他就说看不见
00:08:56.960 → 00:08:59.000
当前这个实例没有配置
00:08:59.000 → 00:09:00.520
图像识别能力
00:09:00.520 → 00:09:03.680
你需要先配置一个Vision Model Provider
00:09:03.680 → 00:09:04.800
就可以看到这个时候
00:09:04.800 → 00:09:07.240
他其实是没有这样的一个能力的
00:09:07.240 → 00:09:09.200
DeepSeek是没有多模态的
00:09:09.200 → 00:09:10.320
就包括我用官网
00:09:10.320 → 00:09:11.280
你可以自己去试试
00:09:11.280 → 00:09:12.520
你去官网给他发一个
00:09:12.520 → 00:09:13.720
没有文字的图片
00:09:13.720 → 00:09:16.040
你可能以前以前发可以
00:09:16.040 → 00:09:16.960
但是你会发现
00:09:16.960 → 00:09:19.640
他其实接的是一个OCR 的服务
00:09:19.640 → 00:09:21.760
如果你的图片一旦没有文字
00:09:22.640 → 00:09:24.360
未提取到文字
00:09:24.360 → 00:09:25.400
你们可以试试
00:09:25.400 → 00:09:28.200
但是主播今天剪视频的时候
00:09:28.200 → 00:09:29.960
发现DeepSeek官网
00:09:29.960 → 00:09:32.120
已经在灰度识图模式了
00:09:32.120 → 00:09:34.280
多模态不远了兄弟们
00:09:34.280 → 00:09:37.040
但API 什么时候来还不知道
00:09:37.040 → 00:09:39.640
所以仍然想和大家分享
00:09:39.640 → 00:09:41.240
多模态的方案
00:09:41.240 → 00:09:43.280
所以我们的解决方案呢
00:09:44.040 → 00:09:46.720
我们要在DeepSeek Flash的基础上
00:09:46.720 → 00:09:47.920
我们再去配置一个
00:09:47.920 → 00:09:49.960
可以支撑他图片理解
00:09:49.960 → 00:09:52.480
能力的一个多模态的模型
00:09:52.480 → 00:09:54.520
就我们主要还用DeepSeek
00:09:54.520 → 00:09:56.720
但是我们就图片
00:09:56.720 → 00:09:58.920
Vision Analyze这个部分
00:09:58.920 → 00:10:00.920
接入一个多模态的模型
00:10:00.920 → 00:10:02.360
到这一步要说明一下
00:10:02.360 → 00:10:04.120
我没有接任何广告
00:10:04.120 → 00:10:07.040
我将会用百炼里面的千问
00:10:07.040 → 00:10:08.360
就阿里的千问来演示
00:10:08.360 → 00:10:10.400
但是千问没有给我任何广告费
00:10:10.400 → 00:10:12.720
就这个思路是通的
00:10:13.960 → 00:10:15.200
你去用腾讯的混元
00:10:15.200 → 00:10:17.640
你去用字节的豆包
00:10:18.520 → 00:10:20.360
并且他们都有羊毛可以好
00:10:20.360 → 00:10:21.560
都有免费额度
00:10:21.560 → 00:10:23.040
没关系随便用
00:10:23.520 → 00:10:26.640
我们进入到百炼大模型的这个界面
00:10:26.640 → 00:10:28.480
我这边选的是一个视觉模型
00:10:28.480 → 00:10:30.200
我先给大家看一下
00:10:30.200 → 00:10:32.400
就是你可以在这里面去找
00:10:32.400 → 00:10:34.200
它有视觉能力的一些模型
00:10:34.200 → 00:10:36.000
那最基础的比较
00:10:36.000 → 00:10:38.200
最新可能有到千问3.7什么
00:10:38.400 → 00:10:39.360
我们用不到这么好
00:10:40.160 → 00:10:41.840
我们可以直接
00:10:41.840 → 00:10:43.600
选个千问 3.6-Flash
00:10:43.600 → 00:10:45.280
我们就以这个来演示吧
00:10:45.280 → 00:10:49.440
你要是想成本更低一点的用千问 3.5-Flash
00:10:49.440 → 00:10:51.480
而且我们可以先不考虑成本问题
00:10:51.480 → 00:10:53.720
因为它这些东西都有免费额度
00:10:54.960 → 00:10:57.200
我们可以一样把这个东西复制过来
00:10:57.240 → 00:10:58.400
我们就把图片贴过来
00:10:59.920 → 00:11:01.120
你能看见这样图片吗
00:11:01.120 → 00:11:03.480
我们可以试一下它的一个图片理解能力
00:11:03.840 → 00:11:05.520
它马上就能夸夸夸
00:11:05.520 → 00:11:06.720
然后都看到了
00:11:07.600 → 00:11:10.280
我看我验证了它的一个图片能力之后呢
00:11:10.280 → 00:11:12.920
我们选择下面的这个用量
00:11:14.440 → 00:11:15.200
我们点一下之后
00:11:15.200 → 00:11:17.120
可以看到它有个免费额度
00:11:19.400 → 00:11:21.280
比如说我们进到方舟里面来
00:11:21.280 → 00:11:23.400
也基本都有免费推理额度
00:11:25.480 → 00:11:27.120
甚至它DeepSeek Flash
00:11:27.120 → 00:11:29.200
你看这个也给你提供了免费额度
00:11:29.200 → 00:11:30.960
就这些东西你都可以去配
00:11:30.960 → 00:11:33.240
反正这种送你个50 万100 万的
00:11:33.920 → 00:11:35.280
像阿里这些都给100 万
00:11:35.280 → 00:11:36.680
然后字节那边给50 万
00:11:36.680 → 00:11:38.680
我们作为个人用户随便去好
00:11:38.680 → 00:11:41.920
然后阿里可以看到它也有DeepSeek-VL Flash
00:11:41.920 → 00:11:44.640
就是如果你想先用起来
00:11:44.640 → 00:11:46.400
你就你就用这个就可以了
00:11:46.400 → 00:11:49.040
当然那就不是我前面的那套配置方式了
00:11:49.040 → 00:11:50.160
那新的配置方式呢
00:11:50.160 → 00:11:51.520
我们现在来讲
00:11:51.520 → 00:11:54.520
呃我们因为我用的是千问 3.6-Flash
00:11:54.560 → 00:11:56.400
我们数一下3.6
00:11:57.960 → 00:12:01.400
呃我们来选择这个千问 3.6-Flash
00:12:01.400 → 00:12:03.800
我们将会用的是这一个东西
00:12:03.800 → 00:12:05.520
可以看到我已经用了一部分了
00:12:05.520 → 00:12:07.760
如果你呃比较谨慎的话
00:12:07.760 → 00:12:08.920
你怕多花一分钱
00:12:08.920 → 00:12:10.000
你一分钱不想花啊
00:12:10.000 → 00:12:12.200
你就点这个免费额度用完即停
00:12:12.200 → 00:12:13.400
当你这个用完了之后呢
00:12:13.400 → 00:12:15.480
你再去好别的模型
00:12:15.480 → 00:12:16.760
到时候你再自己去换嘛
00:12:16.760 → 00:12:20.040
反正这个都是很好很好都替换的
00:12:20.040 → 00:12:22.680
OK 那我们接下来要做的是什么呢
00:12:22.680 → 00:12:25.120
我们知道了要选择那个模型然后呢
00:12:25.120 → 00:12:26.200
呃刚才看一个额度
00:12:26.200 → 00:12:28.160
我们点这个 API Keys
00:12:28.160 → 00:12:29.480
下面的这 API Keys
00:12:29.480 → 00:12:31.880
在用量的下面两个格子呃
00:12:31.880 → 00:12:33.640
然后在这边一样
00:12:33.640 → 00:12:36.240
我们可以去创建 API Key啊
00:12:36.240 → 00:12:38.120
一样我把这个东西给删了
00:12:38.120 → 00:12:39.560
我们重来一遍
00:12:39.560 → 00:12:40.880
权限就默认全部
00:12:40.880 → 00:12:41.960
然后描述一样
00:12:41.960 → 00:12:42.880
我们写个 Hermes
00:12:43.280 → 00:12:44.040
然后也是一样
00:12:44.040 → 00:12:45.160
停在这个页面
00:12:45.160 → 00:12:46.840
然后我们点一个复制
00:12:47.520 → 00:12:49.000
我们先先放着
00:12:50.080 → 00:12:53.040
我们再跳到这个 Hermes Agent
00:12:53.040 → 00:12:55.800
在阿里云上面的一个文档
00:12:55.800 → 00:12:58.400
找到这个接入客户端开发工具
00:12:58.400 → 00:12:59.560
然后Hermes Agent这个
00:12:59.560 → 00:13:01.640
但这个文档到时候会贴给大家
00:13:01.640 → 00:13:03.280
我们直接选到这个
00:13:03.280 → 00:13:04.920
按量计费这一块这边来
00:13:04.920 → 00:13:07.240
因为我们是走的 API,API
00:13:07.240 → 00:13:09.480
就是用多少付多少钱嘛
00:13:09.480 → 00:13:12.040
然后我们刚刚不是已经
00:13:12.040 → 00:13:14.120
有了 key 的那一部分吗
00:13:14.120 → 00:13:16.160
我们可以根据这个
00:13:16.160 → 00:13:18.360
Hermes config 来
00:13:18.360 → 00:13:21.080
当然我们也可以不这么来
00:13:21.080 → 00:13:22.440
因为我们已经接了
00:13:22.440 → 00:13:23.680
DeepSeek Flash 了嘛
00:13:23.920 → 00:13:25.360
那我们就直接让DeepSeek
00:13:25.360 → 00:13:26.520
那个 Hermes Agent
00:13:26.520 → 00:13:28.080
帮我们配就可以了
00:13:28.080 → 00:13:29.720
那我们就大概把这一段话
00:13:30.280 → 00:13:31.200
然后让他来配
00:13:31.200 → 00:13:32.760
那配是会配在哪呢
00:13:33.720 → 00:13:35.880
Hermes Agent 的 Dashboard 里面来
00:13:37.040 → 00:13:38.080
我们这个 Main Model
00:13:38.080 → 00:13:39.040
已经是DeepSeek了
00:13:39.040 → 00:13:41.120
然后我们要去配他的一个
00:13:42.280 → 00:13:43.680
相对应的任务模型
00:13:43.680 → 00:13:44.440
OK 我可以看到
00:13:44.440 → 00:13:46.000
他默认的会全部都是 Auto
00:13:46.000 → 00:13:47.160
就你主模型用哪个
00:13:48.200 → 00:13:50.600
那我们要配的其实就是这个 vision
00:13:50.600 → 00:13:52.040
但是我们这边还没配上
00:13:52.040 → 00:13:54.840
我们会以 Custom 的方式来配
00:13:54.840 → 00:13:56.760
我们会 Custom 的方式来配
00:13:56.760 → 00:13:57.640
可以看一下他这个
00:13:57.640 → 00:13:59.720
config 一个典型的配置示例
00:14:00.880 → 00:14:02.560
大概是一个长这样的东西
00:14:02.560 → 00:14:04.520
呃 那我们就复制复制复制
00:14:07.720 → 00:14:11.760
vision 的模型 key 是
00:14:11.760 → 00:14:12.640
就这样就可以了
00:14:12.640 → 00:14:14.280
你就像我这样说就行了
00:14:14.280 → 00:14:16.240
前面那段话全部复制下来
00:14:16.240 → 00:14:17.720
帮我配置一下什么什么
00:14:17.720 → 00:14:18.880
key 是什么什么什么
00:14:21.680 → 00:14:24.680
呃 我们能发现他配的
00:14:24.680 → 00:14:26.240
好像有一点翻车
00:14:26.240 → 00:14:27.760
不太对不太对
00:14:28.520 → 00:14:31.120
我们主打一个展示容错率
00:14:33.040 → 00:14:34.320
我前面说的不完整啊
00:14:34.320 → 00:14:38.680
你要用 Custom 的方式去配置
00:14:39.680 → 00:14:42.680
其实这段也是他那个弄下来的嘛
00:14:43.320 → 00:14:46.520
然后模型是用
00:14:46.520 → 00:14:49.480
千问三三点六
00:14:51.680 → 00:14:53.760
啊 就说明他前面这个东西配错了
00:14:53.760 → 00:14:55.800
怎么能配到 VL Plus
00:14:55.800 → 00:14:57.840
vl 他其实是一个完整的
00:14:59.320 → 00:15:01.040
就他除了理解
00:15:01.040 → 00:15:02.960
我记得应该是还能生图的
00:15:02.960 → 00:15:05.040
就如果大家有生图的那种需求
00:15:05.040 → 00:15:08.600
然后再去另外找其他的模型
00:15:08.600 → 00:15:11.240
啊 就可以看到他现在就开始夸夸夸一桶配了
00:15:13.480 → 00:15:15.560
OK 那现在应该是好了
00:15:15.560 → 00:15:18.360
我们先来这个看板这边看一眼吧
00:15:18.360 → 00:15:21.400
OK 我们可以看到他这边应该是已经有了啊
00:15:22.200 → 00:15:24.320
Vision Custom 千问3.6
00:15:25.440 → 00:15:28.280
呃 那我们现在回来啊
00:15:28.280 → 00:15:29.400
就说明他这边OK的嘛
00:15:30.680 → 00:15:32.520
那我们现在来把那个
00:15:32.520 → 00:15:34.640
消息重新再来试一遍
00:15:34.640 → 00:15:36.440
OK 一样的内容
00:15:37.400 → 00:15:38.880
能不能看见这张图片
00:15:40.480 → 00:15:43.280
然后就能发现他这个时候就读得出来了
00:15:43.600 → 00:15:45.360
就我们这边是一个步骤
00:15:45.840 → 00:15:47.120
这是配置和默认模型
00:15:47.120 → 00:15:48.800
为DeepSeek Flash 的步骤
00:15:49.640 → 00:15:50.480
然后还反过来
00:15:50.480 → 00:15:52.960
我说你是想让我帮你完成这些配置吗
00:15:54.200 → 00:15:55.680
只是确认我能看到这个图片
00:15:56.680 → 00:15:57.880
OK 就到这一步
00:15:57.880 → 00:16:00.920
我们已经把那个图片的也配完了
00:16:01.200 → 00:16:04.400
然后确实我们这个流程也走完了
00:16:07.440 → 00:16:09.800
在百链上面的一个配置
00:16:09.800 → 00:16:11.360
如果你去用呃
00:16:11.360 → 00:16:13.280
腾讯的混元或者字节
00:16:14.680 → 00:16:17.280
理论上他们你也能找到他们的那个
00:16:17.280 → 00:16:19.760
呃文档甚至说你自己都不要去找
00:16:19.760 → 00:16:22.200
你直接让你的Hermes Agent
00:16:22.200 → 00:16:24.640
自己去找文档来配
00:16:24.640 → 00:16:27.520
因为他本身就自带呃Web 搜索
00:16:27.520 → 00:16:29.200
Web 解析的能力没关系
00:16:29.200 → 00:16:30.360
让他自己去找
00:16:30.360 → 00:16:31.880
这都没有关系
00:16:31.880 → 00:16:34.920
总之就是我们把这个多模态的能力
00:16:36.280 → 00:16:39.360
那我们这样的一个使用就很丝滑了嘛
00:16:39.400 → 00:16:40.360
那你可能会说
00:16:40.360 → 00:16:42.120
哎那他这个东西
00:16:42.120 → 00:16:43.880
好像就是一个
00:16:44.440 → 00:16:45.640
哎那他是不是也是OCR
00:16:45.640 → 00:16:47.040
我们来实验一下
00:16:47.040 → 00:16:49.480
OK 我这边拍一个照片
00:16:49.480 → 00:16:51.240
我们可以看到我拍了一张照片
00:16:51.240 → 00:16:52.560
然后看到能不能解析出来
00:16:52.560 → 00:16:54.600
就这这应该是没有文字了吧
00:16:54.600 → 00:16:55.560
你不能说没文字
00:16:55.560 → 00:16:58.440
但是这确实没什么文字啊
00:16:58.440 → 00:17:00.080
他基本上就是一个物体
00:17:00.080 → 00:17:01.280
这个可能不太好
00:17:01.280 → 00:17:03.920
我刚刚应该找一个完全没文字的
00:17:03.920 → 00:17:05.480
OK 你看他可以看出来
00:17:05.480 → 00:17:07.240
看到了机械键盘
00:17:07.240 → 00:17:10.640
加垂直鼠标的桌面setup
00:17:10.640 → 00:17:12.800
然后可以看出来这个什么
00:17:12.800 → 00:17:14.800
他他他倒是这个这个词别说
00:17:18.040 → 00:17:20.280
其实大部分都能看得出来了
00:17:20.280 → 00:17:22.800
那整个整个完整的闭环就是这样
00:17:22.800 → 00:17:24.360
那这套方案呢
00:17:24.360 → 00:17:26.000
大概要花多少钱
00:17:26.000 → 00:17:27.400
我们可以试一下
00:17:27.400 → 00:17:29.400
就就就这一轮
00:17:31.920 → 00:17:32.960
我们可以这样
00:17:34.760 → 00:17:35.800
我们会发现啊
00:17:35.800 → 00:17:38.120
其实很多都走到缓存上了
00:17:38.120 → 00:17:39.320
然后输出的TOKen
00:17:39.320 → 00:17:41.800
好啊也也没多少
00:17:41.800 → 00:17:43.680
就我们可以用/usage
00:17:43.680 → 00:17:46.240
去看你的使用情况
00:17:47.560 → 00:17:49.320
你要这么算的话
00:17:49.320 → 00:17:52.160
比方说我就就就就拿这个来看吧
00:17:53.760 → 00:17:54.880
这样吧这样吧
00:17:55.680 → 00:17:57.080
然后我们这样一下
00:17:59.080 → 00:18:02.960
当然这是单位要改成0.0
00:18:02.960 → 00:18:04.920
因为你是你的单位是
00:18:09.880 → 00:18:13.520
啊加上没有cache 的1388
00:18:13.520 → 00:18:18.200
但是你得往前一0.0013啊
00:18:23.200 → 00:18:26.840
但是这前面要0.0000啊
00:18:26.840 → 00:18:28.200
这才多少钱啊
00:18:28.200 → 00:18:29.520
一分钱都不到对吧
00:18:29.520 → 00:18:31.280
你这么聊完一分钱都不到
00:18:31.280 → 00:18:32.440
但你平时用的话
00:18:32.440 → 00:18:33.800
肯定是更频繁的
00:18:33.800 → 00:18:34.880
那我这边都可以
00:18:34.880 → 00:18:36.600
你那那那我估凶一点吧
00:18:38.080 → 00:18:39.920
然后你图片识别的话
00:18:39.920 → 00:18:42.280
这样我们直接在这里面去问
00:18:50.240 → 00:18:53.320
我们精确点一张两照的图片
00:18:57.360 → 00:19:00.200
帮我算一下成本
00:19:00.200 → 00:19:02.240
现在云平台都有
00:19:03.520 → 00:19:05.280
哎呀我们反正就
00:19:06.520 → 00:19:08.920
啊他这个有点蠢了
00:19:08.920 → 00:19:10.760
OK你3.6-Flash 的话
00:19:14.240 → 00:19:16.120
我可以直接给大家一个经验值
00:19:16.120 → 00:19:18.400
基本上你一张图片就是
00:19:18.400 → 00:19:20.120
呃可能是1000多
00:19:20.120 → 00:19:21.440
也可能是2000多
00:19:21.440 → 00:19:22.840
3000多4000多5000多
00:19:23.480 → 00:19:25.960
我们假设我们一张就按3000
00:19:28.480 → 00:19:29.840
那我们算一下
00:19:30.680 → 00:19:33.920
100 万除以3000
00:19:33.920 → 00:19:36.440
也就是说我们1.44元
00:19:36.440 → 00:19:38.920
可以用到这么多图片
00:19:38.920 → 00:19:40.520
那一张图片多少钱呢
00:19:46.120 → 00:19:48.480
OK相当于一个图片
00:19:51.760 → 00:19:53.640
好像这个也是0.004
00:19:54.160 → 00:19:55.640
那我们一轮下来
00:19:55.640 → 00:19:56.840
一分钱都不到
00:20:00.000 → 00:20:01.320
啊就是带图的
00:20:01.320 → 00:20:03.280
还在往上加加加加加加
00:20:08.640 → 00:20:11.160
当然你们可能涉及一些缓存的计算
00:20:11.160 → 00:20:12.000
就是文本对话
00:20:12.000 → 00:20:13.240
这边有一些cache
00:20:13.240 → 00:20:14.320
那我们再订算了
00:20:14.320 → 00:20:16.280
更何况这个图片识别
00:20:16.280 → 00:20:19.320
你可以不停的去耗羊毛
00:20:19.320 → 00:20:20.560
刚不是给你看了嘛
00:20:22.680 → 00:20:24.200
你看免费额度这么多
00:20:24.200 → 00:20:25.680
你回去那边视觉模型
00:20:25.680 → 00:20:27.600
这边找哪些支持
00:20:27.640 → 00:20:30.000
你一个一个给他耗干了再说
00:20:30.000 → 00:20:31.560
啊那完了之后你火山了
00:20:31.560 → 00:20:33.040
接着一个个好
00:20:34.440 → 00:20:35.920
那包括其他云平台
00:20:35.920 → 00:20:38.600
都有这种呃免费额度
00:20:39.800 → 00:20:41.200
反正我们我们
00:20:42.200 → 00:20:43.920
就大家先把免费的用完
00:20:43.920 → 00:20:46.080
你大概对你怎么用的情况
00:20:47.240 → 00:20:48.920
那你有更高的要求
00:20:48.920 → 00:20:49.560
比如说你能说
00:20:49.560 → 00:20:50.520
哎我要用Gemini
00:20:50.520 → 00:20:52.160
他可能识别效果更好
00:20:52.160 → 00:20:53.240
我要用GPT怎么样
00:20:54.240 → 00:20:55.760
我们把话聊回来了
00:20:55.760 → 00:20:57.000
就前面有讲到这个
00:20:57.000 → 00:20:59.520
那我们为什么不去用贵的模型呢
00:20:59.520 → 00:21:00.840
就我们来看看
00:21:00.840 → 00:21:01.960
这个模型的价格
00:21:03.040 → 00:21:06.000
啊就GPT 新的输入
00:21:07.040 → 00:21:09.400
DeepSeek是1 元人民币
00:21:09.400 → 00:21:10.880
这之前差了几倍
00:21:11.200 → 00:21:12.440
现在汇率应该6.8吧
00:21:14.480 → 00:21:16.080
大概就是34倍啊
00:21:16.080 → 00:21:17.520
反正就差不多这样子
00:21:18.440 → 00:21:19.920
然后你缓存输入
00:21:20.920 → 00:21:21.960
就是十分之一嘛
00:21:26.960 → 00:21:28.440
那个很夸张的
00:21:28.440 → 00:21:29.640
他这个只是十分之一
00:21:30.600 → 00:21:32.160
DeepSeek 可是2%
00:21:32.160 → 00:21:34.720
往那成本缓存成没有差几个量级
00:21:34.720 → 00:21:36.040
然后输出更夸张了
00:21:36.040 → 00:21:38.800
输出是输入的6倍
00:21:39.840 → 00:21:41.840
如果你还拿这个写代码
00:21:41.840 → 00:21:44.800
我之前试过用API写代码
00:21:46.360 → 00:21:48.000
再做一个项目的重构
00:21:48.000 → 00:21:49.320
写了大概两三个小时
00:21:49.320 → 00:21:51.720
写完了就直接跑了我一千块人民币
00:21:51.720 → 00:21:54.040
TOKen 量可能一亿多两亿吧
00:21:56.040 → 00:21:57.480
包括你看Claude 的
00:21:58.760 → 00:22:00.640
Opus用不上现在
00:22:00.640 → 00:22:02.440
你就看都别说opus了
00:22:03.480 → 00:22:04.560
你Claude 的 Sonnet
00:22:06.080 → 00:22:08.360
你这个东西都要三刀
00:22:09.160 → 00:22:13.720
那你opus就是5 刀,跟这个GPT对齐吗
00:22:15.200 → 00:22:17.560
哪怕你用的是kimi
00:22:17.560 → 00:22:20.840
他的输入价格也要6.5
00:22:20.840 → 00:22:23.080
输出价格27 块
00:22:23.120 → 00:22:24.760
这都不是一个成本
00:22:24.760 → 00:22:27.000
更何况kimi的上下文窗口
00:22:27.000 → 00:22:28.640
还没有到百万
00:22:28.640 → 00:22:31.880
就我对DeepSeek是有一点偏爱的
00:22:31.880 → 00:22:33.920
就不仅他是国模
00:22:33.920 → 00:22:36.360
而且就感谢他们确实是做了很大努力
00:22:36.360 → 00:22:38.760
就他们能用很小的成本
00:22:38.760 → 00:22:41.000
来做到很不错的成果
00:22:41.000 → 00:22:43.400
特别是他在中文语境下
00:22:43.400 → 00:22:44.960
他的洞察力更好
00:22:44.960 → 00:22:47.240
我之前有个个人的问题
00:22:47.240 → 00:22:48.720
是全用中文的
00:22:48.720 → 00:22:50.280
然后我最后我发现
00:22:50.280 → 00:22:51.440
就是我发给了
00:22:51.480 → 00:22:53.480
御三家就GPT Claude
00:22:54.200 → 00:22:55.840
然后包括DeepSeek
00:22:55.840 → 00:22:57.800
这四个一起去用
00:22:57.800 → 00:22:59.520
最后洞察效果最好就DeepSeek
00:22:59.520 → 00:23:00.760
他在中文语境下
00:23:00.760 → 00:23:03.120
等能力还真的确实没得说
00:23:03.440 → 00:23:05.120
那我们来谈一下
00:23:05.120 → 00:23:08.040
为什么Flash这个模型他就够用了
00:23:08.040 → 00:23:10.840
不仅仅是价格的问题
00:23:10.840 → 00:23:13.320
也不仅仅是速度的问题
00:23:13.320 → 00:23:15.360
而且我们要谈的是效果
00:23:15.360 → 00:23:17.520
就这个很很反直觉对吧
00:23:21.080 → 00:23:22.640
但其实不是的
00:23:22.640 → 00:23:24.400
就是Flash 的话
00:23:24.400 → 00:23:26.880
他的指令遵循会更强
00:23:27.600 → 00:23:29.840
他是thinking能力比较
00:23:29.840 → 00:23:31.200
思考能力比较强
00:23:31.200 → 00:23:33.960
Flash就好像是你给他一个指令
00:23:33.960 → 00:23:35.760
他就会老老实实去执行
00:23:35.760 → 00:23:37.760
他又快又便宜又稳定
00:23:39.440 → 00:23:40.880
就人想的多嘛
00:23:40.880 → 00:23:42.960
那就是你懂的
00:23:42.960 → 00:23:44.720
他推理链就比较重
00:23:44.720 → 00:23:46.120
然后还喜欢自我延伸
00:23:46.120 → 00:23:48.040
甚至把自己推理出来的东西
00:23:48.040 → 00:23:50.120
当成规则来用
00:23:50.120 → 00:23:52.080
就这种就是 overthinking
00:23:52.080 → 00:23:53.400
你过度思考之后
00:23:53.400 → 00:23:55.800
反而他的结果不理想
00:23:55.800 → 00:23:57.520
就你一件事情可能
00:23:57.520 → 00:23:59.200
并没有这么难对吧
00:23:59.200 → 00:24:01.120
你要让他在那边想什么呢
00:24:01.120 → 00:24:02.960
还要给他这么大的思考空间
00:24:03.840 → 00:24:05.320
就大部分的Agent场景
00:24:05.320 → 00:24:06.680
我不是说所有
00:24:06.680 → 00:24:07.840
大部分的Agent场景里面
00:24:07.840 → 00:24:08.920
你的指令遵循
00:24:08.920 → 00:24:11.400
其实比你的推理深度要更重要
00:24:11.400 → 00:24:13.240
这个观点可能偏主观
00:24:13.240 → 00:24:15.000
但我就是这么认为的
00:24:15.000 → 00:24:16.680
就好像你在公司里面带人的话
00:24:16.680 → 00:24:19.640
Flash他就有点像是一线的执行者
00:24:19.680 → 00:24:21.880
你给他具体的指令他就照着做
00:24:21.880 → 00:24:23.480
他反而这样不容易出错
00:24:24.320 → 00:24:26.480
他就像是一个高手一样的东西
00:24:26.480 → 00:24:27.960
你给他一个方向
00:24:27.960 → 00:24:29.160
他就自己在那边琢磨了
00:24:29.160 → 00:24:30.960
就一直琢磨怎么达成这个目标
00:24:30.960 → 00:24:32.000
他有时候确实吧
00:24:32.000 → 00:24:33.760
能给你很不错的结果
00:24:33.760 → 00:24:36.200
因为他琢磨的确实还可以
00:24:37.480 → 00:24:39.520
那有的时候他就会跑偏
00:24:39.520 → 00:24:40.400
然后越想越偏
00:24:41.200 → 00:24:42.240
这句话不用管他
00:24:42.240 → 00:24:44.800
这个应该是我掉了一个顺序
00:24:44.800 → 00:24:46.160
然后这边忘改了
00:24:46.160 → 00:24:48.000
那我们怎么做抉择呢
00:24:48.000 → 00:24:49.480
就他们之前怎么选呢
00:24:49.520 → 00:24:50.960
但主要大部分情况下
00:24:51.600 → 00:24:53.480
就你用Flash就行了
00:24:53.480 → 00:24:55.000
基本上你去做
00:24:55.000 → 00:24:56.440
tool use就调工具
00:24:56.440 → 00:24:57.800
然后或者你去执行一个任务
00:24:58.360 → 00:25:00.480
就你日常情况下用Flash就够了
00:25:00.480 → 00:25:02.520
又便宜又快又指令遵循
00:25:04.840 → 00:25:07.640
你可以主动的去做切换
00:25:10.640 → 00:25:12.480
你在这里面你就可以去
00:25:12.480 → 00:25:14.000
看你有哪一些模型
00:25:14.520 → 00:25:17.240
然后你就可以按照他给你的这个
00:25:19.480 → 00:25:20.160
然后什么怎么样
00:25:20.160 → 00:25:21.240
然后就可以换了
00:25:21.240 → 00:25:22.840
或者你要是实在不会换
00:25:22.840 → 00:25:23.720
你不可以用这个指定
00:25:24.200 → 00:25:25.960
请你帮我把模型切换成
00:25:29.040 → 00:25:30.520
比如说这个Pro呢
00:25:30.520 → 00:25:32.560
他更适合你去用他来做一些
00:25:32.560 → 00:25:34.280
有一定思考能力复杂度
00:25:34.280 → 00:25:35.680
要深度的东西
00:25:35.680 → 00:25:38.000
比如说你重新搭建一个系统框架
00:25:38.000 → 00:25:40.480
或者说你要做系统性的分析复盘
00:25:40.480 → 00:25:41.960
就本来就需要一些
00:25:41.960 → 00:25:43.560
我们深入思考的东西
00:25:43.560 → 00:25:45.880
或者说你去梳理一些复杂的逻辑
00:25:45.880 → 00:25:47.640
你需要他去想这个东西
00:25:49.960 → 00:25:51.200
你就再请他出来
00:25:52.560 → 00:25:54.240
你再主动去切吧
00:25:55.800 → 00:25:57.200
很跟大家分享这么多
00:25:57.200 → 00:25:58.880
那我们来做一个总结吧
00:25:58.880 → 00:26:00.520
首先就是DeepSeek
00:26:00.520 → 00:26:02.520
Flash做主模型
00:26:02.520 → 00:26:04.360
然后因为他在
00:26:04.360 → 00:26:05.200
多模态能力上
00:26:05.200 → 00:26:06.240
缺失,所以我们要补一个
00:26:06.240 → 00:26:08.800
多模态模型的能力
00:26:08.800 → 00:26:10.160
然后在Agent场景下
00:26:10.160 → 00:26:12.800
Flash其实是不输Pro的
00:26:12.800 → 00:26:15.560
甚至他更加的稳定
00:26:15.800 → 00:26:17.480
那本期视频就是这样了
00:26:17.480 → 00:26:19.480
如果你想看到更多
00:26:19.480 → 00:26:22.480
有关于AI 实战方面的东西
00:26:22.480 → 00:26:23.960
或者想跟我讨论
00:26:23.960 → 00:26:27.400
或者想在这方面能有更进一步的
00:26:27.400 → 00:26:29.200
思考或者怎么样的话
00:26:29.200 → 00:26:31.840
欢迎可以加入我最近
00:26:31.840 → 00:26:34.200
刚开的一个知识星球
00:26:34.200 → 00:26:35.760
就帅真 AI 实战圈
00:26:35.760 → 00:26:37.960
目前的话我每天都会在
00:26:37.960 → 00:26:39.960
群里面跟大家讨论
00:26:39.960 → 00:26:41.560
AI 相关的问题
00:26:41.560 → 00:26:42.640
包括星球里面
00:26:42.640 → 00:26:45.800
我也会做很多的内容分享
00:26:45.800 → 00:26:46.960
就实战方面的
00:26:46.960 → 00:26:48.480
包括好内容都有
00:26:48.480 → 00:26:50.960
然后我这里面就会有很多
00:26:52.080 → 00:26:53.560
就反正这里面发了
00:26:53.560 → 00:26:55.880
好多好多实战相关的
00:26:55.880 → 00:26:58.160
就我自己的一些观点也好
00:26:58.160 → 00:26:59.200
实战经验也好
00:26:59.200 → 00:27:01.080
反正就发了很多很多
00:27:01.080 → 00:27:03.800
然后群也是每天都在高强度冲浪这样
00:27:04.400 → 00:27:05.880
视频就到这吧
00:27:05.880 → 00:27:07.320
如果你喜欢本期视频的话
00:27:07.320 → 00:27:08.320
欢迎留言点赞