WEBVTT
Kind: captions
Language: zh

00:00:00.066 --> 00:00:01.966
大家好欢迎来到灵姐说AI

00:00:01.966 --> 00:00:02.766
这期视频啊

00:00:02.766 --> 00:00:05.700
跟大家分享一下如何用AI

00:00:05.700 --> 00:00:08.466
原生的方法将Claude code

00:00:08.600 --> 00:00:10.566
接入第三方的模型

00:00:10.733 --> 00:00:14.066
比如说国内的低成本的模型

00:00:14.066 --> 00:00:15.766
像Deepseek的V4

00:00:15.766 --> 00:00:18.100
大家看到这是我的Claude

00:00:18.100 --> 00:00:21.066
的桌面端的GUI界面

00:00:21.366 --> 00:00:23.000
这个是我和它的聊天

00:00:23.133 --> 00:00:24.866
这里有个很神奇的地方

00:00:24.866 --> 00:00:27.333
看一下这里的模型选择

00:00:27.766 --> 00:00:33.333
是Deepseek的V4Pro Flash各个版本的模型接入

00:00:33.500 --> 00:00:35.866
有没有一种穿越的感觉

00:00:36.200 --> 00:00:40.000
你看而且Deepseek也可以快速的给我回复

00:00:40.000 --> 00:00:42.666
并且给我高质量的答复

00:00:42.666 --> 00:00:45.166
最近我主力的运营的

00:00:45.166 --> 00:00:47.133
运行的中心是Codex

00:00:47.266 --> 00:00:51.333
它是我执行非常多落地任务的手脚

00:00:51.533 --> 00:00:53.800
我是使用GPT加Codex的

00:00:53.800 --> 00:00:55.733
方式来完成整个的loop

00:00:55.966 --> 00:00:58.333
但是呢Codex也有一些坏处

00:00:58.433 --> 00:01:00.666
我的这个模型的套餐已经

00:01:00.666 --> 00:01:03.800
开到100刀Pro Lite的这个档位了

00:01:03.800 --> 00:01:06.066
有可能马上又要升到200刀

00:01:06.200 --> 00:01:08.833
但是因为网络不是特别稳定

00:01:08.833 --> 00:01:12.666
它经常针对一些长任务会失败

00:01:13.000 --> 00:01:14.633
就是一直会出现这个

00:01:14.633 --> 00:01:16.333
reconnect这个界面啊

00:01:16.366 --> 00:01:17.466
任务经常会失败

00:01:17.466 --> 00:01:20.166
特别是网络不太稳定的时候

00:01:20.333 --> 00:01:21.200
这个时候呢

00:01:21.200 --> 00:01:22.200
我的这个

00:01:22.200 --> 00:01:23.800
用完Codex的时候呢

00:01:23.800 --> 00:01:27.433
我就需要再去用一下Claude code去回回血

00:01:27.566 --> 00:01:30.466
用Claude code去接入我的

00:01:30.466 --> 00:01:32.533
这些比较便宜一些模型

00:01:32.533 --> 00:01:35.066
这样子我就有一个左右护法了

00:01:35.233 --> 00:01:36.033
一个Codex

00:01:36.033 --> 00:01:38.266
一个Claude code加第三方模型

00:01:38.366 --> 00:01:39.466
再加上GPT

00:01:39.633 --> 00:01:43.466
让我整个的运行项目的效率变得更高

00:01:43.466 --> 00:01:44.666
有一个平衡点吧

00:01:44.666 --> 00:01:46.533
而且用起来真的挺爽的

00:01:46.533 --> 00:01:49.000
这一期我会给大家分享这个方法

00:01:49.033 --> 00:01:50.833
而且我今天分享的

00:01:50.833 --> 00:01:53.666
方法是非常AI原生化的

00:01:53.666 --> 00:01:56.933
有的人曾经在我的节目里面留言说

00:01:56.933 --> 00:02:00.366
那你都用国内的第三方的一些模型了

00:02:00.433 --> 00:02:02.933
那你还为什么要接Claude code呢

00:02:02.933 --> 00:02:04.933
这不是多此一举吗

00:02:05.233 --> 00:02:06.133
我告诉你

00:02:06.133 --> 00:02:07.200
非常有必要

00:02:07.266 --> 00:02:07.866
首先啊

00:02:07.866 --> 00:02:09.066
你用过Claude code

00:02:09.066 --> 00:02:10.466
你就知道Claude code

00:02:10.466 --> 00:02:11.600
它的Harness

00:02:11.800 --> 00:02:15.700
整个的工作流的框架是非常强的

00:02:15.900 --> 00:02:17.633
他之前不是还把自己整个

00:02:17.633 --> 00:02:19.733
托管的体系拿出来卖吗

00:02:19.800 --> 00:02:22.200
这个其实就是他的底气

00:02:22.333 --> 00:02:24.500
他里面是有一个很好

00:02:24.500 --> 00:02:26.766
的规划过的agent loop的

00:02:26.833 --> 00:02:29.600
他可以去自己去规划任务

00:02:29.633 --> 00:02:30.600
调用工具

00:02:30.666 --> 00:02:31.666
读取结果

00:02:31.666 --> 00:02:32.800
继续执行

00:02:32.833 --> 00:02:36.800
Claude code它整个的文件系统的能力

00:02:36.866 --> 00:02:40.200
包括终端的能力都是非常强的

00:02:40.300 --> 00:02:43.066
它现在整体的估值这么高

00:02:43.200 --> 00:02:45.133
每年的这个arr这么高

00:02:45.133 --> 00:02:46.500
都是有道理的

00:02:46.600 --> 00:02:47.966
它是真的强

00:02:47.966 --> 00:02:49.600
而且在Claude code这个

00:02:49.600 --> 00:02:51.466
桌面端里面的应用啊

00:02:51.666 --> 00:02:54.300
普通的知识工作者或者普通的

00:02:54.300 --> 00:02:57.500
职场人士也能够很好的去使用

00:02:57.700 --> 00:03:00.000
Codex它的桌面端引起了一个

00:03:00.233 --> 00:03:01.433
新的风潮就是

00:03:01.466 --> 00:03:02.666
其实在未来啊

00:03:02.666 --> 00:03:05.400
这个CLI的这个模式是更加先进的

00:03:05.400 --> 00:03:06.800
而且它是精确的

00:03:06.800 --> 00:03:07.800
我也非常

00:03:08.100 --> 00:03:10.833
提倡大家去使用CLI的模式

00:03:10.833 --> 00:03:12.133
但是对于大部分的

00:03:12.133 --> 00:03:14.033
普通的知识工作者而言

00:03:14.033 --> 00:03:17.066
这个GUI的模式还是大家更适应的模式

00:03:17.133 --> 00:03:19.866
而且这个Codex现在真的是非常流行

00:03:19.900 --> 00:03:20.733
大家对这样的

00:03:20.733 --> 00:03:22.866
工作方式也是比较适应的

00:03:23.066 --> 00:03:25.800
所以在Claude code的桌面端

00:03:25.866 --> 00:03:28.133
也去接入第三方的模型

00:03:28.200 --> 00:03:31.266
它中间有一个能力就是cowork

00:03:31.633 --> 00:03:34.100
CO work呢区别于Claude code

00:03:34.100 --> 00:03:35.533
就是写代码的能力

00:03:35.533 --> 00:03:38.666
它相当于是给大家普通的这种工作者

00:03:38.666 --> 00:03:42.000
也可以利用这个模型框架去

00:03:42.000 --> 00:03:45.333
解决一些具体的自主工作的问题

00:03:45.333 --> 00:03:47.700
并且能够返回完成品

00:03:47.766 --> 00:03:51.266
claude code本身会更加偏开发者终端

00:03:51.266 --> 00:03:53.333
和一些代码项目和工程项目

00:03:53.333 --> 00:03:55.933
那Claude code Cowork呢会这种

00:03:56.266 --> 00:03:58.466
集群还有蜂群的模式会

00:03:58.466 --> 00:04:01.266
更加适合普通的办公任务

00:04:01.266 --> 00:04:02.100
本地文件

00:04:02.100 --> 00:04:03.900
还有应用操作和交付成果

00:04:03.933 --> 00:04:05.433
我自己在使用的时候

00:04:05.433 --> 00:04:09.066
我觉得它的整个的Harness框架加上

00:04:09.100 --> 00:04:12.800
Deepseek V4或者类似这样的能力的模型

00:04:12.800 --> 00:04:15.233
它的整个的产出结果还是不错的

00:04:15.233 --> 00:04:18.100
而且它可以和GPT去协同

00:04:18.200 --> 00:04:21.166
它最后给出的结果GPT也认可了

00:04:21.166 --> 00:04:24.800
可见它在这样的框架下的交付能力

00:04:24.800 --> 00:04:27.100
生成结果是比较好的

00:04:27.100 --> 00:04:28.866
质量是相对高的

00:04:28.900 --> 00:04:31.500
而且我自己的使用体验下来呢

00:04:31.500 --> 00:04:32.600
我会感觉啊

00:04:32.600 --> 00:04:35.766
现在Claude code和Codex的它的

00:04:35.766 --> 00:04:38.233
整个的Harness框架是非常强的

00:04:38.366 --> 00:04:41.500
他们两家最近的动作也是最多的

00:04:41.500 --> 00:04:42.733
我有一个非常

00:04:43.300 --> 00:04:44.533
嗯超前的想象吧

00:04:44.533 --> 00:04:48.233
我觉得可以用Claude code和

00:04:48.433 --> 00:04:51.200
codex（口误）这两家的Harness框架

00:04:51.233 --> 00:04:53.033
可以把它抽取出来

00:04:53.033 --> 00:04:56.366
去调用任何一家的大模型能力

00:04:56.366 --> 00:04:58.200
我们可以把它处理成这样

00:04:58.200 --> 00:05:00.433
有了这样比较好的harness框架

00:05:00.433 --> 00:05:02.133
我们可以在顶层去

00:05:02.133 --> 00:05:05.000
调动不同厂商的大模型

00:05:05.033 --> 00:05:07.033
而且我们可以在顶层统一

00:05:07.033 --> 00:05:11.500
的去管理各个agent的skill MCP

00:05:11.633 --> 00:05:13.966
哇我觉得真的是非常多的

00:05:13.966 --> 00:05:15.600
这个可以玩的东西啊

00:05:15.966 --> 00:05:16.800
好说回来啊

00:05:16.800 --> 00:05:19.300
我再跟大家切实的去分享

00:05:19.400 --> 00:05:21.333
怎么去做这样的接入

00:05:21.333 --> 00:05:23.600
把Claude code的GUI桌面界面

00:05:23.600 --> 00:05:25.833
去接入我们的Deepseek V4

00:05:25.833 --> 00:05:27.333
我是以Deepseek为例

00:05:27.333 --> 00:05:30.466
其实各家的这个模型都是可以接入的

00:05:30.466 --> 00:05:35.166
我这里讲的AI原生的方法就是用Codex

00:05:35.466 --> 00:05:37.633
给他具体的接入文档

00:05:37.800 --> 00:05:41.066
让Codex成为手脚来帮你

00:05:41.233 --> 00:05:44.000
使用CC switch这样的工具

00:05:44.166 --> 00:05:48.333
把Claude code的Desktop的桌面端的界面

00:05:48.366 --> 00:05:51.200
接入像Deepseek阿里云或者coding plan

00:05:51.533 --> 00:05:53.800
或者其他的一些成本

00:05:53.800 --> 00:05:55.566
比较低的国内的模型

00:05:56.200 --> 00:05:57.866
这里我是给了他一个文档的

00:05:57.966 --> 00:05:59.433
给大家看一下我的这个

00:05:59.600 --> 00:06:01.733
国内模型接入的交接手册

00:06:02.066 --> 00:06:04.133
相当于这个文档是我从另外

00:06:04.200 --> 00:06:06.433
一个安装的过程中抽取出来的

00:06:06.533 --> 00:06:09.466
实际上这个交接手册这个执行的命令

00:06:09.766 --> 00:06:12.366
你也可以和GPT去沟通

00:06:12.366 --> 00:06:13.866
你跟他说我有这样的想法

00:06:13.900 --> 00:06:16.500
我要把Claude code接入这些

00:06:16.533 --> 00:06:18.300
非官方的模型应该怎么做

00:06:18.400 --> 00:06:20.666
你跟GPT对话很多轮之后

00:06:20.766 --> 00:06:24.000
让他给你给Codex的执行命令

00:06:24.266 --> 00:06:26.833
这里呢我是把我整个的安装

00:06:26.833 --> 00:06:28.966
过程抽象抽取了出来

00:06:29.100 --> 00:06:31.066
它会把那些坑都避雷掉

00:06:31.400 --> 00:06:33.433
这个另外一个人用了这个MD文档

00:06:33.500 --> 00:06:35.933
这个Markdown文档就可以直接来用了

00:06:36.000 --> 00:06:37.200
机器能够快速的识别

00:06:37.233 --> 00:06:37.966
知道上下文

00:06:38.000 --> 00:06:39.000
然后知道你的目标

00:06:39.166 --> 00:06:40.966
你看这里的试用对象

00:06:40.966 --> 00:06:43.200
就是说一台全新的Mac mini

00:06:43.300 --> 00:06:46.366
由Codex远程执行安装和配置

00:06:46.500 --> 00:06:48.833
目标是让Claude进入这样的模式

00:06:48.833 --> 00:06:52.033
通过CC switch本地路由去

00:06:52.033 --> 00:06:53.833
接入第三方的模型

00:06:53.833 --> 00:06:55.833
这个就是CC switch的界面

00:06:55.833 --> 00:06:57.233
一开始没用过的你

00:06:57.233 --> 00:06:58.466
可能都不知道怎么配

00:06:58.466 --> 00:07:02.566
Codex它本来有computer use这样的能力

00:07:02.600 --> 00:07:05.766
它可以直接帮你去配置和设置

00:07:06.000 --> 00:07:08.500
把那个模型窗口的命名设置

00:07:08.500 --> 00:07:09.966
大家刚刚看到的

00:07:09.966 --> 00:07:12.000
这里的Claude code

00:07:12.200 --> 00:07:14.766
这里的模型名称全部帮你改掉

00:07:14.900 --> 00:07:19.333
你可以是完全智能化AI原生的方式

00:07:19.566 --> 00:07:23.100
所以说这个过程才是真正的AI原生

00:07:23.333 --> 00:07:25.533
我们要想把AI用得好

00:07:25.533 --> 00:07:27.900
必须有这样的心态

00:07:28.100 --> 00:07:29.133
和这样的思路

00:07:29.133 --> 00:07:32.533
而不是再像传统的方式那样

00:07:32.533 --> 00:07:34.600
啊去哪里下载这个软件

00:07:34.600 --> 00:07:35.533
然后怎么配置

00:07:35.533 --> 00:07:36.733
一步步的跟着走

00:07:36.766 --> 00:07:37.400
你知不知道

00:07:37.400 --> 00:07:39.100
如果说中间遇到一些卡点

00:07:39.100 --> 00:07:40.333
你一步步截图

00:07:40.533 --> 00:07:41.533
跟GPT沟通

00:07:41.533 --> 00:07:42.566
或者跟其他模型沟通

00:07:42.566 --> 00:07:43.700
来来回回多少

00:07:44.066 --> 00:07:44.900
多少轮啊

00:07:44.900 --> 00:07:46.333
这里你用computeruse

00:07:46.566 --> 00:07:49.333
用Codex就直接帮你搞定了

00:07:49.333 --> 00:07:50.533
会非常爽

00:07:50.533 --> 00:07:52.733
给大家快速的看一下这个文档啊

00:07:53.000 --> 00:07:54.500
首先会讲讲最终的效果

00:07:54.500 --> 00:07:55.666
要达到的目标

00:07:55.733 --> 00:07:58.866
然后Mac mini的前置条件然后呢

00:07:58.866 --> 00:08:02.500
接着呢就要安装这个Claude code的桌面端

00:08:02.533 --> 00:08:04.733
啊然后要安装CC switch

00:08:04.933 --> 00:08:08.000
下面是怎么写入这个Deepseek的配置

00:08:08.133 --> 00:08:09.400
啊你看

00:08:09.500 --> 00:08:10.966
只要把这个文档丢给他

00:08:10.966 --> 00:08:12.800
我觉得哪怕你的电脑

00:08:12.800 --> 00:08:14.300
配置和我的不一样

00:08:14.400 --> 00:08:16.200
你也可以快速的完成

00:08:16.566 --> 00:08:17.533
即便没有

00:08:17.533 --> 00:08:20.700
你和GPT沟通出来也会有

00:08:20.700 --> 00:08:23.400
只不过说轮次多一点

00:08:23.500 --> 00:08:24.366
卡点多一点

00:08:24.366 --> 00:08:28.800
但是都比你那种原来传统的这种

00:08:28.800 --> 00:08:32.500
安装方式或者是接入方式要省事的多

00:08:32.500 --> 00:08:35.400
大家看一下我和Codex的沟通界面啊

00:08:35.966 --> 00:08:38.133
你看我就给他了这个文档

00:08:38.200 --> 00:08:40.066
然后我让他参考我

00:08:40.066 --> 00:08:41.666
这个文档来给我安装

00:08:41.866 --> 00:08:46.400
一开始我让它安装的是呃coding plan

00:08:46.400 --> 00:08:47.566
阿里云的coding plan（口误）

00:08:47.600 --> 00:08:49.466
但是coding plan（口误）它有个问题啊

00:08:49.466 --> 00:08:52.200
因为它是用来写code的所以呢

00:08:52.200 --> 00:08:54.733
就是它是没有实时的搜索能力的

00:08:54.733 --> 00:08:55.733
大家可以看到

00:08:55.800 --> 00:08:58.200
这个其实就是Coding plan（口误）

00:08:58.200 --> 00:09:00.466
的本身的这个回复你看

00:09:00.500 --> 00:09:03.533
我问的是特朗普2026年的访华

00:09:03.533 --> 00:09:05.966
你看他告诉我他的数据是

00:09:06.300 --> 00:09:08.733
截至2025年5月的

00:09:08.733 --> 00:09:10.400
但是我接入Deepseek之后

00:09:10.400 --> 00:09:13.133
它其实它是有实时搜索能力的

00:09:13.300 --> 00:09:13.666
啊

00:09:13.666 --> 00:09:18.200
所以说这个方法就会非常的AI原生化

00:09:18.200 --> 00:09:20.066
我这里只是举了一个例子

00:09:20.066 --> 00:09:23.200
实际上大家在日常的工作生活

00:09:23.200 --> 00:09:26.933
中应该想办法把自己的所有的

00:09:27.333 --> 00:09:30.800
工作的模块都尽可能的AI原生化

00:09:30.800 --> 00:09:32.166
这个AI原生是说是你

00:09:32.166 --> 00:09:33.800
一个互相交互的东西

00:09:33.933 --> 00:09:36.200
你既要把你知道的去交给他

00:09:36.200 --> 00:09:37.600
让他知道你的状态

00:09:37.700 --> 00:09:41.866
也要尽量避免自己直接输入东西

00:09:42.000 --> 00:09:42.900
那说错了

00:09:42.900 --> 00:09:44.466
直接输出东西

00:09:44.866 --> 00:09:49.066
就是你要尽量让输出是AI给你的

00:09:49.100 --> 00:09:51.933
然后这个AI给你的东西你再交给

00:09:52.200 --> 00:09:53.800
这个另一个AI

00:09:53.900 --> 00:09:55.900
AI之间它们互相的这个

00:09:55.900 --> 00:09:57.766
可理解性比你更强

00:09:57.933 --> 00:10:00.333
长期这样的培养之后

00:10:00.500 --> 00:10:03.533
你的AI的思维会很强

00:10:03.533 --> 00:10:06.200
你会更能和AI对话

00:10:06.266 --> 00:10:08.200
你看这里对话就一轮

00:10:08.500 --> 00:10:09.866
好我给它那个文档

00:10:10.066 --> 00:10:12.766
后面我要做的就是给他我阿里云的

00:10:12.766 --> 00:10:15.600
CODING plan的API key啊API key这里要打码

00:10:15.600 --> 00:10:17.133
后面他这里就告诉我啊

00:10:17.133 --> 00:10:20.266
我的阿里云的Claude的coding

00:10:20.266 --> 00:10:21.766
plan已经接入成功了

00:10:21.766 --> 00:10:22.833
这里告诉我了

00:10:22.833 --> 00:10:25.566
然后呢但是当时我直接用的时候

00:10:25.566 --> 00:10:27.366
我发现它会有一些小bug

00:10:27.366 --> 00:10:29.766
比如说它这里的这个名字

00:10:29.933 --> 00:10:31.133
这里是没有改的

00:10:31.133 --> 00:10:33.066
然后呢我这个反馈给它

00:10:33.500 --> 00:10:36.466
同时我就直接启动了这个computeruse

00:10:36.800 --> 00:10:39.333
它就直接帮我选项接入

00:10:39.333 --> 00:10:39.933
你要知道

00:10:39.933 --> 00:10:42.733
如果说没有Codex这样的辅助

00:10:42.800 --> 00:10:46.700
你走到这个接入的界面有多难

00:10:46.700 --> 00:10:49.866
有可能一个卡点就能卡你非常久

00:10:49.866 --> 00:10:52.800
大家现在看到的界面就是

00:10:52.800 --> 00:10:57.133
computeruse通过CC switch的设置来

00:10:57.133 --> 00:11:00.700
接入claude桌面端的整个过程

00:11:00.833 --> 00:11:02.000
然后很快的

00:11:02.100 --> 00:11:04.600
阿里云的CODING plan我接入完成之后

00:11:04.600 --> 00:11:07.466
我接着给他的是Deepseek的API key

00:11:07.633 --> 00:11:09.100
API key这里还是要打一下码

00:11:09.266 --> 00:11:12.466
然后呢Deepseek的V4的模型也接入成功了

00:11:12.866 --> 00:11:13.533
特别爽啊

00:11:13.533 --> 00:11:16.066
我觉得以后大家在处理问题的时候都

00:11:16.066 --> 00:11:19.300
要保持这样的AI原生的思路和思维

00:11:19.433 --> 00:11:19.900
然后呢

00:11:19.900 --> 00:11:24.200
我再把我这一轮的呃动作再抽象一下

00:11:24.233 --> 00:11:24.800
这样子呢

00:11:24.800 --> 00:11:28.133
我就形成了一个新的指南就是把

00:11:28.433 --> 00:11:31.033
前一版的文档没有抽取到

00:11:31.033 --> 00:11:32.800
没有覆盖到的东西

00:11:32.900 --> 00:11:34.800
我再把它抽取出来

00:11:34.800 --> 00:11:37.500
形成了一个更加完整的手册

00:11:37.533 --> 00:11:39.900
你看它的清晰度就会更高了

00:11:40.000 --> 00:11:42.466
而这一版的MD的文档

00:11:42.600 --> 00:11:45.733
在交接给下一个人来安装

00:11:45.900 --> 00:11:48.000
国内模型的接入的时候

00:11:48.000 --> 00:11:51.000
它中间遇到的卡点会更少

00:11:51.000 --> 00:11:53.900
这个就是不断迭代的一个过程

00:11:53.933 --> 00:11:55.666
怎么样我介绍的这个方法

00:11:55.666 --> 00:11:57.800
是不是特别的轻量级

00:11:57.933 --> 00:11:59.633
相关的文档可以到我的

00:11:59.633 --> 00:12:01.466
同名公众号里面去找

00:12:01.733 --> 00:12:04.133
而且我相信这种桌面终端

00:12:04.133 --> 00:12:06.966
也是大部分人都能够接受

00:12:06.966 --> 00:12:09.333
并且快速上手的一种方式

00:12:09.433 --> 00:12:11.433
国内的模型确实便宜

00:12:11.433 --> 00:12:12.966
我调用了好多轮

00:12:13.100 --> 00:12:14.033
用了半天

00:12:14.033 --> 00:12:16.633
Deepseek上面API接口才花了10块钱

00:12:16.666 --> 00:12:17.833
赶紧去试试吧

00:12:17.900 --> 00:12:19.666
记得订阅灵姐说AI

00:12:19.666 --> 00:12:22.033
给我的节目点赞评论

00:12:22.066 --> 00:12:24.133
我们下期再见了拜拜

