WEBVTT
Kind: captions
Language: zh-Hans

00:00:00.000 --> 00:00:03.100
大家好 我是墨端 欢迎来到科技梦星云

00:00:03.100 --> 00:00:09.100
这期主要讲的是使用 Ollama 或者 cc-switch 免费使用 Claude Code

00:00:09.100 --> 00:00:13.000
Claude 加 Ollama 就像是《山海经》里的禺强

00:00:13.000 --> 00:00:18.400
那货是海神兼风神 人面鸟身 脚踩两条青蛇

00:00:18.400 --> 00:00:21.600
似乎和李淳罡的两袖青蛇有一些关系

00:00:21.600 --> 00:00:24.400
它掌管北海呼风唤雨无所不能

00:00:24.400 --> 00:00:29.000
Claude 加 Ollama 出代码稳、快、能堪事

00:00:29.000 --> 00:00:32.200
cc-switch 就像是《山海经》里的天吴

00:00:32.200 --> 00:00:35.200
八头人面 八足八尾 是水伯

00:00:35.200 --> 00:00:38.300
专门负责疏通水路 连接各方

00:00:38.300 --> 00:00:41.600
有时候魔法阻止了 访问不了 Claude Code

00:00:41.600 --> 00:00:44.300
天吴能帮你在分流里把路接通

00:00:44.300 --> 00:00:46.100
视频推荐机制 创作不易

00:00:46.100 --> 00:00:48.100
请点赞订阅支持我的创作

00:00:48.100 --> 00:00:50.500
首先 该配的环境还是要配的

00:00:50.500 --> 00:00:53.500
你需要确保你本地已经安装了 git 命令行

00:00:53.500 --> 00:00:56.400
在 Mac 上你可以直接用 brew 安装

00:00:56.400 --> 00:00:57.600
当然无论是什么系统

00:00:57.600 --> 00:01:00.900
你都可以直接到它的官网上去下载安装

00:01:00.900 --> 00:01:02.800
点这个按钮在这里

00:01:02.800 --> 00:01:06.300
就可以选择其他的系统进行安装了

00:01:06.300 --> 00:01:08.500
如果是 macOS 就选这个

00:01:08.500 --> 00:01:11.100
它本身推荐的也是用 brew 进行安装

00:01:11.100 --> 00:01:13.500
如果是 Windows 点这里下载

00:01:13.500 --> 00:01:15.200
或者用这个命令安装

00:01:15.200 --> 00:01:17.700
如果是 Windows 下载安装

00:01:17.700 --> 00:01:19.700
尽量要在这两个里面选

00:01:19.700 --> 00:01:22.000
说白了就是尽量要选 Standalone

00:01:22.000 --> 00:01:23.200
装好了以后

00:01:23.300 --> 00:01:25.300
用这个命令看到版本

00:01:25.300 --> 00:01:26.700
就是安装成功了

00:01:26.700 --> 00:01:28.300
然后你会需要 Ollama

00:01:28.300 --> 00:01:30.300
它会提供免费的 AI 模型

00:01:30.300 --> 00:01:33.100
安装也很容易直接到它的官网上去

00:01:33.100 --> 00:01:35.100
可以用这个命令安装

00:01:35.100 --> 00:01:36.700
也可以下載安裝

00:01:36.700 --> 00:01:39.100
安装好以后直接用这个命令

00:01:39.100 --> 00:01:41.900
能看到版本号就说明安装是成功的

00:01:41.900 --> 00:01:44.100
接下来你会需要安装 Claude Code

00:01:44.100 --> 00:01:47.200
到它的官网去用這個命令進行安裝

00:01:47.200 --> 00:01:50.400
如果是 Windows 必须在 PowerShell 里面

00:01:50.400 --> 00:01:52.000
用这个命令进行安装

00:01:52.000 --> 00:01:53.800
你也可以在这个按钮底下

00:01:53.800 --> 00:01:56.200
找到它的 desktop 下载安装

00:01:56.200 --> 00:01:58.300
安装好以后用这个命令

00:01:58.300 --> 00:02:00.700
查看一下有版本号就是安装成功了

00:02:00.700 --> 00:02:02.800
另外说一下 cc-switch

00:02:02.800 --> 00:02:04.500
它不是一个 AI 模型

00:02:04.500 --> 00:02:06.800
它实际上是给 Claude Code

00:02:06.800 --> 00:02:07.600
Codex

00:02:07.600 --> 00:02:08.800
OpenRouter

00:02:08.800 --> 00:02:09.800
千问

00:02:09.800 --> 00:02:10.900
Kimi

00:02:10.900 --> 00:02:11.800
MiniMax

00:02:11.800 --> 00:02:12.400
等

00:02:12.400 --> 00:02:14.300
提供的一个管理器

00:02:14.300 --> 00:02:18.200
它主要是给受魔法限制的小伙伴使用的

00:02:18.200 --> 00:02:20.600
它有中文解释点一下中文

00:02:20.600 --> 00:02:23.000
这样看上去就顺眼多了

00:02:23.000 --> 00:02:25.900
它还能帮你管理 OpenRouter 和 Hermes

00:02:25.900 --> 00:02:28.400
这是它的官网点进去看一下

00:02:28.400 --> 00:02:31.200
在官网上面直接有提供稳定版的下载

00:02:31.200 --> 00:02:33.200
在官网上面可以看到它的大体功能

00:02:33.200 --> 00:02:36.400
这里有 Provider 管理、本地路由和使用统计

00:02:36.400 --> 00:02:39.400
本地路由就是我们一定会用到的东西

00:02:39.400 --> 00:02:41.300
cc-switch 需要下载安装

00:02:41.300 --> 00:02:43.000
你可以在这里直接下载

00:02:43.000 --> 00:02:44.500
也可以回到它的 GitHub

00:02:44.500 --> 00:02:45.900
点一下它的仓库名

00:02:45.900 --> 00:02:48.000
在右边栏点一下 Release

00:02:48.000 --> 00:02:49.600
进来以后直接拉到底

00:02:49.600 --> 00:02:51.300
这些就是它可以下载的软件

00:02:51.300 --> 00:02:53.000
选择自己对应的系统

00:02:53.000 --> 00:02:54.100
下载安装就好

00:02:54.100 --> 00:02:55.700
比如说我是 Mac 我就选这个

00:02:55.700 --> 00:02:57.000
下载以后打开

00:02:57.000 --> 00:02:59.500
把它拖进 Applications

00:02:59.500 --> 00:03:01.000
然后就可以打开它了

00:03:01.000 --> 00:03:03.000
打开的时候会看到这个欢迎页

00:03:03.000 --> 00:03:05.000
直接点 Got it 就不用管它了

00:03:05.000 --> 00:03:07.600
打开以后就可以看见 cc-switch

00:03:07.600 --> 00:03:09.700
自带对 Claude Code 的支持

00:03:09.700 --> 00:03:10.600
这个先放一边

00:03:10.600 --> 00:03:12.100
要免费使用 Claude Code

00:03:12.100 --> 00:03:14.000
依旧要使用模型

00:03:14.000 --> 00:03:16.500
我们会用 Ollama 提供免费的 AI 模型

00:03:16.500 --> 00:03:19.200
但问题是哪一个模型才真正适合你呢

00:03:19.200 --> 00:03:21.900
首先你需要查看你电脑的硬件信息

00:03:21.900 --> 00:03:24.500
在 Mac 上就用这个命令查看一下就好了

00:03:24.500 --> 00:03:27.100
你有了你电脑的基本硬件信息

00:03:27.100 --> 00:03:29.200
就可以到这个网站这里

00:03:29.200 --> 00:03:31.000
这个网站就是帮你挑模型的

00:03:31.000 --> 00:03:33.100
首先要选一下 GPU

00:03:33.100 --> 00:03:34.400
这个怎么也绕不过

00:03:34.400 --> 00:03:36.300
点一下选择对应的类型

00:03:36.300 --> 00:03:38.000
如果你是苹果就选这个

00:03:38.000 --> 00:03:40.200
然后选自己对应的 GPU

00:03:40.200 --> 00:03:41.400
我是 M2 Pro

00:03:41.400 --> 00:03:42.600
内存 16G

00:03:42.600 --> 00:03:47.000
因为我们要让 Ollama 能够提供 AI 模型给 Claude Code

00:03:47.100 --> 00:03:50.100
它要求最低的上下文是 32K

00:03:50.100 --> 00:03:53.200
顺便说一下我这个内存为什么会选 16G

00:03:53.200 --> 00:03:54.400
因为它没得选

00:03:54.400 --> 00:03:56.200
而且 Mac 本身是集显

00:03:56.200 --> 00:03:57.700
它内存一共就 16G

00:03:57.700 --> 00:04:01.200
也就是说这 16G 不是像独立 GPU 那样

00:04:01.200 --> 00:04:03.100
可以全部用来跑模型的

00:04:03.100 --> 00:04:05.300
这些选好以后下面就会出现

00:04:05.300 --> 00:04:07.300
跑得很好的各种模型

00:04:07.300 --> 00:04:08.400
也就是说在这里

00:04:08.400 --> 00:04:11.700
就可以找到适合于你电脑的 AI 模型了

00:04:11.700 --> 00:04:13.200
当然因为是 Mac

00:04:13.200 --> 00:04:16.600
所以能用的都是比较旧比较小的模型

00:04:16.600 --> 00:04:18.800
一般情况下尽量选择靠上面的

00:04:18.800 --> 00:04:20.700
也就是这些靠前的

00:04:20.700 --> 00:04:23.300
相对来说评分比较高，性能也比较好

00:04:23.300 --> 00:04:23.700
当然了

00:04:23.700 --> 00:04:26.800
因为 Mac 的性能是有一些限制的

00:04:26.800 --> 00:04:30.600
我会把上下文改为 16K

00:04:30.600 --> 00:04:32.700
试着使用一下 phi4

00:04:32.700 --> 00:04:35.900
但是 phi4 跑起来会很慢

00:04:35.900 --> 00:04:36.900
它本身是不错的

00:04:36.900 --> 00:04:38.500
是微软出品的

00:04:38.500 --> 00:04:42.200
另外 Ollama 自己本身也是有推荐的模型的

00:04:42.200 --> 00:04:46.500
主要是千问 3.5 和智谱 5 还有 Kimi 2.5

00:04:46.600 --> 00:04:48.100
后缀有这个 Cloud

00:04:48.100 --> 00:04:49.500
说明它是云端版的

00:04:49.500 --> 00:04:51.400
知道要下什么模型以后

00:04:51.400 --> 00:04:54.000
就可以到 Ollama 上点一下 Models

00:04:54.000 --> 00:04:56.000
开始搜对应的模型

00:04:56.000 --> 00:04:58.700
比如我们搜一个 GLM 5 的模型

00:04:58.700 --> 00:04:59.800
输一下 GLM

00:04:59.800 --> 00:05:01.100
点 GLM 5

00:05:01.100 --> 00:05:04.100
这样就可以下载它对应的模型了

00:05:04.100 --> 00:05:06.000
AI 的模型是有两种

00:05:06.000 --> 00:05:08.200
我们看一下千问

00:05:08.200 --> 00:05:09.700
以千问 3.5 为例

00:05:09.700 --> 00:05:13.200
如果你看到它后面这里是 Text and Image

00:05:13.200 --> 00:05:14.700
这个是多模态的模型

00:05:14.700 --> 00:05:15.700
它支持图形

00:05:15.700 --> 00:05:16.900
也支持聊天

00:05:16.900 --> 00:05:18.900
如果后面就单独是 Text

00:05:18.900 --> 00:05:21.300
那这个模型就只是一个聊天模型

00:05:21.300 --> 00:05:22.200
可以用来写代码

00:05:22.200 --> 00:05:23.500
但是它不是多模态的

00:05:23.500 --> 00:05:25.100
那怎么下载模型呢

00:05:25.100 --> 00:05:26.200
就比如说

00:05:26.200 --> 00:05:28.700
我们想用千问 3.5 4B的这一个

00:05:28.700 --> 00:05:29.400
点进去

00:05:29.400 --> 00:05:31.400
这个就是它的下载命令了

00:05:31.400 --> 00:05:32.100
复制一下

00:05:32.100 --> 00:05:34.700
粘贴到终端就可以把它下载下来

00:05:34.700 --> 00:05:35.900
顺便说一下

00:05:35.900 --> 00:05:38.400
如果你想下载并直接开始运行

00:05:38.400 --> 00:05:39.700
就使用 run 命令

00:05:39.700 --> 00:05:42.700
如果你只是想下载就使用 pull 命令

00:05:42.700 --> 00:05:45.100
我本地是已经有一些模型了

00:05:45.100 --> 00:05:46.600
用 ollama list

00:05:46.600 --> 00:05:48.100
给大家看一下

00:05:48.100 --> 00:05:50.100
我本地是下了这两个模型

00:05:50.100 --> 00:05:51.900
像这样的云端的模型

00:05:51.900 --> 00:05:53.700
它是有使用限制的

00:05:53.700 --> 00:05:54.800
毕竟免费嘛

00:05:54.800 --> 00:05:56.200
常看我视频的小伙伴知道

00:05:56.200 --> 00:05:57.800
我视频主打的是不花钱

00:05:57.800 --> 00:05:59.600
如何查看限制条件呢

00:05:59.600 --> 00:06:01.000
你需要一个账号

00:06:01.000 --> 00:06:02.700
登录到它的官网

00:06:02.700 --> 00:06:03.900
点用户按钮

00:06:03.900 --> 00:06:04.900
点一下设置

00:06:04.900 --> 00:06:06.600
进来以后就可以看到

00:06:06.600 --> 00:06:08.300
这是一个免费的账户

00:06:08.300 --> 00:06:10.500
这是每个 Session 的限制

00:06:10.500 --> 00:06:12.000
这是每个星期的限制

00:06:12.000 --> 00:06:14.400
对于使用 Ollama 本地模型来说

00:06:14.400 --> 00:06:16.000
是不需要 API Key 的

00:06:16.000 --> 00:06:17.600
但是如果你一定想要一个

00:06:17.600 --> 00:06:19.200
也可以到这里来搞一下

00:06:19.200 --> 00:06:20.100
点一下 Keys

00:06:20.100 --> 00:06:22.300
进去以后自己设一个就是了

00:06:22.300 --> 00:06:24.000
记得复制粘贴保存到一个

00:06:24.000 --> 00:06:26.600
你本地等会儿方便你复制粘贴的地方

00:06:26.600 --> 00:06:27.800
但是如果有的时候

00:06:27.800 --> 00:06:29.500
你的工程量特别大

00:06:29.500 --> 00:06:32.600
云端模型免费的额度已经满了

00:06:32.600 --> 00:06:33.200
怎么办呢

00:06:33.200 --> 00:06:34.500
你可以换一个账号

00:06:34.500 --> 00:06:37.400
注册账号需要手机验证

00:06:37.400 --> 00:06:38.900
你可以到这个网站来

00:06:38.900 --> 00:06:40.800
这里有很多这种免费的手机号

00:06:40.800 --> 00:06:41.900
可以帮你接码

00:06:41.900 --> 00:06:44.600
但是这不是一个稳妥的方案

00:06:44.600 --> 00:06:47.400
它的成功率是有一定概率的

00:06:47.400 --> 00:06:50.400
主要取决于它第二次的验证

00:06:50.400 --> 00:06:51.400
用的是什么

00:06:51.400 --> 00:06:53.500
它第二次验证如果用的是手机

00:06:53.500 --> 00:06:56.000
那你就只能等过几天再试了

00:06:56.000 --> 00:06:57.900
如果它第二次验证用的是邮箱

00:06:57.900 --> 00:06:59.000
那就没问题了

00:06:59.000 --> 00:07:00.600
这看大家喜好了

00:07:00.600 --> 00:07:03.900
反正这些都是免费的临时手机号

00:07:03.900 --> 00:07:05.900
基础的配置就讲完了

00:07:05.900 --> 00:07:09.000
现在看一下如何直接使用

00:07:09.000 --> 00:07:11.900
Ollama 的命令来启动 Claude Code

00:07:11.900 --> 00:07:13.800
这样 Claude Code 就可以使用 Ollama

00:07:13.800 --> 00:07:15.800
提供的免费的 AI 模型

00:07:15.800 --> 00:07:18.000
希望你已经安装好了 Claude Code

00:07:18.000 --> 00:07:19.600
Mac 是这个命令

00:07:19.600 --> 00:07:23.100
Windows 必须在 PowerShell 底下用这个命令

00:07:23.100 --> 00:07:25.000
链接的话可以去博客里找

00:07:25.000 --> 00:07:27.500
要让 Claude Code 使用 Ollama 也很简单

00:07:27.500 --> 00:07:28.800
直接使用这个命令

00:07:28.800 --> 00:07:29.700
复制一下

00:07:29.700 --> 00:07:32.000
如果你想用特定的模型

00:07:32.000 --> 00:07:33.500
也可以使用这个命令

00:07:33.500 --> 00:07:34.600
这个命令的後半部分

00:07:34.600 --> 00:07:36.900
就规定了要使用的模型

00:07:36.900 --> 00:07:38.100
另外 Ollama 的官方

00:07:38.100 --> 00:07:40.200
还有一些推荐的模型

00:07:40.200 --> 00:07:43.200
另外如果你想要直接使用 Claude Code

00:07:43.200 --> 00:07:44.800
不想要交互的话

00:07:44.800 --> 00:07:46.400
你可以使用这个命令

00:07:46.400 --> 00:07:48.600
在它的後半部分就是问题

00:07:48.600 --> 00:07:52.000
另外关于想要循环执行某一个任务

00:07:52.000 --> 00:07:54.800
Claude Code 是有这样一个 loop 命令的

00:07:54.800 --> 00:07:56.300
以这个为例

00:07:56.300 --> 00:07:57.600
输入 loop 命令

00:07:57.600 --> 00:07:59.300
循环的时间是 30 分钟

00:07:59.300 --> 00:08:02.700
也就是说每 30 分钟会执行一下 loop 命令

00:08:02.700 --> 00:08:04.100
这命令要干什么呢

00:08:04.100 --> 00:08:05.000
最后这个部分

00:08:05.000 --> 00:08:08.400
就是告诉 loop 命令要做什么

00:08:08.400 --> 00:08:10.100
也就是说每 30 分钟

00:08:10.100 --> 00:08:11.900
会查看一下 pull request

00:08:11.900 --> 00:08:13.900
然后总结一下它们的状态

00:08:13.900 --> 00:08:14.800
再看下

00:08:14.800 --> 00:08:15.600
使用这个命令

00:08:15.600 --> 00:08:18.000
你还可以从外部来控制 Claude Code

00:08:18.000 --> 00:08:21.300
比如说从 Telegram 来控制 Claude Code

00:08:21.300 --> 00:08:24.600
如果你不想从 Ollama 启动 Claude Code

00:08:24.600 --> 00:08:26.400
你也可以去配置环境变量

00:08:26.400 --> 00:08:28.100
然后直接用 claude 的命令

00:08:28.100 --> 00:08:31.100
加 Ollama 模型的名字来启动

00:08:31.100 --> 00:08:34.600
这样 Claude Code 也会使用本地 Ollama 的模型

00:08:34.600 --> 00:08:36.800
当然除 Claude Code 以外

00:08:36.800 --> 00:08:41.000
Ollama 还支持其他的这些 AI 的编程工具

00:08:41.000 --> 00:08:42.500
像这个 Open Interpreter

00:08:42.500 --> 00:08:44.800
它和 Claude Code 非常像

00:08:44.800 --> 00:08:46.300
其实这些都很像

00:08:46.300 --> 00:08:48.300
你会了一个，其他都差不多

00:08:48.300 --> 00:08:51.500
使用 Ollama 启动 Claude Code 的一个好处

00:08:51.500 --> 00:08:54.400
就是你可以不用去写这些环境变量

00:08:54.400 --> 00:08:55.200
先复制

00:08:55.200 --> 00:08:58.400
这个 Ollama 启动 Claude Code 的命令

00:08:58.400 --> 00:09:00.100
用这个命令

00:09:00.100 --> 00:09:02.000
创建一个新的文件夹

00:09:02.000 --> 00:09:04.300
然后进入这个文件夹

00:09:04.400 --> 00:09:06.100
粘贴刚才的启动命令

00:09:06.100 --> 00:09:07.500
如果你只是想配置

00:09:07.500 --> 00:09:10.700
而不是想直接启动 Claude Code

00:09:10.700 --> 00:09:13.200
在后面可以加上 config 的后缀

00:09:13.200 --> 00:09:14.400
按一下回车

00:09:14.400 --> 00:09:15.700
进去以后就可以看见

00:09:15.700 --> 00:09:17.200
它只是帮你配置

00:09:17.200 --> 00:09:18.500
用了这个 config 命令

00:09:18.500 --> 00:09:21.400
它是只配置不运行 Claude Code

00:09:21.400 --> 00:09:23.400
进来就是帮你选一下模型

00:09:23.400 --> 00:09:25.500
上面部分是它推荐的模型

00:09:25.500 --> 00:09:27.500
下面这个是我下载本地的一个模型

00:09:27.500 --> 00:09:29.800
因为我需要使用 Claude Code

00:09:29.800 --> 00:09:31.600
所以按 ESC 退出

00:09:31.700 --> 00:09:33.500
用这个命令直接让 Ollama

00:09:33.500 --> 00:09:34.700
把 Claude Code 跑起来

00:09:34.700 --> 00:09:35.500
按回车

00:09:35.500 --> 00:09:37.500
第一步依旧是配置模型

00:09:37.500 --> 00:09:38.800
Gemma 4 是不错的

00:09:38.800 --> 00:09:40.400
但是它本地模型跑不起来

00:09:40.400 --> 00:09:41.200
支持有限

00:09:41.200 --> 00:09:42.900
要用也只能用云端

00:09:42.900 --> 00:09:44.800
但是云端的版本也要看

00:09:44.800 --> 00:09:49.500
就比如说我们选这个千问 3.5、GLM

00:09:49.500 --> 00:09:51.500
或者 Kimi

00:09:51.500 --> 00:09:54.800
你会看到它后面都有这个 Upgrade Required 的字样

00:09:54.800 --> 00:09:56.300
这个都是要付费的

00:09:56.300 --> 00:10:00.200
免费的云端只能选 Nemotron 3 和 Gemma 4

00:10:00.200 --> 00:10:02.000
再来这里看一下

00:10:02.000 --> 00:10:04.900
在选模型的网站上可以看到 Nemotron

00:10:04.900 --> 00:10:06.800
因此我们就选这个 Nemotron 吧

00:10:06.800 --> 00:10:09.200
phi4 的话会很慢很慢

00:10:09.200 --> 00:10:09.800
按回车

00:10:09.800 --> 00:10:11.400
选择相信这个 folder

00:10:11.400 --> 00:10:13.900
在这里你就会看到 Claude Code

00:10:13.900 --> 00:10:16.200
现在使用的是 Nemotron 的模型

00:10:16.200 --> 00:10:17.800
输入一下 skills 命令

00:10:17.800 --> 00:10:20.500
这里可以看到 Frontend Design 这个 skill

00:10:20.500 --> 00:10:22.100
这说明这一个 Claude Code

00:10:22.100 --> 00:10:24.000
依旧是我之前用的那个 Claude Code

00:10:24.000 --> 00:10:25.400
按 ESC 退出

00:10:25.400 --> 00:10:27.300
我已经处理了验证警告

00:10:27.300 --> 00:10:28.300
要怎么处理呢

00:10:28.300 --> 00:10:29.500
先 logout 一下

00:10:29.600 --> 00:10:30.400
按回车

00:10:30.400 --> 00:10:31.600
退出以后

00:10:31.600 --> 00:10:33.000
用 unset 命令

00:10:33.000 --> 00:10:35.800
把 Anthropic 的 Token 去掉

00:10:35.800 --> 00:10:37.300
然后再用 Ollama 命令

00:10:37.300 --> 00:10:38.800
把 Claude Code 跑起来

00:10:38.800 --> 00:10:39.600
跑起来之后

00:10:39.600 --> 00:10:41.400
会需要做一点简单的设置

00:10:41.400 --> 00:10:43.700
基本就是按照它推荐的走就行了

00:10:43.700 --> 00:10:44.800
我是已经做好了

00:10:44.800 --> 00:10:47.200
现在启动是正常启动

00:10:47.200 --> 00:10:48.700
启动以后选模型

00:10:48.700 --> 00:10:51.400
终端样式选自动，按回车继续

00:10:51.400 --> 00:10:53.200
使用它推荐的设置

00:10:53.200 --> 00:10:55.400
这样就没有验证冲突了

00:10:55.400 --> 00:10:57.300
然后我可以给提示词

00:10:57.300 --> 00:10:59.600
如果提示词太长可以按 Ctrl-G

00:10:59.600 --> 00:11:03.000
这样就可以在 VS Code 里面进行编辑

00:11:03.000 --> 00:11:05.700
给一个提示词保存一下关掉

00:11:05.700 --> 00:11:09.300
它就会自动把它回弹到 Claude Code 里面

00:11:09.300 --> 00:11:11.200
按回车它就会开始执行

00:11:11.200 --> 00:11:13.900
稍等一下它已经开始运行了

00:11:13.900 --> 00:11:15.700
这个 Token 怎么飙都不怕了

00:11:15.700 --> 00:11:18.500
反正在本地用的是免费模型

00:11:18.500 --> 00:11:19.700
开始做配置了

00:11:19.700 --> 00:11:20.700
稍等一下

00:11:20.700 --> 00:11:23.600
这样似乎就是好了

00:11:23.600 --> 00:11:28.100
我们到本地用 storybook 命令启动它一下

00:11:28.100 --> 00:11:28.900
按回车

00:11:28.900 --> 00:11:32.200
这样就可以看见它做的这样一个组件库

00:11:32.200 --> 00:11:35.700
指上去以后会有 ABC 三个子按钮

00:11:35.700 --> 00:11:36.300
很不幸

00:11:36.300 --> 00:11:37.800
即便是这样一个小任务

00:11:37.800 --> 00:11:41.300
也已经把今天能用的免费额度给用完了

00:11:41.300 --> 00:11:43.500
如果用 Ollama 的云端模型

00:11:43.500 --> 00:11:46.300
它确实是会有免费额度的限制

00:11:46.300 --> 00:11:48.400
今天用完了等明天吧

00:11:48.400 --> 00:11:50.300
之前用的是云端的模型

00:11:50.300 --> 00:11:53.100
现在来用一下本地的模型

00:11:53.200 --> 00:11:55.500
用这个命令打开 Claude Code

00:11:55.500 --> 00:11:57.100
直接选 phi4

00:11:57.100 --> 00:11:58.200
这是一个本地模型

00:11:58.200 --> 00:11:59.600
也就是这个模型

00:11:59.600 --> 00:12:01.500
进来以后可以看到模型就是 phi4

00:12:01.500 --> 00:12:03.700
问一下它会写代码吗

00:12:03.700 --> 00:12:04.800
直接报错

00:12:04.800 --> 00:12:06.100
这是 400 错误

00:12:06.100 --> 00:12:08.500
说不能支持工具的调用

00:12:08.500 --> 00:12:11.400
因为 Claude Code 一定要求工具的调用

00:12:11.400 --> 00:12:13.500
像我们上一个用的这个 Nemotron

00:12:13.500 --> 00:12:15.100
它就是支持工具调用的

00:12:15.100 --> 00:12:18.700
而 Claude Code 是强制要求一定要有工具调用的

00:12:18.700 --> 00:12:20.500
因此用 phi4 是不行的

00:12:20.500 --> 00:12:21.700
既然 phi4 没有用

00:12:21.700 --> 00:12:23.300
我们就 logout 一下

00:12:23.300 --> 00:12:25.600
用这个命令把 phi4 移除掉

00:12:25.600 --> 00:12:26.800
因为不需要了

00:12:26.800 --> 00:12:28.300
用这个命令看一下

00:12:28.300 --> 00:12:30.700
本地还有什么其他的模型

00:12:30.700 --> 00:12:32.400
像 GLM-4-Cloud

00:12:32.400 --> 00:12:34.500
这个要收费也一样删掉

00:12:34.500 --> 00:12:36.000
常看我视频的小伙伴知道

00:12:36.000 --> 00:12:37.600
我视频主打的是不花钱

00:12:37.600 --> 00:12:39.700
因为 Claude Code 一定要求

00:12:39.700 --> 00:12:42.000
AI 模型具有工具调用的功能

00:12:42.000 --> 00:12:44.500
所以要选这种有 tools 标签的

00:12:44.500 --> 00:12:46.200
比如说 phi4-mini

00:12:46.200 --> 00:12:48.600
或者这个 Gemma-2-9B 的

00:12:48.600 --> 00:12:50.700
它也有工具调用的功能

00:12:50.800 --> 00:12:54.300
要下载 phi4-mini 就用这个命令

00:12:54.300 --> 00:12:56.500
要下载 Gemma 2 就用这个命令

00:12:56.500 --> 00:12:58.800
我这两个是都已经下好了

00:12:58.800 --> 00:13:00.400
因为之前用的是云端命令

00:13:00.400 --> 00:13:04.200
现在主要是想要用一下本地 AI 的模型

00:13:04.200 --> 00:13:06.200
用这个命令启动 Claude Code

00:13:06.200 --> 00:13:07.600
就选择 Gemma 2 吧

00:13:07.600 --> 00:13:08.600
按回车

00:13:08.600 --> 00:13:10.100
Sync 选自动

00:13:10.100 --> 00:13:11.100
按回车

00:13:11.100 --> 00:13:12.500
使用推荐设置

00:13:12.500 --> 00:13:13.500
先问个问题

00:13:13.500 --> 00:13:14.900
看一下它能不能用

00:13:14.900 --> 00:13:15.800
然后它又开始运转

00:13:15.800 --> 00:13:17.500
并不是弹出 400 错误

00:13:17.500 --> 00:13:19.400
而且你会发现它运行的过程中

00:13:19.400 --> 00:13:20.700
连 Token 都没有

00:13:20.700 --> 00:13:23.300
也就是说这是纯粹的本地模型

00:13:23.300 --> 00:13:25.100
Gemma-2-9B 是小一点

00:13:25.100 --> 00:13:27.800
它对于小代码是完全够用的

00:13:27.800 --> 00:13:29.600
当然如果是大段代码

00:13:29.600 --> 00:13:31.700
或者是需要 scaffolding 的

00:13:31.700 --> 00:13:33.100
或者是需要部署的

00:13:33.100 --> 00:13:34.500
可能就吃不动了

00:13:34.500 --> 00:13:37.800
另外近期在 Hugging Face 上看到一个模型

00:13:37.800 --> 00:13:39.300
是千问 2.5-Coder

00:13:39.300 --> 00:13:42.700
这个模型根据它的介绍很不错

00:13:42.700 --> 00:13:45.100
只需要 6G 的 VRAM 就能跑起来

00:13:45.100 --> 00:13:46.200
它给出了回答

00:13:46.200 --> 00:13:50.000
这说明它是可以在 Claude Code 里面正常用的

00:13:50.000 --> 00:13:52.200
把昨天的代码跑起来

00:13:52.200 --> 00:13:54.800
这样就又看到这个 FAB 按钮了

00:13:54.800 --> 00:13:56.100
点这个右上角的按钮

00:13:56.100 --> 00:13:57.300
复制一下它的链接

00:13:57.300 --> 00:14:00.000
准备使用 Claude Code 的 skills

00:14:00.000 --> 00:14:02.300
对于这个 FAB 做一点提升

00:14:02.300 --> 00:14:05.700
比如我们就用这个 Frontend Design 这个 skill

00:14:05.700 --> 00:14:06.900
ESC 退出

00:14:06.900 --> 00:14:08.200
给一下提示词

00:14:08.200 --> 00:14:09.400
使用这个 skill

00:14:09.400 --> 00:14:13.300
查找目前这个 FAB 按钮的本地链接

00:14:13.300 --> 00:14:14.900
对它稍做一点调整

00:14:14.900 --> 00:14:17.200
主要是要有交互动画的效果

00:14:17.200 --> 00:14:19.900
然后要能够输出 Wireframe

00:14:19.900 --> 00:14:22.700
先看一下，如果可以再修改 UI

00:14:22.700 --> 00:14:23.900
本地运行比较慢

00:14:23.900 --> 00:14:24.700
稍等一下

00:14:24.700 --> 00:14:26.400
它开始问问题

00:14:26.400 --> 00:14:29.500
希望我使用哪一种美学方向

00:14:29.500 --> 00:14:30.700
其实哪一个都可以

00:14:30.700 --> 00:14:32.100
就直接选第一个

00:14:32.100 --> 00:14:32.700
复制一下

00:14:32.700 --> 00:14:33.460
粘贴进来

00:14:33.460 --> 00:14:34.100
按回车

00:14:34.100 --> 00:14:35.700
这样它就继续运行了

00:14:35.700 --> 00:14:37.000
运行得非常慢

00:14:37.000 --> 00:14:40.300
但是确实是生成了线框图

00:14:40.300 --> 00:14:41.600
看上去还可以

00:14:41.600 --> 00:14:43.400
给出了 Styling

00:14:43.500 --> 00:14:45.100
基本的要素

00:14:45.100 --> 00:14:46.300
问我要不要同意

00:14:46.300 --> 00:14:48.100
肯定必须要同意

00:14:48.100 --> 00:14:50.600
复制这一段粘贴到对话框

00:14:50.600 --> 00:14:51.700
如果不同意的话

00:14:51.700 --> 00:14:54.100
这么长时间不就白费了吗

00:14:54.100 --> 00:14:56.400
本地运行的话真的很吃资源

00:14:56.400 --> 00:14:58.400
等了一会总算是做完了

00:14:58.400 --> 00:15:00.100
来看一下它的效果

00:15:00.100 --> 00:15:02.000
效果还是相当不错的

00:15:02.000 --> 00:15:05.200
原来就是一个简单的蓝色的 FAB 按钮

00:15:05.200 --> 00:15:06.300
现在变成这样

00:15:06.300 --> 00:15:07.600
看上去还挺酷的

00:15:07.600 --> 00:15:08.700
本地运行的话

00:15:08.700 --> 00:15:10.500
其实还是相当吃资源的

00:15:10.500 --> 00:15:13.100
当然也许是我自己机子

00:15:13.100 --> 00:15:14.760
本身资源非常紧

00:15:14.760 --> 00:15:17.300
主要是前面做设计稿的那部分

00:15:17.300 --> 00:15:18.800
消耗了比较长的时间

00:15:18.800 --> 00:15:21.400
现在来看一下 cc-switch 的用法

00:15:21.400 --> 00:15:25.200
cc-switch 前面已经演示过怎么安装了

00:15:25.200 --> 00:15:27.800
我们现在就直接开始添加一个 Provider

00:15:27.800 --> 00:15:29.300
点一下这个加号按钮

00:15:29.300 --> 00:15:33.200
这个提示栏是说可以添加 common config

00:15:33.200 --> 00:15:37.000
这样可以在其他的客户端进行复用

00:15:37.000 --> 00:15:37.500
没关系

00:15:37.500 --> 00:15:38.500
直接点 Got it

00:15:38.500 --> 00:15:39.300
不要管它

00:15:39.300 --> 00:15:42.400
进来以后可以看到它其实支持很多的东西

00:15:42.400 --> 00:15:46.500
像 Gemini、DeepSeek、智谱、MiniMax

00:15:46.500 --> 00:15:47.700
它支持很多

00:15:47.700 --> 00:15:49.100
OpenRouter 也支持

00:15:49.100 --> 00:15:49.600
但没关系

00:15:49.600 --> 00:15:52.000
我们直接选 Custom Configuration

00:15:52.000 --> 00:15:53.000
点添加

00:15:53.000 --> 00:15:54.700
要填一点资料

00:15:54.700 --> 00:15:55.600
点 Cancel

00:15:55.600 --> 00:15:56.500
剩下了

00:15:56.500 --> 00:15:58.400
我们用的是 Ollama

00:15:58.400 --> 00:15:59.700
这里就填 Ollama

00:15:59.700 --> 00:16:03.000
Note 的话可以随便填

00:16:03.000 --> 00:16:04.000
关于 API Key

00:16:04.000 --> 00:16:06.900
其实 Ollama 是不需要 API Key 的

00:16:06.900 --> 00:16:09.200
我觉得应该就是只要填一个

00:16:09.200 --> 00:16:11.000
这里填一个 A 进去

00:16:11.000 --> 00:16:12.600
打开一下小眼睛

00:16:12.600 --> 00:16:14.700
这就是一个极为简单的 API Key

00:16:14.700 --> 00:16:16.300
反正是用本地模型

00:16:16.300 --> 00:16:17.800
关于 API Endpoint

00:16:17.800 --> 00:16:20.200
把这个链接粘过来

00:16:20.200 --> 00:16:21.500
后面加上 /v1

00:16:21.500 --> 00:16:22.800
打开高级选项

00:16:22.800 --> 00:16:25.300
打开 API Format 下拉框

00:16:25.300 --> 00:16:27.700
我们需要改变一下 API 的格式

00:16:27.700 --> 00:16:29.100
这两个都可以

00:16:29.100 --> 00:16:31.300
第二个选项和第三个选项都可以

00:16:31.300 --> 00:16:32.500
我们就选第二个吧

00:16:32.500 --> 00:16:34.500
接下来看一下认证字段

00:16:34.500 --> 00:16:36.100
选择 API Key 吧

00:16:36.100 --> 00:16:39.200
它问要使用什么样的模型

00:16:39.200 --> 00:16:42.100
来代替 Sonnet、Opus 和 Haiku

00:16:42.100 --> 00:16:45.000
这是准备让我们提供模型

00:16:45.000 --> 00:16:47.700
进而能够替换这几个模型

00:16:47.700 --> 00:16:49.900
或者叫“欺骗”这几个模型

00:16:49.900 --> 00:16:53.100
用这个命令退出 Claude Code

00:16:53.100 --> 00:16:55.800
用这个命令清理一下页面

00:16:55.800 --> 00:16:57.300
用 ollama list

00:16:57.300 --> 00:16:59.300
看一下有什么选项

00:16:59.300 --> 00:17:01.100
刚才用过 Gemma 2 了

00:17:01.100 --> 00:17:03.100
这次用下 phi4-mini

00:17:03.100 --> 00:17:04.200
复制一下

00:17:04.200 --> 00:17:05.600
粘到这里

00:17:05.600 --> 00:17:08.500
这里全部都使用 phi4-mini 吧

00:17:08.500 --> 00:17:11.400
在这里可以看一下它的配置

00:17:11.400 --> 00:17:14.900
如果觉得没有什么问题就点添加

00:17:14.900 --> 00:17:17.900
这样这个新的 Provider 就添加好了

00:17:17.900 --> 00:17:19.200
点一下 Enable

00:17:19.200 --> 00:17:22.700
根据提示应该说要提供路由

00:17:22.700 --> 00:17:25.200
路由在这个齿轮按钮里

00:17:25.200 --> 00:17:26.800
点一下选 Routing

00:17:26.800 --> 00:17:29.500
Local Routing 本身是停止的

00:17:29.500 --> 00:17:31.600
把这两个都启动了

00:17:31.600 --> 00:17:34.100
选择 I Understand, Enable

00:17:34.100 --> 00:17:37.100
我们当然是要桥接给 Claude

00:17:37.100 --> 00:17:39.000
所以 Claude 要打开

00:17:39.000 --> 00:17:42.600
这个是 cc-switch 服务器的地址

00:17:42.600 --> 00:17:46.000
复制一下保存到你本地

00:17:46.000 --> 00:17:48.400
方便等下复制粘贴的地方

00:17:48.400 --> 00:17:50.300
它确实有提供整流器

00:17:50.300 --> 00:17:53.100
cc-switch 看上去就像是一个

00:17:53.100 --> 00:17:55.800
AI Client 的综合管理器

00:17:55.800 --> 00:17:58.700
这样路由设置就做好了

00:17:58.700 --> 00:18:00.100
关掉 cc-switch

00:18:00.100 --> 00:18:01.400
重新打开一下

00:18:01.400 --> 00:18:03.000
选择路由

00:18:03.000 --> 00:18:05.800
确保这些路由设置依旧存在

00:18:05.800 --> 00:18:09.700
用这个命令把 phi4-mini 在本地跑起来

00:18:09.700 --> 00:18:12.200
跑起来以后就让它一直运行

00:18:12.200 --> 00:18:16.000
运行以后就直接使用 claude 命令

00:18:16.000 --> 00:18:17.200
打开代码

00:18:17.200 --> 00:18:20.100
问是否要使用 Custom API Key

00:18:20.100 --> 00:18:21.100
选“是”

00:18:21.100 --> 00:18:22.400
问一个问题

00:18:22.400 --> 00:18:23.400
按回车

00:18:23.400 --> 00:18:26.100
似乎是已经可以开始工作了

00:18:26.100 --> 00:18:29.000
我是直接用 claude 命令进来的

00:18:29.000 --> 00:18:32.700
并没有使用 ollama 来启动 claude

00:18:32.700 --> 00:18:35.300
这个模型看上去叫做 Opus

00:18:35.300 --> 00:18:36.800
但是你看到了

00:18:36.800 --> 00:18:39.700
它运行的时候根本就没有 Token 的统计

00:18:39.700 --> 00:18:42.700
也就是说它应该用的是一个本地模型

00:18:42.700 --> 00:18:45.400
在 cc-switch 里面回到首页

00:18:45.400 --> 00:18:47.700
在我们新建的 Ollama 提供商这里

00:18:47.700 --> 00:18:49.200
点一下编辑

00:18:49.200 --> 00:18:50.800
在这里你就会看到

00:18:50.800 --> 00:18:53.500
实际上 Claude Code 的 Opus

00:18:53.500 --> 00:18:56.400
已经被 phi4-mini 取代了

00:18:56.400 --> 00:19:00.100
因此在这里虽然看到的模型还叫做 Opus

00:19:00.100 --> 00:19:03.600
但是实际上用的是本地的 phi4-mini

00:19:03.600 --> 00:19:04.900
但是它比较慢

00:19:04.900 --> 00:19:07.100
比我想象中的慢了很多

00:19:07.100 --> 00:19:09.000
这也可以理解

00:19:09.000 --> 00:19:11.300
Mac 本身的资源有限

00:19:11.300 --> 00:19:13.300
还加了一层路由层

00:19:13.300 --> 00:19:14.800
慢一点可以理解

00:19:14.800 --> 00:19:18.000
只是说希望它不要慢到让我怀疑人生

00:19:18.000 --> 00:19:20.000
这个慢得有一点不太正常

00:19:20.000 --> 00:19:21.100
有空再看一下吧

00:19:21.100 --> 00:19:22.600
现在就不用了

00:19:22.600 --> 00:19:24.300
用 exit 退出

00:19:24.300 --> 00:19:26.000
关掉这个 cc-switch

00:19:26.000 --> 00:19:27.700
对于机子性能非常有限

00:19:27.700 --> 00:19:30.300
需要手动配置环境变量的小伙伴

00:19:30.300 --> 00:19:34.300
可以用一个这样的脚本来做开关

00:19:34.300 --> 00:19:35.500
用这个命令

00:19:35.500 --> 00:19:37.400
创建一个脚本文件

00:19:37.400 --> 00:19:41.200
用这个命令打开刚才这个创建的空文件

00:19:41.200 --> 00:19:42.900
按 I 开始输入

00:19:42.900 --> 00:19:44.900
脚本就这么一段

00:19:44.900 --> 00:19:46.400
它有一个 Argument

00:19:46.400 --> 00:19:48.000
使用 ON 或者 OFF

00:19:48.000 --> 00:19:49.600
打开或者关闭

00:19:49.600 --> 00:19:52.300
Ollama Cloud Code 的环境变量

00:19:52.300 --> 00:19:53.300
好了以后

00:19:53.300 --> 00:19:54.400
保存一下

00:19:54.400 --> 00:19:55.800
用这个命令

00:19:55.800 --> 00:19:56.900
查看一下

00:19:56.900 --> 00:19:59.500
脚本是已经保存并退出了

00:19:59.500 --> 00:20:01.600
用这个命令清理一下页面

00:20:01.600 --> 00:20:03.000
用这个命令

00:20:03.000 --> 00:20:05.900
给刚才的脚本文件以授权

00:20:05.900 --> 00:20:07.300
主要是让它可以执行

00:20:07.300 --> 00:20:09.600
以后如果你想用 Claude Code

00:20:09.600 --> 00:20:12.200
加 Ollama 本地的 AI 模型

00:20:12.200 --> 00:20:13.800
你就用这样的一条命令

00:20:13.800 --> 00:20:16.000
环境配置就做好了

00:20:16.000 --> 00:20:18.100
如果不想用 Ollama 的本地模型了

00:20:18.100 --> 00:20:20.500
想切换回 Claude Code 原本的工作模式

00:20:20.500 --> 00:20:21.800
就使用这个命令

00:20:21.800 --> 00:20:24.800
说白了就是最后用 ON 或者 OFF

00:20:24.800 --> 00:20:27.100
来控制环境变量的开关

00:20:27.100 --> 00:20:30.400
这样会比你每一次去写环境变量

00:20:30.400 --> 00:20:32.400
然后还要把它暴露出来

00:20:32.400 --> 00:20:33.400
要方便一些

00:20:33.400 --> 00:20:34.800
本期主要讲的就是 Claude Code

00:20:34.800 --> 00:20:37.000
叫 Ollama 免费使用 Claude Code

00:20:37.000 --> 00:20:38.900
以及使用 cc-switch

00:20:38.900 --> 00:20:42.600
它也可以让你免费地使用 Claude Code

00:20:42.600 --> 00:20:46.700
因为它能够做模型的代理管理

00:20:46.700 --> 00:20:49.800
但其实它其实更像是一个

00:20:49.800 --> 00:20:53.300
模型的 AI Client 的管理器

00:20:53.300 --> 00:20:55.400
它其实并不像是一个代理

00:20:55.400 --> 00:20:59.200
虽然它有这种直连类型的描述

00:20:59.200 --> 00:21:02.000
而且它下面也说了这个

00:21:02.000 --> 00:21:04.400
代理和自动错误处理

00:21:04.400 --> 00:21:05.600
热切换

00:21:05.600 --> 00:21:07.600
Request 整流器

00:21:07.600 --> 00:21:09.700
但是它并不像它说的这个

00:21:09.700 --> 00:21:10.900
可以代理这些东西

00:21:10.900 --> 00:21:13.200
它本身应该只是一个管理器

00:21:13.200 --> 00:21:14.900
有兴趣的小伙伴可以试一试

00:21:14.900 --> 00:21:17.000
请点赞订阅支持我的创作

00:21:17.000 --> 00:21:17.500
谢谢

