大家好 我是墨端 欢迎来到科技梦星云 这期主要讲的是使用 Ollama 或者 cc-switch 免费使用 Claude Code Claude 加 Ollama 就像是《山海经》里的禺强 那货是海神兼风神 人面鸟身 脚踩两条青蛇 似乎和李淳罡的两袖青蛇有一些关系 它掌管北海呼风唤雨无所不能 Claude 加 Ollama 出代码稳、快、能堪事 cc-switch 就像是《山海经》里的天吴 八头人面 八足八尾 是水伯 专门负责疏通水路 连接各方 有时候魔法阻止了 访问不了 Claude Code 天吴能帮你在分流里把路接通 视频推荐机制 创作不易 请点赞订阅支持我的创作 首先 该配的环境还是要配的 你需要确保你本地已经安装了 git 命令行 在 Mac 上你可以直接用 brew 安装 当然无论是什么系统 你都可以直接到它的官网上去下载安装 点这个按钮在这里 就可以选择其他的系统进行安装了 如果是 macOS 就选这个 它本身推荐的也是用 brew 进行安装 如果是 Windows 点这里下载 或者用这个命令安装 如果是 Windows 下载安装 尽量要在这两个里面选 说白了就是尽量要选 Standalone 装好了以后 用这个命令看到版本 就是安装成功了 然后你会需要 Ollama 它会提供免费的 AI 模型 安装也很容易直接到它的官网上去 可以用这个命令安装 也可以下載安裝 安装好以后直接用这个命令 能看到版本号就说明安装是成功的 接下来你会需要安装 Claude Code 到它的官网去用這個命令進行安裝 如果是 Windows 必须在 PowerShell 里面 用这个命令进行安装 你也可以在这个按钮底下 找到它的 desktop 下载安装 安装好以后用这个命令 查看一下有版本号就是安装成功了 另外说一下 cc-switch 它不是一个 AI 模型 它实际上是给 Claude Code Codex OpenRouter 千问 Kimi MiniMax 等 提供的一个管理器 它主要是给受魔法限制的小伙伴使用的 它有中文解释点一下中文 这样看上去就顺眼多了 它还能帮你管理 OpenRouter 和 Hermes 这是它的官网点进去看一下 在官网上面直接有提供稳定版的下载 在官网上面可以看到它的大体功能 这里有 Provider 管理、本地路由和使用统计 本地路由就是我们一定会用到的东西 cc-switch 需要下载安装 你可以在这里直接下载 也可以回到它的 GitHub 点一下它的仓库名 在右边栏点一下 Release 进来以后直接拉到底 这些就是它可以下载的软件 选择自己对应的系统 下载安装就好 比如说我是 Mac 我就选这个 下载以后打开 把它拖进 Applications 然后就可以打开它了 打开的时候会看到这个欢迎页 直接点 Got it 就不用管它了 打开以后就可以看见 cc-switch 自带对 Claude Code 的支持 这个先放一边 要免费使用 Claude Code 依旧要使用模型 我们会用 Ollama 提供免费的 AI 模型 但问题是哪一个模型才真正适合你呢 首先你需要查看你电脑的硬件信息 在 Mac 上就用这个命令查看一下就好了 你有了你电脑的基本硬件信息 就可以到这个网站这里 这个网站就是帮你挑模型的 首先要选一下 GPU 这个怎么也绕不过 点一下选择对应的类型 如果你是苹果就选这个 然后选自己对应的 GPU 我是 M2 Pro 内存 16G 因为我们要让 Ollama 能够提供 AI 模型给 Claude Code 它要求最低的上下文是 32K 顺便说一下我这个内存为什么会选 16G 因为它没得选 而且 Mac 本身是集显 它内存一共就 16G 也就是说这 16G 不是像独立 GPU 那样 可以全部用来跑模型的 这些选好以后下面就会出现 跑得很好的各种模型 也就是说在这里 就可以找到适合于你电脑的 AI 模型了 当然因为是 Mac 所以能用的都是比较旧比较小的模型 一般情况下尽量选择靠上面的 也就是这些靠前的 相对来说评分比较高,性能也比较好 当然了 因为 Mac 的性能是有一些限制的 我会把上下文改为 16K 试着使用一下 phi4 但是 phi4 跑起来会很慢 它本身是不错的 是微软出品的 另外 Ollama 自己本身也是有推荐的模型的 主要是千问 3.5 和智谱 5 还有 Kimi 2.5 后缀有这个 Cloud 说明它是云端版的 知道要下什么模型以后 就可以到 Ollama 上点一下 Models 开始搜对应的模型 比如我们搜一个 GLM 5 的模型 输一下 GLM 点 GLM 5 这样就可以下载它对应的模型了 AI 的模型是有两种 我们看一下千问 以千问 3.5 为例 如果你看到它后面这里是 Text and Image 这个是多模态的模型 它支持图形 也支持聊天 如果后面就单独是 Text 那这个模型就只是一个聊天模型 可以用来写代码 但是它不是多模态的 那怎么下载模型呢 就比如说 我们想用千问 3.5 4B的这一个 点进去 这个就是它的下载命令了 复制一下 粘贴到终端就可以把它下载下来 顺便说一下 如果你想下载并直接开始运行 就使用 run 命令 如果你只是想下载就使用 pull 命令 我本地是已经有一些模型了 用 ollama list 给大家看一下 我本地是下了这两个模型 像这样的云端的模型 它是有使用限制的 毕竟免费嘛 常看我视频的小伙伴知道 我视频主打的是不花钱 如何查看限制条件呢 你需要一个账号 登录到它的官网 点用户按钮 点一下设置 进来以后就可以看到 这是一个免费的账户 这是每个 Session 的限制 这是每个星期的限制 对于使用 Ollama 本地模型来说 是不需要 API Key 的 但是如果你一定想要一个 也可以到这里来搞一下 点一下 Keys 进去以后自己设一个就是了 记得复制粘贴保存到一个 你本地等会儿方便你复制粘贴的地方 但是如果有的时候 你的工程量特别大 云端模型免费的额度已经满了 怎么办呢 你可以换一个账号 注册账号需要手机验证 你可以到这个网站来 这里有很多这种免费的手机号 可以帮你接码 但是这不是一个稳妥的方案 它的成功率是有一定概率的 主要取决于它第二次的验证 用的是什么 它第二次验证如果用的是手机 那你就只能等过几天再试了 如果它第二次验证用的是邮箱 那就没问题了 这看大家喜好了 反正这些都是免费的临时手机号 基础的配置就讲完了 现在看一下如何直接使用 Ollama 的命令来启动 Claude Code 这样 Claude Code 就可以使用 Ollama 提供的免费的 AI 模型 希望你已经安装好了 Claude Code Mac 是这个命令 Windows 必须在 PowerShell 底下用这个命令 链接的话可以去博客里找 要让 Claude Code 使用 Ollama 也很简单 直接使用这个命令 复制一下 如果你想用特定的模型 也可以使用这个命令 这个命令的後半部分 就规定了要使用的模型 另外 Ollama 的官方 还有一些推荐的模型 另外如果你想要直接使用 Claude Code 不想要交互的话 你可以使用这个命令 在它的後半部分就是问题 另外关于想要循环执行某一个任务 Claude Code 是有这样一个 loop 命令的 以这个为例 输入 loop 命令 循环的时间是 30 分钟 也就是说每 30 分钟会执行一下 loop 命令 这命令要干什么呢 最后这个部分 就是告诉 loop 命令要做什么 也就是说每 30 分钟 会查看一下 pull request 然后总结一下它们的状态 再看下 使用这个命令 你还可以从外部来控制 Claude Code 比如说从 Telegram 来控制 Claude Code 如果你不想从 Ollama 启动 Claude Code 你也可以去配置环境变量 然后直接用 claude 的命令 加 Ollama 模型的名字来启动 这样 Claude Code 也会使用本地 Ollama 的模型 当然除 Claude Code 以外 Ollama 还支持其他的这些 AI 的编程工具 像这个 Open Interpreter 它和 Claude Code 非常像 其实这些都很像 你会了一个,其他都差不多 使用 Ollama 启动 Claude Code 的一个好处 就是你可以不用去写这些环境变量 先复制 这个 Ollama 启动 Claude Code 的命令 用这个命令 创建一个新的文件夹 然后进入这个文件夹 粘贴刚才的启动命令 如果你只是想配置 而不是想直接启动 Claude Code 在后面可以加上 config 的后缀 按一下回车 进去以后就可以看见 它只是帮你配置 用了这个 config 命令 它是只配置不运行 Claude Code 进来就是帮你选一下模型 上面部分是它推荐的模型 下面这个是我下载本地的一个模型 因为我需要使用 Claude Code 所以按 ESC 退出 用这个命令直接让 Ollama 把 Claude Code 跑起来 按回车 第一步依旧是配置模型 Gemma 4 是不错的 但是它本地模型跑不起来 支持有限 要用也只能用云端 但是云端的版本也要看 就比如说我们选这个千问 3.5、GLM 或者 Kimi 你会看到它后面都有这个 Upgrade Required 的字样 这个都是要付费的 免费的云端只能选 Nemotron 3 和 Gemma 4 再来这里看一下 在选模型的网站上可以看到 Nemotron 因此我们就选这个 Nemotron 吧 phi4 的话会很慢很慢 按回车 选择相信这个 folder 在这里你就会看到 Claude Code 现在使用的是 Nemotron 的模型 输入一下 skills 命令 这里可以看到 Frontend Design 这个 skill 这说明这一个 Claude Code 依旧是我之前用的那个 Claude Code 按 ESC 退出 我已经处理了验证警告 要怎么处理呢 先 logout 一下 按回车 退出以后 用 unset 命令 把 Anthropic 的 Token 去掉 然后再用 Ollama 命令 把 Claude Code 跑起来 跑起来之后 会需要做一点简单的设置 基本就是按照它推荐的走就行了 我是已经做好了 现在启动是正常启动 启动以后选模型 终端样式选自动,按回车继续 使用它推荐的设置 这样就没有验证冲突了 然后我可以给提示词 如果提示词太长可以按 Ctrl-G 这样就可以在 VS Code 里面进行编辑 给一个提示词保存一下关掉 它就会自动把它回弹到 Claude Code 里面 按回车它就会开始执行 稍等一下它已经开始运行了 这个 Token 怎么飙都不怕了 反正在本地用的是免费模型 开始做配置了 稍等一下 这样似乎就是好了 我们到本地用 storybook 命令启动它一下 按回车 这样就可以看见它做的这样一个组件库 指上去以后会有 ABC 三个子按钮 很不幸 即便是这样一个小任务 也已经把今天能用的免费额度给用完了 如果用 Ollama 的云端模型 它确实是会有免费额度的限制 今天用完了等明天吧 之前用的是云端的模型 现在来用一下本地的模型 用这个命令打开 Claude Code 直接选 phi4 这是一个本地模型 也就是这个模型 进来以后可以看到模型就是 phi4 问一下它会写代码吗 直接报错 这是 400 错误 说不能支持工具的调用 因为 Claude Code 一定要求工具的调用 像我们上一个用的这个 Nemotron 它就是支持工具调用的 而 Claude Code 是强制要求一定要有工具调用的 因此用 phi4 是不行的 既然 phi4 没有用 我们就 logout 一下 用这个命令把 phi4 移除掉 因为不需要了 用这个命令看一下 本地还有什么其他的模型 像 GLM-4-Cloud 这个要收费也一样删掉 常看我视频的小伙伴知道 我视频主打的是不花钱 因为 Claude Code 一定要求 AI 模型具有工具调用的功能 所以要选这种有 tools 标签的 比如说 phi4-mini 或者这个 Gemma-2-9B 的 它也有工具调用的功能 要下载 phi4-mini 就用这个命令 要下载 Gemma 2 就用这个命令 我这两个是都已经下好了 因为之前用的是云端命令 现在主要是想要用一下本地 AI 的模型 用这个命令启动 Claude Code 就选择 Gemma 2 吧 按回车 Sync 选自动 按回车 使用推荐设置 先问个问题 看一下它能不能用 然后它又开始运转 并不是弹出 400 错误 而且你会发现它运行的过程中 连 Token 都没有 也就是说这是纯粹的本地模型 Gemma-2-9B 是小一点 它对于小代码是完全够用的 当然如果是大段代码 或者是需要 scaffolding 的 或者是需要部署的 可能就吃不动了 另外近期在 Hugging Face 上看到一个模型 是千问 2.5-Coder 这个模型根据它的介绍很不错 只需要 6G 的 VRAM 就能跑起来 它给出了回答 这说明它是可以在 Claude Code 里面正常用的 把昨天的代码跑起来 这样就又看到这个 FAB 按钮了 点这个右上角的按钮 复制一下它的链接 准备使用 Claude Code 的 skills 对于这个 FAB 做一点提升 比如我们就用这个 Frontend Design 这个 skill ESC 退出 给一下提示词 使用这个 skill 查找目前这个 FAB 按钮的本地链接 对它稍做一点调整 主要是要有交互动画的效果 然后要能够输出 Wireframe 先看一下,如果可以再修改 UI 本地运行比较慢 稍等一下 它开始问问题 希望我使用哪一种美学方向 其实哪一个都可以 就直接选第一个 复制一下 粘贴进来 按回车 这样它就继续运行了 运行得非常慢 但是确实是生成了线框图 看上去还可以 给出了 Styling 基本的要素 问我要不要同意 肯定必须要同意 复制这一段粘贴到对话框 如果不同意的话 这么长时间不就白费了吗 本地运行的话真的很吃资源 等了一会总算是做完了 来看一下它的效果 效果还是相当不错的 原来就是一个简单的蓝色的 FAB 按钮 现在变成这样 看上去还挺酷的 本地运行的话 其实还是相当吃资源的 当然也许是我自己机子 本身资源非常紧 主要是前面做设计稿的那部分 消耗了比较长的时间 现在来看一下 cc-switch 的用法 cc-switch 前面已经演示过怎么安装了 我们现在就直接开始添加一个 Provider 点一下这个加号按钮 这个提示栏是说可以添加 common config 这样可以在其他的客户端进行复用 没关系 直接点 Got it 不要管它 进来以后可以看到它其实支持很多的东西 像 Gemini、DeepSeek、智谱、MiniMax 它支持很多 OpenRouter 也支持 但没关系 我们直接选 Custom Configuration 点添加 要填一点资料 点 Cancel 剩下了 我们用的是 Ollama 这里就填 Ollama Note 的话可以随便填 关于 API Key 其实 Ollama 是不需要 API Key 的 我觉得应该就是只要填一个 这里填一个 A 进去 打开一下小眼睛 这就是一个极为简单的 API Key 反正是用本地模型 关于 API Endpoint 把这个链接粘过来 后面加上 /v1 打开高级选项 打开 API Format 下拉框 我们需要改变一下 API 的格式 这两个都可以 第二个选项和第三个选项都可以 我们就选第二个吧 接下来看一下认证字段 选择 API Key 吧 它问要使用什么样的模型 来代替 Sonnet、Opus 和 Haiku 这是准备让我们提供模型 进而能够替换这几个模型 或者叫“欺骗”这几个模型 用这个命令退出 Claude Code 用这个命令清理一下页面 用 ollama list 看一下有什么选项 刚才用过 Gemma 2 了 这次用下 phi4-mini 复制一下 粘到这里 这里全部都使用 phi4-mini 吧 在这里可以看一下它的配置 如果觉得没有什么问题就点添加 这样这个新的 Provider 就添加好了 点一下 Enable 根据提示应该说要提供路由 路由在这个齿轮按钮里 点一下选 Routing Local Routing 本身是停止的 把这两个都启动了 选择 I Understand, Enable 我们当然是要桥接给 Claude 所以 Claude 要打开 这个是 cc-switch 服务器的地址 复制一下保存到你本地 方便等下复制粘贴的地方 它确实有提供整流器 cc-switch 看上去就像是一个 AI Client 的综合管理器 这样路由设置就做好了 关掉 cc-switch 重新打开一下 选择路由 确保这些路由设置依旧存在 用这个命令把 phi4-mini 在本地跑起来 跑起来以后就让它一直运行 运行以后就直接使用 claude 命令 打开代码 问是否要使用 Custom API Key 选“是” 问一个问题 按回车 似乎是已经可以开始工作了 我是直接用 claude 命令进来的 并没有使用 ollama 来启动 claude 这个模型看上去叫做 Opus 但是你看到了 它运行的时候根本就没有 Token 的统计 也就是说它应该用的是一个本地模型 在 cc-switch 里面回到首页 在我们新建的 Ollama 提供商这里 点一下编辑 在这里你就会看到 实际上 Claude Code 的 Opus 已经被 phi4-mini 取代了 因此在这里虽然看到的模型还叫做 Opus 但是实际上用的是本地的 phi4-mini 但是它比较慢 比我想象中的慢了很多 这也可以理解 Mac 本身的资源有限 还加了一层路由层 慢一点可以理解 只是说希望它不要慢到让我怀疑人生 这个慢得有一点不太正常 有空再看一下吧 现在就不用了 用 exit 退出 关掉这个 cc-switch 对于机子性能非常有限 需要手动配置环境变量的小伙伴 可以用一个这样的脚本来做开关 用这个命令 创建一个脚本文件 用这个命令打开刚才这个创建的空文件 按 I 开始输入 脚本就这么一段 它有一个 Argument 使用 ON 或者 OFF 打开或者关闭 Ollama Cloud Code 的环境变量 好了以后 保存一下 用这个命令 查看一下 脚本是已经保存并退出了 用这个命令清理一下页面 用这个命令 给刚才的脚本文件以授权 主要是让它可以执行 以后如果你想用 Claude Code 加 Ollama 本地的 AI 模型 你就用这样的一条命令 环境配置就做好了 如果不想用 Ollama 的本地模型了 想切换回 Claude Code 原本的工作模式 就使用这个命令 说白了就是最后用 ON 或者 OFF 来控制环境变量的开关 这样会比你每一次去写环境变量 然后还要把它暴露出来 要方便一些 本期主要讲的就是 Claude Code 叫 Ollama 免费使用 Claude Code 以及使用 cc-switch 它也可以让你免费地使用 Claude Code 因为它能够做模型的代理管理 但其实它其实更像是一个 模型的 AI Client 的管理器 它其实并不像是一个代理 虽然它有这种直连类型的描述 而且它下面也说了这个 代理和自动错误处理 热切换 Request 整流器 但是它并不像它说的这个 可以代理这些东西 它本身应该只是一个管理器 有兴趣的小伙伴可以试一试 请点赞订阅支持我的创作 谢谢