大家好 这里是灵度解说 最近AI圈突然出现一个非常有趣的玩法 就是很多年开始不用Cloud官方的API 甚至不用联网 直接让自己电脑里的本地AI模型 接管整个Cloud Code 在可视化的桌面板进行完美操作 什么意思呢 就现在你可以让本地的AI模型 比方千问,Deep Sync,GLM,伪装成Cloud 然后直接驱动Cloud Code这个超强的AI Agent 它不仅难聊天 甚至还能自动读取项目 改代码 执行命令 修复bug 搭建网站等等 终点是现在这一切 都可以完全本地的现实用 而最近这个玩法的核心原理就是 通过这款爆火的开源项目 CCSWitch 来实现这一套本地Cloud Code 移化揭幕大法 关键是可以完美适配 Cloud Code官方的桌面板 从此不再受限于付费的API 接下来我就跟大家演示一下 如何通过CCSWitch加Oloma 把本地AI模型 接入CodeCode桌面吧 来看看这免费的本地AI模型 到底能不能替换真正的CodeCodeSonic 可能很多人会有个误会 会把CodeCode当作一个普通的AI聊天工具 其实它真正厉害的地方在于 它是一个非常强悍的AI agent 可以真正操控你的电脑项目 拥有超长的上下文 它可以一次性吃完整个项目 分析整个代码库 理解依捞关系等等 这个比科者强悍多了 比如说通过一句话 帮我给这网站增加登录系统 Card Quote就会自动吐起整个项目代码 分析结构 修改文件 安装依赖 甚至直接运行命令 来帮我们自动完成我们需要的功能 所以它本身其实就是这个 AI加IDE加Terminal加文件系统 现在更加离谱的是 我们甚至可以不用Cloud的官方模型 直接来Olamo本地模型来驱动它 然后接下来我们再演示一下 如何进行本地部署 在开始之前 首先我们需要打开零路博上这篇文章 这个地址我们放在视频下方 打开以后就往下拉 上面我们接触去的全部资料 在开始安装之前 我们需要安装一下必备的环境 就是Gate 如果你之前没安装过的话 那么第一打开它 来进行安装一下 打开以后 上面有个硬式多的for Windows 先把最新版本的兜下来 第一打开它 下转好以后 来进行安装一下Gate的环境 点击下一步就可以了 后面选择环境目的就可以了 不需要做额外的设置 安装完成以后 我们点击Finish 然后现在正式开始安装 今天我们需要用的工具 其实就是这三个 第一是Color Code桌面板 第二是Oruma 第三个是CC Switch 这个Color Code负责AGI Oruma负责本地模型的运行 CC Switch的话 主要负责模型的鬼装和转发 其实它整个原理非常简单 就让Color Code桌面板 以为它调整自己的API 但实际上 它的请求已经被CC Switch 偷偷转发给了本地的AI模型 比如千万或者DBSIC等等 那现在开始执行第一步 就下载这个官方的Color Code桌面板 这个客户端 我们直接前往打开它 那先下载安装一下 打开以后 先把这个客户头给当下来 它下边是Windows版本 还有MacOS 这个Windows版本它有两个 第一个是32位的 或者是64位的 然后第二个是ARM结构的 一般情况大家选第一个就可以了 就选择这32位的 或者是64位版本 那么第一个登录的给当下来 总共是6兆左右 下载好以后 把这个Cloud Code的桌面板 拿进去安装下 下载好以后 先把这个桌面板打开 把最想画一下 一会儿才用到 安装好的KLU Code桌面板以后 来现在我们直接进第二步 来下载这个CCSWage这款客业项目 它才是本期重点 那么先前往打开它 打开以后 先给东西来 这款项目最近非常火 然后先来获取它最新版本 先前往打开它 打开以后往下拉 拉最底部 来把客户刀给东西来 它里面有这个Linux版本 还有MacOS Windows版本都有 到处根据情况去选择就可以了 这个选择Windows版本 把这个安装刀给东西来 就这个 点击下载 总共11帧左右 下载好以后 先把这个CCS位置 给它进行安装下 打开它 点击下一步 点击下一步 点击安装 点击Finish 安装好以后 这些困住面板了 我们先不用管它 一会再来配置 然后接下来执行第三步 就下载Unomar客户端 我们返回了刚才的点子下 把这最新版本的Unomar客户端 给它动下来 点击前往 打开它 当然部署本地AI模型方式 有很多种 但是onoma对系统来说是最友好的 打开以后我们就上方有个download的按钮 给它动下来 打开它 上面同样三个版本 第一个是macOS 第二个是linux 第三个是windows版本 到时候跟置其他选择就可以了 这个选择windows版本 点下载 总共是1.9G左右 下载 下载好以后 把onoma客户安装一下 打开它 打开以后 点击上方一个install 安装一下 如果你之前已经安装过这个Olamo 客户的话 那么我建议把它进行申请一下 给它申请到最新版本 目前最新版本是这个0.24.0这个版本 安装好以后 然后接下来开始安装这个本地模型 我们在上面用New Chat 然后接下来开始安装本地模型 它这里问我们是否需要登录账号 这我们先不用登录 因为直接来获取本地模型呢 比如你直接下载里面有个Gemma 4模型 或者千万3.6都是可以的 当然你下载的DPC跟21开源模型 或者千万3.6Glm都是可以的 像谷歌最新开源的Gemma4模型的话 它里面可供选择模型非常多 像这个9G的或者7G的 9.6G 18G 20G 7.2G 这都是它的量化版本 这倒是可以跟这些选择大小来进行选择 比如说这些选择这个Gemma4 24B模型的 打开它 打开以后 先我复制上发这个一键安装命令 复制好以后 在下方搜索栏里 我们输入一个CMD 打开我们的命迪制服 打开以后 我们手边去张贴一下 把这个最新开源的Gemma4 24B模型给动下来 所以我们确认一下 总共是17G左右 因为我的选择是24Gb的 所以我可以跑26B模型 但如果选择比较小的话 那么你可以选择其他尺寸的 它现在已经把开源的Gammer 4模型 拉去到本地了 当然我们也可以下载更多的本地模型 到时可以方便我们切换 比如现在我们可以再下载一个千万的3.6模型 我们底下千万打开它 开源的千万3.6模型的话 它最小的尺寸是17Gb 为了方便绝大部分的人用的话 那么现在我们切换它千万3.5吧 我直接切碗打开它 好 千万3.5的话就有更新的模型了 我们来看一下 它都有哪些尺寸了 嗯 里面都有1G 5G 4G 9G左右都有啊 如果你的显存是8G的话 那么记忆选择9G左右的 这样的话至少可以保 但这选择模型要注意啊 如果后面是只有TST的话 那说明它只是支持文本的 如果它后面是带这个TST加Image的 那说明它是多模态的 功能是不一样的 比如这些味道方面大家都能使用的话 那这也会选择千万3.5 9B的模型 这样给大家快遍出来 来下载一下 它总共在6.6G 这样的显示做是8G以内的都可以 然后现在我们重新再打开一个 面理提示符合窗口 打开以后 就直接一切粘贴下 来把这个千万3.59B模型 给它当下来 这个模型的话 绝大部分都能用 因为它总共在6G左右 真的显示做是8G左右的 都可以使用 好 这样的话 这个千万3.59B模型 它就部署好了 然后接下来说一下 如何把这个本地模型 对接到Cloud Code桌面板上去 然后先打开刚才下载好的CCSWitch这个客户 我们的上方有一个加号 回这里了 打开它 来进步数下 打开以后它下面有一个添加新的供应商 它不仅可以对写本地模型 也可以通过API对接 比方MiniMac是Kimi DeepSeek NVIDIA OpenLOD等等 因为我们对接是本地模型 所以这么选第一个就可以了 选自定性配置 就这里了 打开它 打开以后我们先往下拉 在下方这里这个模型供应商名称这里 我们可以随便自定一下 比如我输入这个OLOMA 然后背注的话可以自定一下 比如我们可以在这个模型面前来自定 输入个千分3.5吧 输入好以后 然后下方有一个官网链接 这样我们可以不用管它 有空就可以了 然后这个API Key 因为我们是本地模型 所以这个API Key 我们可以随便填写 比如就输入123456吧 都OK啊 都可以 输入好以后 然后下方有一个请求地址 这里要注意了 这个一定要填写我们 AUDOMA的本地调整地址 就127.0.0.1 然后后面开吨动口号 11434斜杠位1 停留好以后 在下方这里有API格式 这里我们需要切换一下 这里我们需要选第二个 就选择OpenInit进入模式 就选第二个 然后下方有个认证制度 这里我们需要切换一下 选第二个 就是这个AndroidPig API Key 选第二个就可以了 然后这里有个主模型 这里我们选择我们 千万3.5 9B这个模型 因为是本地模型 把它贴进来 然后后面有个Hiku模型 当然如果你下载多个模型的话 那么你可以在这里贴入不同的模型 比如你需要使用这个Gemma4这个模型的话 那么可以把这个模型贴进来 我先拿着千万三点五来做测试 测试好以后 我们在上方要添加按钮 给它添加进去 它就会在这里显示出来 我们在上方的启用按钮 那它上方有提示 要我们现在启用路由 那我们在上方有一个设置按钮 就这里了 打开它 打开以后 在上方的第二选项 就是路由功能 我们需要把本地路由给打开 就第一个选项 它默认是停止的 那我们展开它 展开以后 那现在需要把路由总快关给打开 打开以后 我们在上面有个继续启用 投资我们在主线上显示本地路由开关 给打开 打开以后在下方这里有一个路由启用 现在我们需要把第一个选项 就Cloud 路由转发给打开 然后这是它服务地址了 一会就要用的 然后现在我们需要确定一下 我们单机电脑上也没有开启一个虚拟化功能 因为很多电脑它是没有开启的 然后现在我们需要在下方搜索栏里 我们搜索关键词 启用或关闭Windows功能 然后找这个选项 我们打开它 然后打开就这样往下拉 首先我们需要把这个 Windows虚拟机这个节目平台 这个选项可以勾上 那下面还有一个 适用于Linux的Windows纸系统 可以勾选上 那接下来往下拉 下方还有一个虚拟机平台 这个选项我已经勾选上了 勾选好以后 基本点确定 来击安装下 它就开始搜索文件 来击安装了 好 安装好以后 来现在它邀请我们重新一下电脑 在重新之前 建议收藏一下我当前的这个教程 否则一会重新以后 你可能就找不到了 好 重新电脑以后 来现在打开我们CCCV去 这个客户端 打开以后确保一下当前本地路由它是运行中短 然后现在打开我们的Olamacode 如果它没有自动运行的话 那么记得打开它 因为它是托管本地模型的 同时打开我们的Codecode桌面板 打开它 然后现在需要进入Codecode开发者模式 打开以后我们的上面有一个商业横杆就这里了 打开它 接下来打开了一个help 然后一时打开开发者模式 选用enable开发者模式 然后上面有一个enable 请你启动一下 点击enable 点击以后它会重启一下 好重启打开以后 那基本上上了个三个横杆 这个时候没看到 它里面就出现一个开发者模式了 然后下面进行配置下 点击第三方的配置选项 进入以后 那现在需要把这网关地址进行填写一下 这个就是刚才我们在CTS位置上 获取的网关地址就这个了 它需要有个服务地址 给快遍出来 在这个CTS位置路由这里 把这地址填进来 那下面有个API Key 这个就是我们刚才这些设置的 因为我这些设置123456 那我就填进去123456 好 填写好以后 先往下拉 拉底部 现在我们需要把上方有一个引擎登录模式给打开 打开以后 这Cloud Code就会自动调用本地的API 看清以后 这边上方有一个导出功能 我们需要把配置文件给导出来 这里要注意 第一个配置文件它是用这个MacOS的 然后第二个是Windows的 因为我当天电脑是Windows 所以就选第二个就可以了 给它导出为注册表文件 给它放在桌面上 导出好以后我们给你保存一下 保存出来以后 然后现在准备右键 点击一个 以记者本打开它 然后编辑一下 然后既然我们却在底部注入这一行的命令 那它在CCC位置里 强行显示这三个模型的选项 到时你可以自由切换 尤其你起用多个模型的话 那么这功能是有必要开启的 好 现在好久不久保存一下 保存好以后 那么打按它 双击打开就可以了 打按注视表文件 点击4 这那么点击4就可以了 点击确定 好 运行注视表文件以后 那先把这个Cloud Code的桌面客户端 给它彻底退出来 那么直接关闭一下 给它关闭掉 然后同样在下方这里给它退出来 退出以后 然后重新打开这个Cloud Code的扣端 打开它 打开就这么学着本体广观 然后进行打开它 先来试一下来看行不行 比如说我来拿自我介绍一下 看它能不能调用这个本地模型 可以的 它是我的Cloud Work 是并且在你电脑上一个智能助手 帮助你自动化处理文件和任务 我可以帮你自动完成重复器工作 处理文档邮件 整理数据分析 执行代码和脚本 创建和编辑各种文件 调用网络搜索工具 并获得最新消息 目前我正在CloudWork 3P环境下这运行 今天论址是2026年5月15号 有什么我可以帮助你吗 单级选下有三个模型 其实这都是本地模型 都是通过这CZWork调用本地模型的 我们先来问他一下 看看他知不知道这个模型 比如输入 转移单级的底层模型是什么 他肯定不知道 他肯定会以为自己是Cloud模型 真的 他说我是Cloud的Hikku模型 这是一个Enterpeak开发的模型系统中的Hikku版本 真的是骗过去了 比方我切换来的Opus模型 他也会自己认为自己是Opus模型 其实是本地模型 他说我当前的底层模型是Opus 我的知识结识到2025年的5月 他真的是被骗过去了 在创举工作绘画的时候 这里面需要授权一下 否则的话它是没有权限的 他说你好 我是Cloud Code 按出屁股光风的命令行助手Cloud 专门帮助开发者完成软件工作任务 这样的话就可以了 如果你需要切换其他模型的话 那么可以在automa进行配置 门地上有一个边境按钮 到时候主要把这模型改进其他的 比如我们看一下 当前我这aluma里面有多少个模型 我们输入aluma 后面list 来看一下 我目前里面有两个模型 第一是签换3.5 9b模型 另外一个是gm4 26b模型 要签换的话就可以把这个模型名称给大家贴进来就可以了 改成这个gm4模型 做进保存就可以了 其他不用管 再使用的时候他就会签换到gm4模型了 因为其他他已经配置好了 那现在测试效果 比如输入要求 那帮我生成一个 Syber文科的个人网站主页 要求是动态背景 毛玻璃效果 打字机动画 音乐播放器 粒子特效 响应式布局 输入要求的话 我们得去发送一下 来看一下效果怎么样 我们先决明一下 它先开始了 其实它现在调用的是 Gamma 4本地模型 通过这种方式的话 你就不用花一份钱 完全通过本地模型 来调用这个Cloud Code的桌面板 它现在已经完成了 那只要稍微修改一下 这样一个Syber文科风格的 他就帮我们完成了 他现在跑的是本地模型 当前我的GPU几乎是百分百占用 现在帮我制作一个3D跑酷游戏 他现在开始了 当他制作完成以后 我发现使用不同的模型的话 效果是不一样的 这个是Gram4模型生成的效果 无论是功能的完整性 还是游戏的执行 都是没问题的 但这个千万模型的话 可能是因为这个模型比较小 所以他这个明显感觉功能是有问题的 大家看一下 无论怎么跑 他都能跑过去 这说明肯定是有问题的 更多好玩大家自己去测试 今天视频所用的全部资料 他们下载链接 我都放在视频下方