# 影片筆記:DeepSeek-V4-Flash接入Codex保姆级教程|再配一个识图Skill补齐视觉 p01 DeepSeek-V4-Flash接入Codex保姆级教程|再配一个识图Skill补齐视觉 ## 一句話總結 本影片詳細演示了如何在 8 月 2 日發布的最新版 **CloudX**(已與 ChatGPT 合併)中,透過 PowerShell 腳本一鍵配置 **DeepSeek V4 Flash** 模型,並額外安裝阿里雲「千問」模型作為 Skill,以補足 DeepSeek 原生缺乏的圖片識別(影片口誤稱為「石圖」)能力。 ## 核心重點 1. **模型性價比**:DeepSeek V4 Flash 被宣稱性能強悍,價格僅為頭部雲端服務的 1/90,具備極高性價比。 2. **環境合併**:CloudX 已與 ChatGPT 合併,安裝的是 ChatGPT 客戶端,但可通過菜單切換至 CloudX 模式。 3. **一鍵配置**:推薦使用 DeepSeek 官方文檔中的 PowerShell 腳本進行配置,無需手動修改複雜文件。 4. **視覺能力擴展**:DeepSeek V4 Flash 原生可能不支持圖片識別,需通過安裝第三方 Skill,使用阿里雲「千問」(Qwen)模型來實現圖片識別功能。 5. **界面設置限制**:切換至中文界面需要「科學上網」(梯子),因為語言設置開關位於雲端伺服器。 ## 詳細大綱 ### I. 前言與模型介紹 * **模型名稱**:DeepSeek V4 Flash(影片口誤多次稱為 Deep C V4 Flash 或 Devseek)。 * **性能與價格**: * 性能強悍,Angie 能力(疑點:可能指推理或特定能力指標)提升近 6 倍。 * 價格僅為頭部 Cloud 的 1/90,具備極高性價比。 * **版本狀態**:目前不支持 Pro 版本,Pro 尚未上線;當前教程適用於 V4 Flash,未來 Pro 上線後內容同樣適用。 * **軟件合併**:CloudX 已與 ChatGPT 合併,安裝的是 ChatGPT 客戶端,可通過菜單切換至 CloudX。 * **發布時間**:最新版本於 8 月 2 日正式發布。 ### II. 安裝 CloudX (ChatGPT) 客戶端 * **下載來源**: * 官方下載需科學上網。 * 影片提供整合包,存放於「福建」(疑點:可能指某個論壇或資源站名稱,或口誤)。 * 提供 Windows (X64/ARM64) 及 Apple 系統版本。 * **安裝步驟 (以 Windows 為例)**: 1. **確認系統架構**:右擊開始菜單 -> 系統,確認是 X64 還是 ARM64 處理器,選擇對應安裝包。 2. **執行安裝**:雙擊安裝包,選擇「ChatGPT」進行安裝。 3. **關鍵選項**:務必勾選「安裝後啟動」選項,因為需要首次啟動來生成配置文件夾。 4. **啟動與退出**: * 安裝後會自動啟動,網絡環境可能導致加載緩慢。 * **不需要登錄**。 * 安裝完成後,必須通過隱藏按鈕確保程序「絕對退出」(非最小化),以便後續配置。 5. **創建快捷方式**:從開始菜單找到程序,拖拽至桌面。 ### III. 配置 DeepSeek V4 Flash 模型 * **前置條件**: * 需註冊 DeepSeek API 開放平台帳號。 * 需充值少量金額(1-5元)以獲取 API Key。 * **配置方式**: * 參考 DeepSeek 官方文檔,推薦使用「第一種方式」(PowerShell 腳本)。 * Windows 系統使用 PowerShell 執行配置腳本。 * **操作步驟**: 1. 複製 PowerShell 配置命令。 2. 在系統 PowerShell 中執行命令。 3. 選擇數字 `1` 代表配置 V4 Flash 模型。 4. 輸入從 DeepSeek API 平台獲取的 API Key。 5. 完成模型揭露與 Key 配置。 ### IV. 驗證模型與界面設置 * **驗證可用性**: 1. 打開 ChatGPT (CloudX) 客戶端。 2. 客戶端會識別配置文件,無需登錄即可使用自定義模型。 3. 跳過歡迎界面,確認模型顯示為 DeepSeek V4 Flash。 4. 進行簡單對話測試,確認調用正常。 * **中文界面設置**: * **限制**:語言設置開關位於雲端伺服器,必須使用「科學上網」(梯子)才能切換。 * **步驟**: 1. 在設置 (Edit) 中將語言切換為「整體中文」。 2. 完全退出程序。 3. 啟用梯子(建議香港、新加坡或美國線路)。 4. 重新啟動 ChatGPT,選擇「是」處理彈窗。 5. 設置完成後,可斷開梯子,界面將保持中文。 ### V. 安裝「石圖」功能 (OCR/Image Capability) * **背景**:DeepSeek 原生不支持「石圖」(OCR/圖片識別),需通過 CloudX 安裝第三方 Skill。 * **模型選擇**:使用阿里雲的「千問」(Qwen)模型,提供 100 萬 token 免費額度。 * **配置步驟**: 1. **獲取模型地址**:從阿里雲百煉平台複製模型地址(如千問 3.7 plus)。 2. **獲取 API Key**:在阿里雲 API 平台創建 API Key。 3. **CloudX 內配置**: * 在 CloudX 中告知模型地址及 API Key。 * 設置請求權限為「替我審批」(避免每次詢問)。 * 執行安裝命令,等待 2-3 分鐘完成部署。 * **驗證石圖能力**: * 在 CloudX 中上傳圖片文件。 * 觀察是否能識別圖片內容或反推提示詞,確認具備「石圖」能力。 ## 工具 / 模型 / 名詞整理 | 類別 | 名稱/術語 | 備註/原文狀態 | | :--- | :--- | :--- | | **軟件/平台** | CloudX | 影片主要討論對象,已與 ChatGPT 合併 | | | ChatGPT | 客戶端名稱,與 CloudX 合併 | | | PowerShell | Windows 系統配置工具 | | | API 開放平台 | DeepSeek 及阿里雲提供的接口平台 | | **模型** | DeepSeek V4 Flash | 影片口誤多次稱為 "Deep C V4 Flash", "Devseek V4 Flash", "DVC VS Flash" | | | 千問 (Qwen) | 阿里雲模型,用於石圖功能,影片口誤稱為 "阿里千萬", "十字圖模型", "簽問" | | | 千問 3.7 plus | 具體使用的阿里雲模型版本 | | **功能/術語** | 石圖 | 影片口誤,應指 OCR 或 Image Understanding (圖片識別) | | | Angie | 影片口誤,指代不明,可能為某項性能指標 | | | 福建 | 影片口誤,指代資源存放位置,疑為論壇或網站名稱 | | | 科學上網 / 梯子 | 用於切換雲端語言設置的工具 | | | ProShare | 影片口誤,指 PowerShell | | | DevSig / Divisig / DevSick | 影片口誤,指 DeepSeek | | | Coldash / Coldex | 影片口誤,指 CloudX | | | Challenge GPT | 影片口誤,指 ChatGPT | | | 10周Skill | 影片口誤,指 10 萬 Skill 或相關 Skill 安裝過程 | ## 操作流程整理 1. **下載與安裝客戶端**: * 從非官方渠道(影片提及的「福建」)下載整合包。 * 確認系統架構(X64/ARM64)。 * 安裝 ChatGPT 客戶端,勾選「安裝後啟動」。 * 啟動後,通過隱藏按鈕確保程序「絕對退出」。 * 創建桌面快捷方式。 2. **獲取 API Key**: * 註冊 DeepSeek API 開放平台帳號。 * 充值少量金額(1-5元)。 * 獲取 API Key。 3. **配置 DeepSeek V4 Flash 模型**: * 打開 PowerShell。 * 複製 DeepSeek 官方文檔推薦的 PowerShell 配置命令。 * 執行命令,選擇數字 `1` 配置 V4 Flash 模型。 * 輸入 API Key。 4. **驗證與界面設置**: * 啟動 ChatGPT (CloudX) 客戶端。 * 確認模型顯示為 DeepSeek V4 Flash 並進行對話測試。 * 若需中文界面: * 在設置中切換為「整體中文」。 * 完全退出程序。 * 啟用梯子(科學上網)。 * 重新啟動客戶端,確認界面變為中文。 * 可斷開梯子。 5. **安裝「石圖」Skill (圖片識別)**: * 註冊阿里雲帳號,獲取 API Key。 * 從阿里雲百煉平台複製模型地址(如千問 3.7 plus)。 * 在 CloudX 中配置模型地址及 API Key。 * 設置請求權限為「替我審批」。 * 執行安裝命令,等待部署完成。 * 上傳圖片測試識別能力。 ## 值得注意的限制或風險 1. **網絡依賴**:官方下載客戶端及切換中文界面均需要「科學上網」(梯子)。 2. **Pro 版本未上線**:當前教程僅適用於 V4 Flash,Pro 版本尚未上線。 3. **原生功能限制**:DeepSeek V4 Flash 原生可能不支持圖片識別,需依賴第三方 Skill 擴展。 4. **配置邏輯混亂**:逐字稿中提到 "Devseek 是不支持石图的",隨後又說 "从 V4 这个版本开始,它支持一键配置 Codex,就直接揭露了,不用第三方的工具",這部分邏輯在影片中較為混亂,需查證 V4 Flash 是否原生支持圖片識別,或仍需通過 Skill 擴展。 ## 逐字稿辨識疑點 1. **模型名稱不一致**:逐字稿中多次出現 "Deep C V4 Flash", "Devseek", "DevSig", "Divisig", "DevSick", "DVC VS Flash",均指代同一個模型,但名稱混亂。 2. **功能名稱口誤**: * "石圖":多次出現,結合上下文(上傳圖片、反推提示詞),應為圖片識別或 OCR 相關功能,但原文堅持使用「石圖」。 * "Angie 能力":原文提及 "Angie 能力提升了近 6 倍",此詞彙在常見 AI 術語中不常見,疑為口誤或特定術語。 * "十字圖模型":指代阿里雲模型時出現的口誤。 * "10周Skill":指代安裝過程或 Skill 數量時的口誤。 3. **資源位置名稱**: * "福建":原文說 "安装包的全部放在福建当中",疑為特定論壇、網站或群組的名稱,或為嚴重口誤。 4. **軟件名稱變體**: * "Coldash", "Coldex", "Coldex":均指代 CloudX。 * "Challenge GPT":指代 ChatGPT。 * "ProShare":指代 PowerShell。 5. **技術細節存疑**: * 原文提到 "Devseek 是不支持石图的",隨後又說 "从 V4 这个版本开始,它支持一键配置 Codex,就直接揭露了,不用第三方的工具"。這部分邏輯在逐字稿中較為混亂,需查證 V4 Flash 是否原生支持圖片識別,或仍需通過 Skill 擴展。 * 原文提到 "Angie 能力",無法確認具體指代何種技術指標。 ## 可延伸追問 1. DeepSeek V4 Flash 是否真的原生支持圖片識別,還是必須通過 Skill 擴展? 2. 「Angie 能力」具體指代什麼技術指標或性能評測標準? 3. 「福建」具體是指哪個論壇、網站或資源站? 4. 阿里雲千問模型在 CloudX 中的具體配置參數和權限設置是否有更詳細的說明? 5. 如何確保在斷開梯子後,CloudX 的中文界面設置不會重置?