# 影片筆記:Kimi K3 首曝实测!最强开源AI模型来了,代码能力直逼 Claude Fable 5? | 零度解说 ## 一句話總結 影片實測月之暗面(Moonshot AI)發布的全新 MOE 架構模型 **Kimi K3**(亦稱 KSAN),該模型擁有 2.5T 參數量與 100 萬 Token 上下文,在 3D 遊戲開發、前端編程及智能體(Agent)任務中展現出超越部分競爭對手(如 Claude 5、GPT 5.6 Pro)的生成質量,雖生成速度較慢,但被認為是當前開源陣營中最強的模型,且預計 API 價格極具競爭力。 ## 核心重點 1. **模型架構與規格**: * Kimi K3 採用全新 MOE(混合專家)架構,總參數量高達 2.5 兆(2.5T),為上一代 KI 系列的兩倍多。 * 原生上下文窗口支持 100 萬 Token。 * 具備多模態能力(影片口誤為「多么他能力」)。 * 已出現在 Kimi APP、命令行及桌面客戶端,無官方模型卡發布。 2. **智能體(Agent)能力**: * 擁有「K3 Agents 1」功能,支持大規模並行搜索和批處理。 * 可連續調用 4000 個工具運行 12 小時以上,展現強大的長期任務執行能力。 3. **實測表現與對比**: * **3D 與遊戲開發**:能通過單一 HTML 文件生成完整可運行的 3D 場景(如黑鷹直升機模擬、Microsoft 客戶版模擬),無需安裝 Unity、Unreal Engine 或 Blender。在 CGS 戰爭場景、宇宙模擬等測試中,視覺衝擊力與複雜度優於 Claude 5.5,且修復次數更少。 * **編程能力**:與 Claude 5(影片稱 CodeFable 5 / Fibbo 5.5)及 GPT 5.6 Pro 競爭激烈。在部分案例中輸出質量甚至更好,被評價為「目前見過最好的輸出之一」。 * **速度劣勢**:生成速度較慢,複雜任務需 10 幾分鐘起步,前端項目生成耗時約 35 分鐘,慢於 Claude 5。 4. **市場定位與影響**: * 整體質量介於 GPT 5.6 Pro 與 Claude 5.5 之間,但在 3D、遊戲、前端領域表現優異。 * 被認為可能是目前開源陣營中最強的模型。 * API 定價預計極具競爭力(僅為 OpOS 的十分之一)。 * 若延續開源傳統,將對開源社區及本地部署產生里程碑式影響。 ## 詳細大綱 ### 一、 K3 模型基本資訊與架構 * **發布狀態**:悄悄發布,無官方模型卡,但已出現在 Kimi APP、命令行及桌面客戶端。 * **技術架構**: * 全新架構的 MOE(混合專家)模型。 * 總參數量:2.5 兆(2.5T)。 * 上下文窗口:原生支持 100 萬 Token。 * **核心功能**: * 具備多模態能力。 * 招牌功能:K3 Agents 1(智能體風群),支持大規模並行搜索和批處理。 * 延續 Kimi 系列在上下文與 Agent 能力上的優勢,K3 可連續調用 4000 個工具運行 12 小時以上。 ### 二、 實測案例解析 * **案例 1:黑鷹直升機 3D 模擬(HTML 單文件)** * **任務**:輸入提示詞生成包含可直接運行的 HTML 文件,還原黑鷹直升機從啟動、起飛、盤旋到降落的完整過程。 * **結果**: * 一次性生成完整代碼,無需修改。 * 在瀏覽器中直接運行,無需安裝 Unity、Unreal Engine 或 Blender。 * 包含程序建模、動態光照、粒子特效、飛行動畫及交互控制。 * 視角包括:GPS 追蹤、坐標、電影環繞、塔台及空格暫停/繼續。 * **評價**:效果驚人,證明大模型可能改變網頁小遊戲及 3D 演示項目的開發方式。 * **案例 2:前端項目生成** * **表現**:生成一個前端項目耗時約 35 分鐘,速度慢於 Claude 5。 * **評價**:雖慢但質量高,被測試者稱為「目前見過最好的輸出之一」。 * **案例 3:編程能力對比** * **對比對象**:Claude 5(影片稱 CodeFable 5 / Fibbo 5.5)。 * **結果**:K3 與 Claude 5 打得有來有回,部分案例輸出質量甚至更好。 * **細節**:K3 使用了與 Claude 5 相同的提示實現機制(未在提示詞中指定),引發「學生超越老師」的討論。 * **案例 4:3D 與遊戲開發領域** * **CGS 戰爭場景**:一鏡到底,場景細節、光影、鏡頭運動由模型一次性生成。 * **Microsoft 客戶版模擬**:僅用一個 HTML 文件(單一腳本)生成完整可玩版本。 * **對比結果**:K3 在該領域被認為是第一個能與 Claude 5.5 Pro 抗衡的模型,且完成更快、修復更少。 * **宇宙模擬對比**:K3 版本複雜度、視覺衝擊力強於 Claude 5.5,但後者交互更穩。 * **其他測試**: * 對戰 OB4.8:K3 明顯勝出,被評價為具備 OB4.5 水平。 * 櫻花盆景測試:樹幹扭曲、分層細節還原度高,完全貼合提示。 * 前端設計:一次性生成完整網站,通過進場測試,動畫、配色、佈局成熟。 * **複雜任務**:4 分鐘生成相當於 GPT 5.6 Pro 水平的結果,一次性通過,僅光照處理有小問題。 ### 三、 綜合評價與市場影響 * **性能定位**: * 整體質量介於 GPT 5.6 Pro 與 Claude 5.5 之間。 * 在 3D、遊戲、前端方面可正面碾壓。 * 缺點:速度偏慢,複雜任務需 10 幾分鐘起步。 * 結論:不是最快的,但可能是目前開源陣營中最強的模型。 * **價格與生態**: * API 定價預計僅為 OpOS 的十分之一。 * 若延續 K2 系列開源開放權重傳統,將對開源社區及本地部署產生里程碑式影響。 * 2.5T 參數量需量化版才能在普通設備運行。 ## 工具 / 模型 / 名詞整理 * **月之暗面 (Moonshot AI)**:Kimi K3 的開發公司。 * **Kimi KSAN / Kimi K3 / K3**:影片中指代同一個新發布的 AI 模型。 * **MOE (混合專家)**:K3 採用的模型架構。 * **Kimi APP / 命令行 / 桌面客戶端**:K3 模型可用的介面。 * **K3 Agents 1**:K3 的智能體功能,支持大規模並行搜索和批處理。 * **CodeFable 5 / Fibbo 5.5 / Fibbo 5.5 PD**:影片中指代 Anthropic 的 Claude 系列模型(聽寫可能有誤)。 * **GPT 5.6 Pro / GPT5.6 Solo**:影片中指代 OpenAI 的 GPT 系列模型(聽寫可能有誤)。 * **OB4.8 / OB4.5**:影片中指代某模型版本(聽寫可能有誤,疑為 OpenAI o1 或類似型號)。 * **Depicic 21**:疑點,指代某開源模型(聽寫可能有誤)。 * **Unity / Unreal Engine (虛幻引擎) / Blender**:3D 開發常用軟體,K3 生成的 HTML 文件無需安裝這些軟體即可運行。 * **PowerMarket**:疑點,指代某平台(聽寫可能有誤,疑為 Hugging Face 或類似平台)。 * **OpOS**:疑點,指代某 API 服務(聽寫可能有誤)。 * **HTML 文件**:K3 生成 3D 場景的輸出格式。 * **瀏覽器**:運行 K3 生成的 HTML 文件的環境。 ## 操作流程整理 1. **訪問模型**:通過 Kimi APP、命令行或桌面客戶端訪問 Kimi K3 模型。 2. **輸入提示詞**: * 針對 3D 模擬(如黑鷹直升機):輸入描述啟動、起飛、盤旋、降落等過程的提示詞。 * 針對前端項目:輸入生成前端項目的需求。 * 針對 3D 遊戲場景:輸入包含場景細節、光影、鏡頭運動等要求的提示詞。 3. **模型生成**: * K3 進行計算,生成代碼或場景文件。 * 對於 3D 任務,生成單一 HTML 文件,內含腳本與資源。 * 對於 Agent 任務,模型連續調用工具(最多 4000 個)運行長達 12 小時。 4. **運行與驗證**: * 在瀏覽器中打開生成的 HTML 文件,驗證 3D 場景的可運行性。 * 檢查代碼質量、功能完整性及視覺效果。 * 對比其他模型(如 Claude 5、GPT 5.6 Pro)的輸出結果。 ## 值得注意的限制或風險 * **生成速度較慢**:相比競爭對手,K3 生成複雜任務(如前端項目)耗時較長(約 35 分鐘),複雜任務需 10 幾分鐘起步。 * **硬體要求高**:2.5T 參數量的模型需要量化版才能在普通設備上運行。 * **無官方模型卡**:模型悄悄發布,缺乏官方詳細的技術文檔與性能指標說明。 * **聽寫辨識不確定性**:影片中存在大量模型名稱與技術術語的聽寫錯誤(如 CodeFable, Fibbo, OB4.8 等),可能影響對具體技術細節的準確理解。 ## 逐字稿辨識疑點 * **Kimi KSAN**:影片標題及開頭使用此名稱,後文多稱為 K3 或 Kimi K3,需確認正式名稱。 * **没夜光学也没夜发布会**:聽寫錯誤,語意不通,疑為「沒有舉行任何發布會」或類似含義。 * **桌面客户端力**:多餘字詞「力」,疑為口誤。 * **多么他能力**:聽寫錯誤,疑為「多模態能力」。 * **K3 Agents 1**:功能名稱,需確認是否為正式命名。 * **避性搜索**:聽寫錯誤,疑為「並行搜索」或「並發搜索」。 * **偿萨下文**:聽寫錯誤,疑為「長上下文」。 * **KI.7 Code**:聽寫錯誤,疑為「Kimi 7 Code」或類似版本號。 * **黑音直升机**:聽寫錯誤,應為「黑鷹直升機」。 * **停机址**:聽寫錯誤,應為「停机坪」。 * **悬翼加速**:聽寫錯誤,應為「旋翼加速」。 * **GY参追踪视角**:聽寫錯誤,應為「GPS 追蹤視角」。 * **坐船视角**:聽寫錯誤,應為「坐標視角」或「座標視角」。 * **空格进化**:聽寫錯誤,應為「空格鍵」或「空格鍵控制」。 * **停机频**:聽寫錯誤,應為「停机坪」。 * **中报信号**:聽寫錯誤,應為「中報信號」或「重磅信號」。 * **PowerMarket**:聽寫錯誤,疑為「Hugging Face」或「OpenAI API Platform」等相關平台。 * **预论**:聽寫錯誤,應為「預熱」或「預覽」。 * **老个第一番**:聽寫錯誤,語意不明,疑為「老外第一個」或類似含義。 * **潮点**:聽寫錯誤,應為「槽點」。 * **慢工出气活**:聽寫錯誤,應為「慢工出細活」。 * **头对头**:聽寫正確,意為「對決」。 * **振留**:聽寫錯誤,應為「複製」或「模仿」。 * **毫不顺势**:聽寫錯誤,應為「毫不遜色」。 * **养手**:聽寫錯誤,應為「養虎為患」或「反殺」之意,語意不明。 * **印象前**:聽寫錯誤,應為「印象之前」或「以往」。 * **Microft客户版**:聽寫錯誤,應為「Microsoft 客戶版」或「Microsoft Flight Simulator」等。 * **一记闭上**:聽寫錯誤,應為「一鍵生成」或「一個閉環」。 * **路远难分**:聽寫錯誤,應為「難分伯仲」或「差距微小」。 * **各有求切**:聽寫錯誤,應為「各有千秋」。 * **提示实话**:聽寫錯誤,應為「提示詞」。 * **进进场测试**:聽寫錯誤,應為「進場測試」或「前端測試」。 * **敞出**:聽寫錯誤,應為「做出」或「生成」。 * **仓数量**:聽寫錯誤,應為「參數量」。 * **普通地上**:聽寫錯誤,應為「普通設備上」或「普通電腦上」。 * **CodeFable 5 / Fibbo 5.5**:影片中指代 Anthropic 的 Claude 系列模型,聽寫可能有誤。 * **GPT 5.6 Pro / GPT5.6 Solo**:影片中指代 OpenAI 的 GPT 系列模型,聽寫可能有誤。 * **OB4.8 / OB4.5**:影片中指代某模型版本,聽寫可能有誤,疑為 OpenAI o1 或類似型號。 * **Depicic 21**:疑點,指代某開源模型,聽寫可能有誤。 * **OpOS**:疑點,指代某 API 服務,聽寫可能有誤。 ## 可延伸追問 1. Kimi K3 的正式官方名稱為何?「KSAN」是否為特定版本或代號? 2. 影片中提到的「CodeFable 5」、「Fibbo 5.5」、「OB4.8」等模型名稱,實際對應的是哪些具體的 AI 模型版本? 3. K3 的 API 定價具體結構為何?「OpOS」指代的是哪家公司或服務? 4. K3 的 2.5T 參數量在量化後,對本地部署的硬體(如顯存、記憶體)具體要求是多少? 5. K3 Agents 1 的「大規模並行搜索」技術細節為何?如何實現連續調用 4000 個工具? 6. 月之暗面是否會公開 K3 的完整開源權重?若開源,將如何影響現有開源生態?