20260624-01 | 便宜模型组合打败 Fable 5?Fugu 和 Fusion 的编排秘密
影片解析了 Sakana AI 的 Fugu 與 OpenRouter 的 Fusion 兩種多模型編排方案,指出在地緣政治風險(如出口管制)與單一模型依賴的背景下,通過「學習式協調」與「結構化合成」的分工協作,低成本模型組合能在工程與深度研究任務上超越單一閉源巨獸(如 Fable 5),成為新的性能擴展與風險對沖路線。
Mac mini / Hermes VideoNote
影片解析了 Sakana AI 的 Fugu 與 OpenRouter 的 Fusion 兩種多模型編排方案,指出在地緣政治風險(如出口管制)與單一模型依賴的背景下,通過「學習式協調」與「結構化合成」的分工協作,低成本模型組合能在工程與深度研究任務上超越單一閉源巨獸(如 Fable 5),成為新的性能擴展與風險對沖路線。
日本 AI 公司 Sakana AI 提出 Fugu(河豚)模型,透過強化學習訓練模型具備「管理能力」,調度多個開源與閉源模型協作,在複雜任務中湧現出超越單一強大模型的專家能力。
本影片深度解析 GitHub 熱門開源專案 Stirling-PDF,強調其透過 Java、Spring Boot 與 Docker 技術,提供免費、可自架且具備 REST API 能力的 PDF 處理平台,旨在解決線上工具隱私洩露與傳統軟體高成本的痛點,讓使用者掌握資料主權。
日本公司 Sakana AI 發布的「河豚(Fugu)」系統在 SWE-bench Pro 編程榜上取得高分,超越多家大廠模型,但講者指出其本質為「多模型編排系統」而非獨立大模型,缺乏底層技術護城河,最終可能被大廠收購以獲取日本市場渠道。
影片介紹利用 AI 工具(影片稱之為 Glock)的「定時任務」功能,設定每日自動向國內郵箱推送翻牆節點連結,以此解決手動更新節點、節點失效或變慢的問題,並驗證了該免費方式在速度與穩定性上表現優異。
OpenAI 的 Codex 經過更新後,具備指揮其他 AI 工具(如 Gemini、Hedgin)協同工作的能力,使用者僅需透過自然語言指令,即可實現從文案撰寫、影片生成到多平台發布的「零滑鼠操作」全流程,無需學習其他 AI 技術。
影片介紹如何利用 GitHub 開源項目 Cowart 為 Codex 提供「無限畫布」功能,透過在本地 HTML 畫布上對圖片進行標註與截圖,將原圖與修改指令同時輸入 Codex,實現精準的「指哪改哪」圖片微調,無需學習傳統 PS 即可提升修圖效率。
講者演示了一款由「傳奇導師」分享的實時視頻翻譯與字幕提取工具,該工具支援選擇多種翻譯引擎(如百度、Google、GPT等),透過設定採集間隔與語言參數,實現對視頻音頻的實時監聽、識別、翻譯及字幕導出,主要應用於語言學習場景。
影片探討如何透過引入具備外部資訊獲取能力的 Agent(如 Agent Rich/Reach)來解決大型語言模型(Hermes)在內容創作與選題時「缺乏真實外部視角」的問題,強調從「內部瞎猜」轉向「外部查證」的工作流,並詳細分析了路由機制、Token 成本優化、隱私風險及商業數據工具的應用限制。
影片探討如何透過引入具備外部資訊獲取能力的 Agent(如 Agent Rich/Reach)來解決大型語言模型(Hermes)在內容創作與選題時「缺乏真實外部視角」的問題,強調從「內部瞎猜」轉向「外部查證」的工作流,並詳細分析了路由機制、Token 成本優化、隱私風險及不同工具(GitHub, X, Clay 等)的適用場景。
Sakana AI 發布的 Fugu Ultra 模型通過基於 Hidden State 的動態編排機制,協調開源與閉源模型池,在 SWE Bench Pro 等基準測試中達到 SOTA,並聲稱具備繞過出口管制限制的能力。