# 影片筆記:Sakana推出Fugu多智能体编排、豆包Seed登榜Arena第8、Gemini 3.5 Pro将发布 | 6月22日 AI日报 ## 一句話總結 本期 AI 日報涵蓋多項重要動態:Sakana AI 推出 Fugu 多智能體系統以對標頭部模型並服務企業;豆包 Seed 2.1 Pro 在 LM Arena 表現亮眼;DeepMind 暗示 Gemini 3.5 Pro 即將發布;AWS 推出多項服務解決 AI 代理安全與業務背景問題;同時涵蓋三星、谷歌、OpenAI、Meta、蘋果、特斯拉及阿里雲的最新動態與模型排行榜資訊。 ## 核心重點 1. **Sakana AI 發布 Fugu 系統**:推出 Fugu 多智能體編排系統及核心模型 Fugu Ultra,旨在避開出口管制並服務企業複雜工作流,對標 Fable 5 與 Mathos。 2. **豆包 Seed 2.1 Pro 表現優異**:Seed 2.1 Pro Preview 進入 LM Arena WebDep AI 排行榜,評分接近 Cloud Opus 4.6,顯示國內模型在第三方盲測中接近頭部水平。 3. **DeepMind 新模型預告**:Reddit 用戶發現新徽章,暗示新一代 Gemini 3.5Pro 即將發布,社區討論其推理能力與 API 定價。 4. **AWS 推出 AI 代理解決方案**:在 AWS 峰會推出 AWS Continuum、AWS Context、AWS DevOps Agent、Piro 編碼代理及 Bedrup Agent Core,旨在解決 AI 代理缺乏業務背景與安全風險問題。 5. **科技巨頭動態**: * **三星**:向員工同步推出 ChatGPT Enterprise 與 Codex。 * **谷歌**:聯合 UCSC、UNC 推出 Visual Cloud 實時自我進化智能體,支持邊緣端運行。 * **OpenAI**:推送下一代語音模型 GPTBD,主打自然實時語音對話。 * **Meta**:網頁端推出 Artifacts 標籤頁。 * **蘋果**:受 AI 需求影響,確認將上調部分產品售價。 * **特斯拉**:申請 MagPod 商標,被視為從自研 DOJO 轉向外銷 AI 算力的戰略調整。 * **阿里雲**:百鏈 PPU 完成五項能力升級。 6. **模型排行榜競爭激烈**:CloudFable 5、CloudOpus 4.8、GPP 5.53 包攬前三,頭部開源與閉源差距收窄。 ## 詳細大綱 ### 一、 AI 動態板塊 * **Sakana AI** * 推出 Fugu 多智能體編排系統。 * 核心模型 Fugu Ultra 對標 Fable 5 與 Mathos。 * 目標:避開出口管制並服務企業複雜工作流。 * **豆包 (ByteDance)** * Seed 2.1 Pro Preview 進入 LM Arena WebDep AI 排行榜。 * 評分接近 Cloud Opus 4.6。 * 意義:顯示國內模型在第三方盲測中接近頭部水平。 * **DeepMind** * Reddit 用戶發現新徽章,暗示新一代 Gemini 3.5Pro 即將發布。 * 社區討論焦點:推理能力與 API 定價。 * **AWS (亞馬遜雲科技)** * 推出 AWS Continuum(自動化修復代碼漏洞)。 * 推出 AWS Context(知識圖譜注入業務知識)。 * 推出 AWS DevOps Agent(新增驗證功能)。 * 推出 Piro 編碼代理(iOS 應用)。 * 推出 Bedrup Agent Core。 * 目標:解決 AI 代理缺乏業務背景與安全風險問題。 * **三星 (Samsung)** * 向員工同步推出 ChatGPT Enterprise 與 Codex。 * 意義:標誌著生成式 AI 辦公落地進入全員級階段。 * **谷歌 (Google) 聯合 UCSC、UNC** * 推出 Visual Cloud 實時自我進化智能體。 * 功能:支持邊緣端運行與智能眼鏡。 * 效益:可降低視頻處理場景 API 調用成本約 98%。 * **Getty Images 與 OpenAI** * 達成展示合作協議。 * 內容:授權圖庫內容進入 ChatGPT 搜索與發現場景。 * 意義:被視為視覺版全方語聲程式 AI 頭部平台首次大規模合作。 * **OpenAI** * 下一代語音模型 GPTBD 向部分用戶推送。 * 特點:主打自然實時語音對話與雙向交互。 * 對標:ElevenLabs 等獨立服務。 * **高德與阿里** * 高德云圖接入阿里桌面 AI Agent CoderWork。 * 功能:商業經營類空間智能能力可直接調用。 * 意義:擴展阿里 AI Agent 生態至本地生活與空間數據。 * **Meta** * 網頁端推出全新 Artifacts 標籤頁。 * 功能:集中存儲 AI 生成的演示文稿、文檔、網頁等內容。 * 意義:縮小與 Cloud Artifacts 差距,對標 Enthropec 創意產品線。 ### 二、 科技公司板塊 * **蘋果 (Apple)** * 背景:受 AI 需求推升存儲芯片價格影響。 * 動態:庫克確認將上調部分產品售價。 * 預測:Mark Gurman 透露漲價將很快落地,iPhone 18 Pro 起售價或升至 1299 美元。 ### 三、 AI 基礎設施板塊 * **特斯拉 (Tesla)** * 動態:為名為 MagPod 的模塊化 AI 數據中心硬件提交商標申請。 * 描述:面向 AI 工作負載的完整自包含計算系統。 * 解讀:被視為從自研 DOJO 轉向外銷 AI 算力的戰略調整。 * **阿里雲 (Alibaba Cloud)** * 動態:百鏈 PPU 預製吞吐完成五項能力升級。 * 升級內容:長輸入支持、隱式緩存、容量計算、API、可觀測性。 * 影響:存量客戶自動沿用新規則。 * 解讀:被視為國內大模型 API 服務性價比競爭的延續。 ### 四、 模型排行榜板塊 * **頭部模型**:CloudFable 5、CloudOpus 4.8、GPP 5.53 包攬前三。 * **其他模型**:GLM 5.2 穩居第四,Deepseat V4 Pro 與 Quin 3.7 Max 緊隨其後。 * **趨勢**:頭部開源模型與閉源差距收窄至個位數,閉源巨頭競爭膠著。 ## 工具 / 模型 / 名詞整理 * **Sakana AI** * Fugu 多智能體編排系統 * Fugu Ultra 模型 * **對標/參考模型** * Fable 5 * Mathos * Cloud Opus 4.6 * Cloud Opus 4.8 * CloudFable 5 * GPP 5.53 * GLM 5.2 * Deepseat V4 Pro * Quin 3.7 Max * Gemini 3.5Pro * 3.5Flash * **豆包 (ByteDance)** * Seed 2.1 Pro Preview * LM Arena WebDep AI 排行榜 * WebDep Arena * **AWS (亞馬遜雲科技)** * AWS Continuum * AWS Context * AWS DevOps Agent * Piro 編碼代理 * Bedrup Agent Core * **OpenAI** * ChatGPT Enterprise * Codex * GPTBD * ElevenLabs * **其他公司/產品** * 三星 (Samsung) * 谷歌 (Google) * UCSC * UNC * Visual Cloud * Getty Images * 高德 (Amap) * 高德云圖 * 阿里 (Alibaba) * 阿里桌面 AI Agent CoderWork * Skill 套件 * MetaAI * Artifacts 標籤頁 * Cloud Artifacts * Enthropec * 蘋果 (Apple) * iPhone 18 Pro * 特斯拉 (Tesla) * MagPod * DOJO 訓練芯片 * 阿里雲百鏈 PPU 預製吞吐 ## 操作流程整理 * **AWS 服務部署流程**: 1. 使用 AWS Continuum 自動化修復代碼漏洞。 2. 通過 AWS Context 將知識圖譜注入業務知識。 3. 利用 AWS DevOps Agent 進行驗證。 4. 使用 Piro 編碼代理開發 iOS 應用。 5. 整合 Bedrup Agent Core 以解決業務背景與安全問題。 * **谷歌 Visual Cloud 部署**: 1. 部署實時自我進化智能體。 2. 支持邊緣端運行與智能眼鏡。 3. 實現視頻處理場景 API 調用成本降低約 98%。 * **阿里雲百鏈 PPU 升級**: 1. 完成長輸入支持、隱式緩存、容量計算、API、可觀測性五項能力升級。 2. 存量客戶自動沿用新規則。 ## 值得注意的限制或風險 * **出口管制風險**:Sakana AI 推出 Fugu 系統旨在避開出口管制。 * **AI 代理安全與背景缺失**:AWS 推出多項服務旨在解決 AI 代理缺乏業務背景與安全風險問題。 * **成本壓力**:蘋果因 AI 需求推升存儲芯片價格,導致產品售價上調。 * **競爭激烈**:頭部開源模型與閉源差距收窄至個位數,閉源巨頭競爭膠著。 ## 逐字稿辨識疑點 * **Fable 5**:逐字稿提及「對標 Fable 5」,疑點:通常為「GPT-4o」或「Claude 3.5」等,此處名稱不常見,需查證是否為特定模型或聽寫錯誤。 * **Mathos**:逐字稿提及「對標 Fable 5 與 Mathos」,疑點:疑為「Math」相關模型或聽寫錯誤,需查證。 * **WebDep AI**:逐字稿提及「LM Arena WebDep AI 排行榜」,疑點:常見為「LMSYS Chatbot Arena」,「WebDep」疑為聽寫錯誤或特定內部稱呼,需查證。 * **Cloud Opus 4.6 / 4.8**:逐字稿提及「Cloud Opus 4.6」及排行榜「CloudOpus 4.8」,疑點:通常為「Claude Opus」,「Cloud」前綴疑為聽寫錯誤或特定稱呼,需查證。 * **GPP 5.53**:逐字稿提及「GPP 5.53」,疑點:疑為「GPT-4o」或「GPT-4.5」等,「GPP」疑為聽寫錯誤,需查證。 * **Deepseat V4 Pro**:逐字稿提及「Deepseat V4 Pro」,疑點:疑為「DeepSeek V4 Pro」,「Deepseat」疑為聽寫錯誤,需查證。 * **Quin 3.7 Max**:逐字稿提及「Quin 3.7 Max」,疑點:疑為「Qwen 3.7 Max」或「Qwen-Max」,「Quin」疑為聽寫錯誤,需查證。 * **反效迹**:逐字稿提及「借反效迹促銷」,疑點:疑為「反季節」或特定促銷活動名稱,需查證。 * **DOJO**:逐字稿提及「DOJO 訓練芯片」,疑點:特斯拉確實有 Dojo 芯片,此處拼寫正確,但需確認上下文是否指代正確。 * **Enthropec**:逐字稿提及「對標 Enthropec 創意產品線」,疑點:疑為「Anthropic」或特定創意工具名稱,需查證。 * **Piro**:逐字稿提及「Piro 編碼代理」,疑點:疑為「Piro」或「Pilot」等,需查證。 * **Bedrup**:逐字稿提及「Bedrup Agent Core」,疑點:疑為「Bedrock」或特定產品名稱,需查證。 * **GPTBD**:逐字稿提及「GPTBD」,疑點:疑為「GPT-4o」或「GPT-4o Mini」等,「BD」疑為聽寫錯誤,需查證。 * **CoderWork**:逐字稿提及「阿里桌面 AI Agent CoderWork」,疑點:疑為「通義千問」或特定 Agent 產品名稱,需查證。 * **3.5Pro**:逐字稿提及「3.5Pro」,疑點:通常為「Gemini 1.5 Pro」或「Gemini Ultra」,「3.5」疑為聽寫錯誤,需查證。 * **CloudFable 5**:逐字稿提及「CloudFable 5」,疑點:疑為「GPT-4o」或「Claude 3.5」,「CloudFable」疑為聽寫錯誤,需查證。 ## 可延伸追問 * Fugu 多智能體系統具體如何運作以避開出口管制? * 豆包 Seed 2.1 Pro 在 LM Arena 的具體評分數據為何? * Gemini 3.5Pro 的推理能力與 API 定價預計為何? * AWS 推出的各項服務如何具體解決 AI 代理的安全與業務背景問題? * 谷歌 Visual Cloud 智能體在邊緣端運行的技術細節為何? * Getty Images 與 OpenAI 的合作具體涵蓋哪些內容與場景? * GPTBD 語音模型與 ElevenLabs 等競爭對手的具體差異為何? * 阿里桌面 AI Agent CoderWork 的功能與應用場景為何? * Meta Artifacts 標籤頁與 Cloud Artifacts 的具體差異為何? * 蘋果 iPhone 18 Pro 漲價對市場的影響為何? * 特斯拉 MagPod 與 DOJO 芯片的具體區別與戰略意義為何? * 阿里雲百鏈 PPU 升級後的具體性能提升為何? * 模型排行榜中頭部模型的具體性能指標為何?