20260710 影片筆記

Mac mini / Hermes VideoNote

← 回首頁

20260710-01 | 把你的hermes打造成满血全模态:生图+生视频+图片理解+视频理解+语音生成~ | Agnes+Minimax M3

來源:BiliBili | 建立:2026-07-10T14:58:47 | 轉錄:whisper

影片演示如何透過接入外部模型與插件,將 Hermes Agent 從單文本模型擴展為具備文本生成、圖像生成、視頻生成、視覺理解及語音生成等「接近全模態」能力的智能體,並展示了具體的配置步驟與應用場景。

20260710-02 | 把你的hermes打造成满血全模态:生图+生视频+图片理解+视频理解+语音生成~ | Agnes+Minimax M3

來源:BiliBili | 建立:2026-07-10T15:02:54 | 轉錄:whisper

影片演示如何透過接入外部模型與插件,將 Hermes Agent 從單文本模型擴展為具備文本生成、圖像生成、視頻生成、視覺理解及語音生成等「接近全模態」能力的智能體,並展示了具體的配置步驟與應用場景。

20260710-03 | 我的贾维斯开源了,可以语音交互,控制多Agent编排【B站AI创造公开赛】

來源:BiliBili | 建立:2026-07-10T15:06:19 | 轉錄:whisper

講者開源其個人開發的語音控制多 Agent 系統 Home Rail,旨在模擬類似「賈維斯(Jarvis)」的家庭 AI 體驗。該系統運行於 NAS 或個人電腦,支援動態工作流編排與語音交互,目前定位為非開箱即用、需具備技術能力進行部署與調優的架構,並推薦透過 Coding Agent(如 Codex)進行調用而非直接使用前端 UI。

20260710-04 | 哈兰德:全世界表情管理倒数第一 #哈兰德 #魔人布欧哈兰德 #挪威 #美加墨世界杯 #足球#体育

來源:Youtube | 建立:2026-07-10T17:12:45 | 轉錄:whisper

影片介紹足球運動員哈蘭德(Haaland)的外貌體格、場上統治力與場下溫和性格,並回顧其從青年時期到帶領挪威隊晉級 2026 年世界盃的生涯軌跡,強調其作為具備絕對力量與極致射術的「超然存在」。

20260710-05 | 十字軍殺了我們的人,但我放下了宗教仇恨的執著 | 薩拉丁【天國王朝(4/4)】

來源:Youtube | 建立:2026-07-10T17:15:11 | 轉錄:whisper

本片從穆斯林歷史視角重新梳理電影《天國王朝》劇情與真實歷史,對比電影虛構與史實差異,並深入分析薩拉丁與貝里昂在耶路撒冷圍城戰中的互動,探討耶路撒冷從普通城市昇華為信仰象徵的過程,以及穆斯林世界從分裂到團結對抗十字軍的歷史轉變。

20260710-06 | AI 视频生成工具 MoneyPrinterTurbo 再体验

來源:Youtube | 建立:2026-07-10T17:17:57 | 轉錄:whisper

講者(自稱根果老師/更古老師)回顧並演示了 GitHub 上名為 Mamling Plin Tuber 的 AI 視頻生成工具,強調其近期更新(版本 1.2.7)已解決舊版穩定性問題,並支援 TTS 語音合成、聲音克隆及自動字幕等功能,建議用戶透過 Docker 或 Python 環境安裝,並配置大語言模型與 Pixos API 以生成視頻。

20260710-07 | 「Github一周热点121期」DeepSeek推理加速框架、Google设计记忆规范、AI投研技能包、AI渗透测试和免费开发者资源清单

來源:Youtube | 建立:2026-07-10T17:20:12 | 轉錄:whisper

本期影片匯總了 GitHub 一周熱點,重點介紹 DeepSeek 發布推理加速框架 Dispark 並完成高額融資、Google 開源設計規範文件 design.md 以解決 AI 前端記憶問題、AI 伯克希尔將價值投資工程化為 Agent 技能、Strix 一體化 AI 滲透測試工具,以及 Free4Dev 整理的開發者免費資源清單,並分享了兩份關於 A...

展示更多

本期影片匯總了 GitHub 一周熱點,重點介紹 DeepSeek 發布推理加速框架 Dispark 並完成高額融資、Google 開源設計規範文件 design.md 以解決 AI 前端記憶問題、AI 伯克希尔將價值投資工程化為 Agent 技能、Strix 一體化 AI 滲透測試工具,以及 Free4Dev 整理的開發者免費資源清單,並分享了兩份關於 AI 價值鴻溝與物理 AI 趨勢的報告。

20260710-08 | Loop Engineering 火了:AI Agent 的杠杆,正在从 Prompt 移到 Loop

來源:Youtube | 建立:2026-07-10T17:26:24 | 轉錄:subtitle

隨著 AI Coding Agent(如 Claude Code、Codex)能力的提升,開發重點正從單次的「提示詞工程(Prompt Engineering)」轉向設計自我迭代與可審計的「Loop 工程(Loop Engineering)」,透過雙執行機制、模組化架構及人工閘口,實現 Agent 的企業級可控與自動化複利。

20260710-11 | 只需要简单几部设置,大幅提升沉浸式翻译质量!!

來源:Youtube | 建立:2026-07-10T18:34:51 | 轉錄:subtitle

本影片教學如何針對非 Pro 會員的「沉浸式翻譯」瀏覽器插件,透過調整 OpenAI 模型的請求參數(如 Token 數量、段落數)及提示詞(Prompt),模擬智能上下文翻譯功能,從而顯著提升網頁文章與 YouTube 字幕的翻譯準確度與連貫性。

20260710-12 | 【セルフ白髪ぼかし】白髪染めが1番綺麗に染まる市販アッシュトリートメント徹底比較

來源:Youtube | 建立:2026-07-10T21:13:31 | 轉錄:whisper

由頭皮研究科若生美容師佐藤主講,針對希望在家自行處理白髮漸層(白髪ぼかし)的需求,透過純白髮與50%白髮混合髮束的實驗,徹底比較五款市售彩色護髮素(カラートリートメント)的染髮效果、紅調抑制及自然光下的反光表現,並推薦適合自然融合的產品。

20260710-14 | 🚀深度实测生产力核弹GPT-5.6 Sol编程能力有多离谱?真能取代Claude Fable 5?在Codex中表现亮眼超乎预期!开发效率倍程序员必备大模型!编程、SVG、Godot游戏、iOS开发

來源:Youtube | 建立:2026-07-10T22:27:03 | 轉錄:whisper

影片深度測試 Anthoropic 發布的 GPT-5.6 Soul 模型,驗證其知識截止日期至 2025 年 12 月,並在 SVG 動畫、3D 遊戲開發(使用 Streetgs/格斗引擎)、iOS 原生應用及瀏覽器自動化等多個複雜場景中展現出超越預期的人類式思考與邏輯推理能力,部分表現甚至被認為可能取代 CloudFable5。

20260710-16 | 特斯拉不賣車了?馬斯克「絕密底牌」曝光,這顆鐵疙瘩將掏空英偉達!😱

來源:Youtube | 建立:2026-07-10T22:32:31 | 轉錄:subtitle

影片解析特斯拉透過申請「Megapod」商標及自研 AI5 芯片,展現從算力消費者轉型為「算力地主」的戰略佈局;透過整合自研芯片、能源儲備、熱管理及晶圓廠等五層技術護城河,特斯拉不僅構建企業級數據中心,更將家用 Powerwall 轉化為分布式算力中心,透過廢熱回收與虛擬電廠(VPP)模式,實現從消費型住宅到自主造血算力發電廠的商業模式翻轉。

20260710-17 | [预览] 32B 逼近 Claude Opus|斯坦福 AutoMem:不堆参数

來源:Youtube | 建立:2026-07-10T22:43:07 | 轉錄:whisper

斯坦福大學研究團隊提出《自動學習記憶作為一種認知技能》(AutoMem),將大模型的記憶管理從被動的 RAG/向量資料庫轉化為模型可主動訓練的動作空間(read/write/search/append)。透過「Lock(鎖定/反思)」與「Plan(規劃)」兩階段歷程,32B 規模的開源模型在極客遊戲中性能提升 2-4 倍,超越 72B 級別模型,並達到與 C...

展示更多

斯坦福大學研究團隊提出《自動學習記憶作為一種認知技能》(AutoMem),將大模型的記憶管理從被動的 RAG/向量資料庫轉化為模型可主動訓練的動作空間(read/write/search/append)。透過「Lock(鎖定/反思)」與「Plan(規劃)」兩階段歷程,32B 規模的開源模型在極客遊戲中性能提升 2-4 倍,超越 72B 級別模型,並達到與 Cloud Opera 4.5 及 Jamlet 3.1 Pro Thinking 同等水平,同時大幅降低上下文增量與 API 成本。

20260710-18 | gpt-5.6 真实案例上手体验,慢工出细活,一个真正干活的模型。

來源:Youtube | 建立:2026-07-10T22:49:58 | 轉錄:subtitle

主講人透過遊戲優化與 API 計費功能兩個真實案例,實測 OpenAI 發布的 GPT-5.6 模型,指出其雖耗時較長(2-3 小時),但具備主動截圖測試、修復計劃外問題及自動優化的能力,展現出比前幾代模型更接近「真正干活」的工作模式,同時提醒使用者需注意模型可能進行的不必要修改或降級風險。

20260710-19 | SpaceXAI 發布 Grok 4.5!超低成本入手 Opus 級效能?跟 Claude Fable 比較,速度冠絕全場

來源:Youtube | 建立:2026-07-10T22:53:58 | 轉錄:whisper

影片實測對比了 Grog 4.5、Fable 與 GPT 系列 模型,發現 Grog 4.5 雖具備極高速度與接近 Opus 的性價比,但在視覺細節與格式微調上表現較弱;Fable 在創意與視覺任務上表現優異但價格較高;GPT 則以嚴謹的驗證機制適合後端工作流。

20260710-20 | GPT-5.6 正式登場!ChatGPT 直接操作電腦、做網站、即時翻譯

來源:Youtube | 建立:2026-07-10T22:59:09 | 轉錄:whisper

OpenAI 發布 GPT-5.6 系列模型(包含 Sol、Terra、Luna 三種規格),並推出 ChatGPT Work 企業版與全新桌面應用程式(Desktop App)。影片展示了模型在直接操作電腦(Computer Use)、生成互動式網站(Sites)、自動化工作流及農業管理等場景的應用,並強調了 Ultra Mode 的多代理協作能力與安全對...

展示更多

OpenAI 發布 GPT-5.6 系列模型(包含 Sol、Terra、Luna 三種規格),並推出 ChatGPT Work 企業版與全新桌面應用程式(Desktop App)。影片展示了模型在直接操作電腦(Computer Use)、生成互動式網站(Sites)、自動化工作流及農業管理等場景的應用,並強調了 Ultra Mode 的多代理協作能力與安全對齊措施。

20260710-22 | OpenAI凌晨发布GPT-Live:能打断、能同传,把我唬住了!#chatgpt #openai

來源:Youtube | 建立:2026-07-10T23:09:39 | 轉錄:whisper

影片對比測試了「豆包」與新發布的「Glock」系列模型(疑為 Grok 或特定內部模型),重點評估其語音延遲、方言同傳、邏輯推理及代碼審查能力,並指出新模型雖在技術上有所進步,但存在語音「恐怖谷效應」及代碼質量問題,整體表現被評價為偏向寫代碼而非陪聊,最終測試結果令人失望。