Unthorbit最强模型Cloud Fable 5全球金融 后面一直都有人想去效仿它 前有OpenRouter上线的Fusion模型 这个我之前也分享过 后有Transformer发明者Ion Jones 两人共同创办的AI创业公司Sakuna AI 才日本创建的 所以起了日本名字 所以说一款模型叫做Fugu Ultra 性能据说是比肩Cloud Fable和Mythos的 Fugu的声明中明确说 无需承担出口管风险的牵沿能力 也是针对Fable 5说的 在行业最严格的工程科学推理基准测试中的 Fugu跟Fable的对比模型看上去相差 无几几乎是可以匹配的 Mythos和Fable据说是一个单模型的架构 Fugu思路有点使这些巧劲 它的说法叫做集体智能 革新逻辑就是背后编排了 一整个可自由切换的AI的智能体池 碰到单一供应商限制时 能自动绕道 什么叫限制呢 就是被供应商没法实验它需要的能力 换模型继续跑 系统韧性是大幅提升的 从那图中可以看出来 Sakuna Fugu更像是一个编排的agent 它编排对应的有一系列的模型 包括了自己的模型 也包括了开源和避源的模型 它属于一个大模型的池子 Fugu会动态的编排全球最顶尖的模型 来完成复杂的多步骤任务 所以它的核心的观点是 未来比的不是谁的模型更大 而谁能把全球的模型编排得更好 更稳更自主 表有意思是Fugu Ultra 在SWE Bench Pro和Terminal Bench 2.1 两个基准测试上 都达到了当前的最优水平 性能是明显的提升 在科学推理方面 Fugu模型依然也表现显著 甚至超越了Methos Preview跟Fuble 5 这印证了Fugu的一个核心的能力 就是智能调度 成为了提升性能的另一个维度 并不依赖于增加更多的训练算理 在补充的基准测试中 Fugu和前沿的三个模型 Germel 3.1 Pro High Op4.8 Max GPT 5.5 X High 做了利民的对比 接受在这种情况 他们的Fugu也是很难打 我看了一下Fugu的运行机制 非常意思 它不是按照我们传统意义上的 用人工提示词来编排工作流 而是通过一个语言模型 作为一个骨干 基于Prompt上压文 来生成Hidden State 基于引擎状态 再来协调其他的工作模型的池子 就是说所有的编排工作 其实是在Hidden State内实现的 看了一下它的架构 它的语言模型 应该指的就是Sekona Fugu 这个模型 自己会生成一个Output 同时在Logits之前的Hidden State 又会路由出来 传到它的工作池里面的 所有的模型中 再由这些模型 去输出它的Logits 如果能做到这一步的话 应该它的所谓的工作池的模型 都是开源模型 因为必源模型 是没法接触它的Hidden State 作为Input来输出Logits 所以它整个过程的设影 也是比较巧妙 不是单纯的靠Agent编排 就能实现的一个路由逻辑 Fugu在训练阶段 是采用两步走 第一步是大规模的广度的监督微调 涵盖了编程 数学推理 语言理解 等多方面 第二步就是针对不同的单个任务 进一步的监督微调 实现端到端的优化 这里面 它们透露的一个点 就是用了不同的编码助手 就是Hardless的数据 包括Codex Cloud Code OpenCode等 收集了真实世界的多轮轨迹 构建了设计仓务上要文 迭代编程 工具调用 执行反馈 和最终任务的 多个端到端的任务用力虚拟