日本在AI领域里终于追上来了 终于不是中美两国的游戏了 Sakana AI也就是鱼AI 超越Mythos了大家好 欢迎收听老范讲故事的YouTube频道 咱们来解析一下这个故事 昨天 6月22日 日本一家叫做Sakana AI的 公司扔出来了一个东西 萨卡纳日语里头是鱼的意思 它生出来这个东西呢叫Fugu 日语的意思应该就是河豚 一上来就放了一张跑分图 SWE bench Pro 编程榜上 它最高档拿到了73.7分 把Anthropic的Claude Opus 4.8 69.2分和OpenAI的GPT-5.5 58.6分全都压在身下了 他甚至宣称 连Anthropic两个最强的Mythos和 Fable他都已经部分超越了 就是有些分数我比你还高 于是网上一片欢呼 说日本终于在AI领域里头赶上来了 不再是中美两国在这玩耍了 咱们呢先把结论放这 别急着高兴啊 这事看起来像追上来了 扒开一层看看 根本不是那么回事 萨卡纳这条鱼到底是真追上来了 还是又一次聪明的投机取巧呢 这期啊 咱们就把这条鱼 从头到尾给你拆开来瞅一瞅 在这呢要再补充一句啊 Mythos和Fable是萨卡纳自己宣布的口径 没有独立的第三方评测 原因也很简单 这两个模型现在禁用了 你只要不是美国公民 你使不了 所所以他们也没有 办法去拿出评测数据来 首先呢咱们先把表面一层打开看看 这条鱼到底长什么样呢 萨卡纳并不是一个突然 冒出来的草台班子啊 它有来头有产品有跑分 表面上看起来呢 确实是比较唬人 这公司呢 在东京创建的 2023年成立 它 一直主打的是不从0打造大模型 这个话大家仔细听啊 他没有从零打造大模型 而是把现成的模型 重新的组合编排一下 它的产品线上呢 一共有三条鱼啊 第一条鱼呢叫鲶鱼 3月24号发布的日语大模型 搭配了一个免费的Sakana Chat 中间发布的一条呢叫枪鱼 6月15日发布 自主研发的agent能不 盯着自己跑8小时 产出60-100页的战略报告 啊应该是瞄准Manus那样的产品去的 最新的也就是昨天 6月22日发布的叫河豚 它其实呢 是一个多模型的编排系统 他呢一共有三位创始人 CEO叫David Ha 他的名字就是David 后边是HA h a 按照广东拼音来说呢 这个人应该姓夏 这应该是一位华裔 虽然他在日本创业 他出生在香港 年幼的时候呢 随着父母去了加拿大 多伦多大学本科 东京大学博士 谷歌大脑做神经网络和进化算法 还当过Stability AI的研究负责人 第二位他的CTO呢 叫做里昂琼斯 英国人伯明翰大学出身 Transformer那篇论文Attention Is All You Need 八个作者之一啊 那是真大神 在谷歌干了12年 在这个团队里头 真正管技术和方向的人 就是这位大神了 还有一个人呢叫伊藤 这是这个公司的COO 东京大学法学 纽约大学法学院 带过日本独角兽的全球化市场 最更关键的是什么 这哥们出身于日本外务省 有外交和政府背景 所以呢这个公司是一个华人创始人 一个写了Transformer论文 的英国人管技术 一个有日本政府 背景的伊藤在管关系 真正的日本本土 又偏官方的 其实是伊藤 这个细节非常非常重要 下一个问题 这一次跑赢了Anthropic大模型 的这个河豚到底是什么 它不是一个模型 它是一个系统 所谓超越Mythos 超越的方法很关键 河豚自己没有前沿大模型 它是个编排器 把别人家的模型 拼出来一个高分 大家觉得哎呀 日本行了啊 其实不是这么回事 我为什么会管河豚叫 系统而不叫模型呢 因为它的核心是一套 AI工作流编排系统 现在有一个新词叫Loop Agent 循环智能体 过去我们干活啊 都是过程管理 或者叫顺序执行 先干什么 后干什么 啊从哪进去 从哪出来 画过流程图的人都知道 流程图里头有一个节点叫开始节点 有一个节点叫结束节点 我们在这两个节点 之间画整个的流程 而Loop Agent干的活是什么呢 我是转着圈干啊 我我有输入有要求 然后呢它有很多的大模型在 里边去承担不同的角色 有人负责拆解任务 有人负责 执行有人负责检查结果 如果检查不满意 那再转一圈 一直转到满意为止啊 这就是现在比较流行的 一种新的AI agent的工作方式 而河豚呢 恰恰是这样的一套系统 河豚最鸡贼的地方 也是最关键的一点 是什么呢 我不告诉你我这里头 到底放了哪些模型 但是我保证啊 我这里头没有放Fable 5和Mythos 5 因为他需要跟Fable 5和Mythos 5去竞争嘛 而且呢Fable 5和Mythos 5现在按照 美国商务部的要求 他也不能使 但是呢您说这里头有没有GPT-5.5啊 有没有Gemini 3啊 有没有DeepSeek呀有没有 Claude Opus 4.8呀 这个不说啊 但是我们跑分跑的比 Claude Opus 4.8还高一些 所以它大概率是怎么干活的呢 比如说你有一个任务进来了 而Opus 4.8负责拆解 拆解完了以后 GPT-5.5去执行 有一些不是特别关键的任务 可能就扔给DeepSeek去执行去了 执行完了以后呢 可能又扔回给Claude Opus 4.8 你检查一下 有问题没有 有问题的话来 再转一圈 啊一直转到说 我觉得可以了 再把这东西吐出来 啊这样的一个情况下 它跑分跑的比Claude Opus 4.8高 跑的比GPT-5.5高 甚至在个别指标上可以 超越Fable 5和Mythos 5 就是这样的一套系统 那河豚里头到底 有没有自己家的模型呢 还是有的啊 不是说前面那鲶鱼模型啊 那个鲶鱼模型实际上在DeepSeek V3.1的 一个版本上去做后训练出来的 也不是从头做的 待会咱们再讲那个模型 它这个河豚系统里头 有一个叫做指挥模型 一上来我可以稍微 的指挥调度一下啊 这个模型呢是用千问 2.5 7B 这个模型去做的后训练 做完了后训练以后 每一次任务进来 拆解可能还是要用大模型去拆解 但是呢 它负责在里边去进行循环调度 所以你说它完全没有自己的模型呢 这事也不对 咱们转过来说这个鲶鱼模型啊 鲶鱼模型呢 是DeepSeek V3.1 Terminus 在这个模型的基础上去做的后训练 除了DeepSeek V3.1 Terminus之外呢 它也参考了Llama 3.1 405B的一个开源底座 然后自己去训练了模型出来 别看咱们现在嘲笑他拿 别人的模型去后训练啊 大部分人连这一步都做不到 能够在人家的基础上做后训练 能够训练了以后有更好的效果 不是一般人能搞定的啊 有一个非常有意思的 细节DeepSeek原版呢 对于日本政治历史 敏感问题会拒绝回答 72%的问题都会拒绝 咱们中国人训练的模型 你去问它说抗日战争怎么回事啊 这个它好多它是答不上来的 而萨卡纳用自己的 日语数据后训练之后 拒答率几乎降到了零 说明它的价值是本土化适配 不是造更强的脑子 都没有触及最硬的东西 就是自己的前沿底层模型 下一个问题大家就要问了 没有前沿底层模型 人家不也跑的好好的吗 你咋就说人日本人不行呢 今天要跟大家讲 没有底层模型就没有护城河啊 编排这件事啊 本身是没有门槛的 谁都能做 而且你的命门是 拿捏在别人手里头的 这条路不光是Sakana 这个鱼公司一家在走 全球最大的模型聚合平台OpenRouter 6月12日就上线了一个 几乎一模一样的东西 叫做Fusion 它呢 可以把最多8个模型编排在一起 跑同一个问题 再让一个裁判模型把大家的答案 融合成一个 号称不用Fable五就 能够逼近Fable五的质量 成本只有Fable五的一半 他的角色分工和河豚是一个思路的 干活的检查的分开 而且干活的不允许自己检查 避免自己给自己打高分 openrouter自己说了 约75%的提升来自于裁判的融合 只有25%来自于模型的多样性 用这个对照就能说明 多模型编排是一个公开的 谁都能拼的工程手段 不是萨卡纳的独门秘技 一个东西如果连聚合 平台都能顺手做一个 它就不构成护城河了 那么到底什么是护城河 底座和价格才是护城河 底座模型是我自己的 我可以有底座模型价格的定价权 这个玩意才叫护城河 而现在这些东西都在谁手里 都在AI大厂手里 OpenAI、Anthropic、谷歌都在他们手里头 而且这些做编排系统的公司 他们只能用大厂 已经公开发布的模型 可是大厂经常会捂着一两代模型 甚至有很多模型从来就不发布 这些大厂自己最清楚 什么时候发新产品了 几款产品之间到底差在什么地方 等这些做编排系统的公司 也是像Sakana这样的公司 拿到大厂最新的模型 开始去研究怎么编排 怎么优化的时候 人家大厂内部的这种编排系统 Loop Agent系统 早就已经迭代了不知道多少回了 所以你想跟他们去比 根本就比不了 而且价格也不是萨卡纳 这样的公司能够控制的 你编排了半天 最后你还得老老实实上 Anthropic给人去付TOKEN的钱去 而且Anthropic没准哪天一 开心还给你把账号封了 Anthropic干这种事太正常不过了 OpenAI也是这样的 你说我用了GPT-5.5作为底层模型 我上头给你编排了一下 那你干完了活 你得上OpenAI交钱去啊 那 我把这个账算好了 最后把自己该挣的钱挣到 不就完事了吗 这里就有一个新的问题啊 大厂AI TOKEN的价格是不透明的 它可以把TOKEN的价格搞得很贵 把自己的套餐啊 20美金的plus套餐 把这个价格搞得很便宜 或者说我虽然是20美金 但是我给你的量给的很大 导致套餐里边的TOKEN很便宜 但是我在外边的TOKEN很贵 那大厂做这样的一个动作以后 花钱买TOKEN的 像Sakana那样的公司 不一把就没了吗 你的利润空间是完全 在人家的报表上啊 什么时候想弄死你 什么时候就弄死你 所以这个是完完全全没有护城河的 没有自己的底层模型 也没有模型的定价权 这就是萨卡纳这样 公司的尴尬的地方 编排这套手法本身就不保密 OpenRouter能上Fusion 大厂自己当然也都把编排 内置到自己的产品里去了 前面我们还专门录 了一期视频去分析 Fable 5被人破解出来的 12万字的系统提示词 实际上就是一套这样 的Loop Agent系统在运作 而且大厂随时可以 决定哪天去摁按钮 按完按钮以后 没准把你的API接口给你封了 或者是说咱把价格调整一下啊 我把TOKEN的价格涨一涨 我把套餐里边的用量给你涨一涨 那你们这些做编排的公司 不一把就被人挤死了吗 所以这种编 纯编排公司 本质上吃的是一个结构性的窗口期 窗口开着的时候呢 你有饭吃 窗口一关 你连桌子都上不了 而且这个事你自己 完全没有任何的主动权 啊所有的权利都在大厂手里头 人家随时想给你关 随时给你关上 当年谷歌就是这么把 一堆小广告平台干掉的 核心的价格和流量在谷歌手里头 你在某个环节优化的再漂亮 也架不住人家从源头上直接弄死你 讲到这呢 咱们稍微的把过去这段历史 跟今天的萨卡纳对比一下吧 咱们把时间拉回到 互联网刚开始的时候 那个时候呢 所有人都想明白了一件事 广告就是唯一的出路 大家都去做广告吧 于是有一大批公司就跑出来了 干嘛呢在广告各个细节 各个环节进行优化比如说 在投放优化 竞价优化 归因优化 广告网络之间的交换怎么去优化 怎么去进行计件 做了好多这样的系统出来 那你说这种系统技术有价值吗有啊 而且很多人的技术还是很扎实的 结果这些公司今天都哪去了 这些公司都死了 或者被大厂收购了 咱们现在一提说互联网广告公司 谷歌、Meta、苹果、X 中国的就是腾讯字节跳动 其他没了 那些小公司都被他们干掉了啊 原因很简单 这些大平台自己是有流量的 他可以随时决定涨价降价 你那些小公司优化了半天以后 你还是要用他的流量 那只能被他干掉 像我以前在猎豹移动 我们也做广告但是 我必须要去接谷歌和Meta的API 我要在那边去把这个流量跑出来 那他随时就可以弄死我呀 就是这么简单的一个情况 在这些啊广告公司里头 绝大部分是雨打风吹去就没了 极个别的做的特别好的会被收购 大厂重新把它买回来啊 完事了而且买进去以后呢 其实也不是要他们的技术 而是要他们的用户 要他们的流量啊 这就是当年的历史 跟今天的Sakana AI 是不是非常非常像 那你说日本这一次是不是又完蛋了 耍了一把小聪明 这个Sakana AI 骗了人的钱啊 最后做不出来东西 还让大家跟着白开心了半天 也不能这么讲啊 Sakana AI呢 它死不了 它最终有可能成为什么呢 就是被谷歌日本收购 或者被OpenAI或者Anthropic 日本直接把它收购掉 这个可能性是很大的 实在不行的话 字节跳动没准还来收你呢 正是因为没有护城河 被收购反而是Sakana AI最好的结局 他这个团队里头坐着 一位Transformer论文的作者 光这一块招牌 被日本OpenAI或者日本谷歌收购 的这个底层逻辑就算通了呀 你的这个定价也不会低 买它的人买的是三样东西啊 第一个是顶尖的团队啊 这看着没毛病 第二个已经铺好的 日本本土落地渠道 你这里头有一个日本外务省 的前官员坐在里头做COO呢 这故事讲得通吧 不需要去讲你具体干了什么 你把伊藤的这个简历往这一放 这故事不就明白了吗 而且你说他这个政企关系 或者日本大企业买单 这也没毛病啊 而且他有调DeepSeek的 历史 它可以把DeepSeek这种拒绝回答任何 日本历史敏感问题的一个模型 调到可以回答日本历史问题 这不,能力已经摆在这了 这三样东西恰恰是从外边 砸钱也比较难以买到的 做纯编排的公司 顶尖的那个结局就是被收购 这恰恰说明啊 它是有价值的 萨卡纳真正的护城河 根本就不在技术上 即使是它被收购了 比如被谷歌收购了 谷歌会用它的编排系统吗 不会的谷歌要的就是你的政府关系 你的整个团队 你懂日本 要的就是这东西 而且日本呢 有一个特别奇葩的地方 就是它对于本土的 产业保护的非常好 以前 我们的一个合作伙伴叫JVC 日本胜利公司 这公司哪来的 美国电气公司在 一九二几年在日本建的分公司 后来打仗的时候分离了 叫JVC了 一直发展的非常好 500强有时候在前边 有时候在后边 现在这几年不知道了啊 还有一个案例是谁 日本雅虎 雅虎在全球基本上都废了 但是日本雅虎 依然是日本最大的门户网站 虽然日本雅虎现在跟LINE合并了 母公司叫LY Corporation ,但是呢 它还是以日本雅虎 的这个底子出来的 所以如果谷歌或者是OpenAI、Anthropic 也许是字节跳动把这个 Sakana AI直接买下来了 就让你好好做日本这个生意 你去把所有关系给我打透 剩下技术的事情你就别问了 我们这有的是人给你搞定 啊这可能就是他未来的一个出路 所以Sakana AI未来不是要去跟OpenAI Anthropic谷歌这些大厂去竞争 他抢的这个生态位叫日本第一 所以这也不是日本追上来了 而是日本又长出了一个只 在日本有用的本土冠军啊 他是这样的一个故事 今天这故事对于普通人 对于创业者对于投资人来说 有什么样的启示呢 首先跟创业者讲清楚 不要在自己没有底层模型 的情况下做纯编排系统 做Loop Agent 也不要把这个东西当成主业去赌 这条路的天花板只有两个结局 做得好能够被大厂收购 做得差就什么都不剩了 最后会被价格战清洗掉 你要么手里有自己的模型 独家的数据 流量入口 要么就像萨卡纳一样 去卡一个本地市场 或者是政企关系 一个不可替代的位置 只优化中间环节 说我技术做的特别好 命门握在别人手里头 长期一定是个死 第二对于普通用户来说 能够使用原厂的 尽量使用原厂的 不要去使用这种第三方的编排系统 啊 他们在技术逻辑上是有 不可克服的先天缺陷的 因为他们只能拿别人已经 公开发布的模型再去进行优化 这个肯定是有问题的 而且呢像Sakana AI这样 它不告诉你后台是怎么运作的 不告诉你这个底层用了哪些模型 你就没有办法去相信它的结果 跑了半天 这个结果呢 我自己看着好像还行 但是你要想清楚一点 AI的运作速度是非常非常高的 它可以一分钟出一大堆结果出来 人的鉴别能力在这个面前 是非常非常苍白无力的 所以我们现在控制 结果的最好方法是什么 就是底层可知 底层有保障 萨卡纳AI这些东西是给不了的 对于投资者和内容创作者来说呢 看一家AI公司 先问两件事情 底座模型在不在自己手里 定价权在不在自己手里 编排层的公司估值要按照被收购 的可能性和被收购的预期来算 不能按照下一个OpenAI来算 把跑分超过谁当成卖点 尤其要警惕跑分是借来的 护城河才是自己的啊 这个一定要记住 最后给出结论 表面上这是日本终于在AI 开始追赶中美了的一个叙事实际上 这是一家没有自己 底层模型的编排公司 在重演互联网广告小平台的老路 技术很聪明 商业没有护城河 命门全在别人手里头 更长期来看 坂本 今天这条鱼公司 也就是萨卡纳AI 最大概率不会变成大海里的鲨鱼 而是会变成日本自家 鱼缸里头那条最贵的锦鲤 好看值钱 被别人买走 但是它始终游不出那个缸 对于整个AI大潮来说 它只是一个小小的水花啊 不会给整个的行业带来任何的变化 好今天故事就讲到这里 感谢大家收听 请帮忙点赞 点小铃铛 参加discussion群 也欢迎有兴趣有能力的 朋友加入我们的付费频道再见