各位朋友早上好 今天咱们就来看看本周AI界 几件暗流涌动的军备竞赛 从Openai秘密研发的超级新模型 到阿里悄悄上架的Qwen新势力 信息量直接拉满 先看画面这份业内研报 里面指明Gemini3.5Flash表现平平 而Openai正研发规模超越 Estrela的全新预训练模型 与此同时 阿里团队在Almerina 秘密测试代号Kiana的模型 其3D渲染能力让人惊艳 此外图像生成领域有重磅进展 带Openai since day水印的 蒙娜丽莎已现身竞技场 马斯克旗下的Grok image 2.0也已经正式发布 目前在文生图榜单高居第二 综合表现同样不容小觑 遗憾的是 谷歌原本计划推出的 120B超大体量模型Gemma V4 1,200亿 近期爆出该项目已经被取消 看完这轮大盘概览 咱们先来深挖Openai的重磅核弹 知名爆料人Chris在推特指出 GPT5.5绝不是Openai今年 最后一次大规模预训练 爆料里特别强调 虽然GPT6本身已经足够震撼 但Openai在年底前还会掏出代号为 bug的超级模型 预训练规模将直接创下历史新高 推文里甚至极其夸张的声称 bug这款新模型的恐怖性能 绝对会让之前的fable 显得像个原始玩具 不过对于它的发布 时间线与代号对应关系 行业内目前依然 存在不少争论与疑虑 比如知名博主 tokengrammaring就公开反驳 指出SEMI analysis在整理这份报告时 把7月初的dog信息和 后续的Astra给彻底搞混了 在他看来 dog早在Astra之前就已经 在内部报告中出现过 因此它极大概率只是 Asha早期研发阶段的一个内部代号 而不是什么全新的后续迭代产品 毕竟Openai内部取代号向来都很随意 此前就曾用过像 Milthree Milfour这种混乱名称 最后才统一叫Asha 这也让外界很难做出精准判断 所以说 咱们目前依然无法百分百确定 dog到底代表着一个全新 的超大模型预训练流 还是只属于同一批预 训练中的不同阶段检查点 依旧充满神秘感 而如果把视线转向谷歌 研报给出的结论就更残酷了 文章直接断言Gemini 3 Pro 已经是谷歌技术的高峰 近期deep mind高层的变动更 是加剧了内部焦虑 报告甚至预测 接下来的Gemini3.5Pro实力仅相当于Opus4.5 甚至不如GLM5.2 面对Anthropic与Openai的死斗 很难招架 不过其中最为引人注意的 仍然是这份研报 尾部给出的重磅结论 Openai已经彻底克服了 预训练的技术障碍 规模更为庞大的大g 模型正在全力推进 极可能在今年年底前彻底颠覆行业 聊完海外巨头的暗流涌动 咱们把视角转回国内 阿里团队最近在LLM Arena的code Arena上悄悄上线了一款代号 为piano的全新检查点模型 不少开发者第一时间拿它 跑起了硬核物理弹道测试 将提亚娜与Claude OPPO S5以及 GPT5.6放在同等提示词下 进行3D前端代码生成的大比拼 而从最终实测运行效果来看 提亚娜用threejs生成的 弩炮模拟动画可以说是 极其逼真 不仅整体结构非常完整 拉弦和发射的物理 交互更是丝滑顺畅 在我看来 这款神秘新模型 在前端网页开发与复杂逻辑呈现上 展现出的综合素质完全不 逊色于目前市场上任何 顶尖的第一梯队旗舰模型 如果大家也想亲自体验它的实力 可以去l美Arena的下拉菜单 里选择Beta mode盲测模式 随后进入code Arena 输入你想要的prompt 在提交具体需求之后 系统会有两个完全匿名的 模型同时在后台生成网页 用户需要通过对比双边 生成的结果进行盲测投票 投票结束后就会揭晓 代码到底属于哪两款模型 不过由于抽取是随机的 想碰上Kiana得运气好或多刷几次 下面咱们就来看几个它生成 的代表性高难度实战案例 咱们先来看这个极其惊艳的案例 提示词要求生成一个名为AIRO one的360度互动耳机展示页面 Tianna生成的UI显得极其精致 黑金高级感直接拉满 更绝的是 这个页面不仅支持用鼠标 全向拖拽旋转和自由缩放 点击耳机上的touch control DISC按钮 还会及时弹出极其精准 的技术参数标签与提示 完成度非常高 而最让人惊叹的则是页面 底部的动态配色切换功能 当点击不同颜色按钮 3D耳机的表面材质与 光照渲染会实时改变 这种threejs代码实现水平 简直远远超越了大多数对手 看完了单独展示 咱们再来看一组 直观的四方横向对比 在同等提示词下 生成蒸汽朋克飞艇 四个画面分别由Claude OPS 5米x Tiana Claude Fabo5嗨 以及昆仑3.8Max渲染 大家仔细看右上角 Tiana生成的这艘飞艇 无论是气囊的网格 复杂的金属管道 还是悬挂吊舱的细节丰富度 都明显碾压了左下角 FIB五h生成的简化模型 虽然左上角Opus5在材质与 细节纹理上略微胜出一点点 但Kiara展示出的设计合理性 还有超强的复杂代码构建能力 已经完全能跟顶尖的 Opus模型正面交锋了 结合刚才这一系列惊人表现 业内普遍推测 这个代号QIANA的模型 极可能就是阿里即将发布的 QWEN4.0或Qwen三点九大更新的 前哨检查点太值得期待了 咱们再看这组黄昏 庄园3D场景的对抗 由克亚娜与老牌 葵文3.8Max shy展开直接PK 这次给到的高难度渲染要求是 生成一个极致拟真的黄昏乡村庄园 大家可以清晰的看到 Tianna生成的庄园简直太惊艳了 不仅精细的还原了小巧的 彩灯串与温馨的屋顶光影 周围还布局了层次 丰富的花坛和森林 光影渲染的整体质感 远远超越了下方的老版本 可以说是彻底坐实了它作为 下一代大模型的绝对实力 聊完了代码与3D 咱们再把视线转向 另一个卷到飞起的赛道 图像生成 最近在Lrmina竞技场里 也突然低调上线了一个代号叫 蒙娜丽莎一的全新图像大模型 表现同样非常惹眼 而要说最锤的铁证 就是用Openai官方的验证工具去 检测蒙娜丽莎一跑出来的图片 系统居然直接识别出了Openai 自家专属的seed ID隐形水印 这下可以说是当场破案了 这就意味着Openai在图像 生成领域也要掏出底牌了 无论接下来叫ChatGPT image 2.5还是直接升到3.0 画质与控图能力都将 迎来脱胎换骨般的质飞跃 不过就在各大厂商猛砸算力的时候 谷歌这边却传来了一条坏消息 此前被开源社区寄予厚望的 超大开源模型Gemma V41,200亿 最新爆料显示已被官方彻底砍掉 根据泄露的后台界面显示 这款原本拥有1,230亿参数以及 262k超百万级上下文窗口的开源旗舰 大模型已经被标记为了取消状态 确定不会再面向公众发布了 这也侧面印证了谷歌在开源与闭源 战略之间正在经历剧烈的阵痛调整 他们很可能是想把 全部计算资源集中起来 全力冲刺下一代闭源Gemini 不得不说 真挺令人唏嘘的 而除了Openai与谷歌 马斯克的Grok也不甘示弱 咱们一起来看看 这些精美的生成范例 无论是波普风海报 细腻纺织纹理 还是素描步骤拆解 Grok image 2.0在文字渲染和 审美排版上都极其出色 按照惯例 看完软件层的神仙打架 咱们在结尾再来看一个极其 硬核的具身智能硬件项目 东京大学最新展示了一款名为 Dragon的空中变形飞行机器人 它最令人惊叹的地方就是彻底 打破了传统无人机固定的形态限制 能在空中完成极度 复杂的自由变体运动 大家仔细看 Dirogan机器人在空中飞行时 能精准改变关节构形 甚至能用身体灵活抓取 并包裹移动悬挂物体 在结合了AI控制算法后 它生动展示了具身智能在 复杂空间下的无限潜力 从底层大模型到具身智能 AI的进化爆发正全面到来 感谢你看到这里 这里是大雷早上好 关注频道 咱们下期见