WEBVTT

00:00.000 --> 00:05.940
各位朋友早上好,今天咱们就来看看本周AI界几件暗流涌动的军备竞赛。

00:06.480 --> 00:13.680
从OpenAI秘密研发的超级新模型,到阿里悄悄上架的Q文新势力,信息量直接拉满。

00:13.680 --> 00:23.880
先看画面这份业内言报,里面指明Gemini 3.5 Flash表现平平,而OpenAI正研发规模超越Astra的全新预训练模型。

00:23.880 --> 00:31.880
与此同时,阿里团队在IOMARINA秘密测试代号Kiana的模型,其3D渲染能力让人惊艳。

00:31.880 --> 00:38.960
此外,图像生成领域有重爆进展,在OpenAI Sinside Day水印的Mona Lisa一线深竞技场。

00:38.960 --> 00:48.840
马斯克旗下的Groak Image 2.0也已经正式发布,目前在文生图榜单高居第二,综合表现同样不容小觑。

00:48.840 --> 00:59.840
遗憾的是,谷歌原本计划推出的120B超大体量模型Gemma V4 1200亿,近期爆出该项目已经被取消。

00:59.840 --> 01:03.840
看完这轮大盘盖揽,咱们先来深挖OpenAI的重爆核弹。

01:03.840 --> 01:10.840
知名爆料人Chris在推特指出,GPT5.5绝不是OpenAI今年最后一次大规模预训练。

01:10.840 --> 01:22.840
爆料里特别强调,虽然GPT6本身已经足够震撼,但OpenAI在年底前还会掏出代号为Dug的超级模型,预训练规模将直接创下历史新高。

01:22.840 --> 01:31.840
推文里甚至极其夸张地声称,Dug这款新模型的恐怖性能绝对会让之前的Fable显得像个原始玩具。

01:31.840 --> 01:38.840
不过对于它的发布时间线与代号对应关系,行业内目前依然存在不少争论与疑虑。

01:38.840 --> 01:48.840
比如知名博主TokenGremlin就公开反驳,指出SemiAnalysis在整理这份报告时,把7月初的Dug信息和后续的Astra给彻底搞混了。

01:48.840 --> 02:02.840
在他看来,Dug早在Astra之前就已经在内部报告中出现过,因此它极大概率只是Astra早期研发阶段的一个内部代号,而不是什么全新的后续迭代产品。

02:02.840 --> 02:15.840
毕竟OpenAI内部取代号向来都很随意,此前就曾用过像Mule 3,Mule 4这种混乱名称,最后才统一叫Astra,这也让外界很难做出精准判断。

02:15.840 --> 02:28.840
所以说,咱们目前依然无法百分百确定,Dug到底代表着一个全新的超大模型预训练流,还是只属于同一批预训练中的不同阶段检查点,依旧充满神秘感。

02:28.840 --> 02:41.840
而如果把视线转向谷歌,言报给出的结论就更残酷了。文章直接断言,Gimini 3 Pro已经是谷歌技术的高峰,近期Deepmind高层的变动更是加剧了内部焦虑。

02:41.840 --> 02:53.840
报告甚至预测,接下来的Gimini 3.5 Pro实力仅相当于OPUS 4.5,甚至不如GLM 5.2,面对Anthropic与OpenAI的死斗很难招架。

02:53.840 --> 03:09.840
不过其中最为引人注意的,仍然是这份言报尾部给出的重磅结论。OpenAI已经彻底克服了预训练的技术障碍,规模更为庞大的Dug模型正在全力推进,极可能在今年年底前彻底颠覆行业。

03:09.840 --> 03:23.840
聊完海外巨头的暗流涌动,咱们把视角转回国内。阿里团队最近在LM Arena的Code Arena上悄悄上线了一款代号为Kiana的全新检查点模型。

03:23.840 --> 03:37.840
不少开发者第一时间拿它跑起了硬核物理弹道测试,将Kiana与Cloud Opus 5以及GPT 5.6放在同等提示词下,进行3D前端代码生成的大比拼。

03:37.840 --> 03:52.440
而从最终实测运行效果来看,Kiana用3GS生成的弩炮模拟动画可以说是极其逼真,不仅整体结构非常完整,拉显和发射的物理交互更是丝滑顺畅。

03:52.440 --> 04:05.420
在我看来,这款神秘新模型在前端网页开发与复杂逻辑呈现上展现出的综合素质完全不逊色于目前市场上任何顶尖的第一梯队旗舰模型。

04:05.420 --> 04:12.880
如果大家也想亲自体验它的实力,可以去Alma Arena的下拉菜单里选择Fight Mode盲测模式。

04:13.540 --> 04:16.700
随后进入Code Arena,输入你想要的Prompt。

04:16.700 --> 04:23.360
在提交具体需求之后,系统会有两个完全匿名的模型同时在后台生成网页。

04:23.860 --> 04:27.980
用户需要通过对比双边生成的结果进行盲测投票。

04:28.420 --> 04:32.300
投票结束后,就会揭晓代码到底属于哪两款模型。

04:32.300 --> 04:36.880
不过由于抽取是随机的,想碰上Kiana得运气好或多刷几次。

04:37.460 --> 04:42.060
下面咱们就来看几个它生成的代表性高难度实战案例。

04:42.240 --> 04:44.740
咱们先来看这个极其惊艳的案例。

04:45.220 --> 04:50.740
提示词要求生成一个名为Aeroo One的360度互动耳机展示页面。

04:51.160 --> 04:53.280
Kiana生成的UI显得极其精致。

04:53.740 --> 04:55.400
黑金高级感直接拉满。

04:55.400 --> 05:01.200
更觉得是,这个页面不仅支持用鼠标全向拖拽旋转和自由缩放。

05:01.740 --> 05:08.920
点击耳机上的Touch Control Disk按钮,还会及时弹出极其精准的技术参数标签与提示。

05:09.480 --> 05:10.620
完成度非常高。

05:10.740 --> 05:15.440
而最让人惊叹的则是页面底部的动态配色切换功能。

05:16.060 --> 05:21.500
当点击不同颜色按钮,3D耳机的表面材质与光照渲染会实时改变。

05:21.500 --> 05:26.740
这种3GS代码实现水平,简直远远超越了大多数对手。

05:26.900 --> 05:31.360
看完了单独展示,咱们再来看一组直观的四方横向对比。

05:32.060 --> 05:35.060
在同等提示词下生成蒸汽朋克飞艇。

05:35.260 --> 05:42.800
四个画面分别由Cloud Ops 5米X,Kiana,Cloud Fable 5 High,以及Kuven 3.8 Max鲜染。

05:42.940 --> 05:46.300
大家仔细看右上角Kiana生成的这艘飞艇。

05:46.300 --> 05:56.540
无论是气囊的网格,复杂的金属管道,还是悬挂吊舱的细节丰富度,都明显碾压了左下角Fable 5 High生成的简化模型。

05:56.700 --> 06:01.400
虽然左上角Ops 5在材质与细节纹理上略微胜出一点点,

06:01.800 --> 06:10.300
但Kiana展示出的设计合理性,还有超强的复杂代码构建能力,已经完全能跟顶尖的Ops模型正面交锋了。

06:10.300 --> 06:24.340
结合刚才这一系列惊人表现,业内普遍推测这个代号Kiana的模型,极可能就是阿里即将发布的Q文4.0或Q文3.9大更新的前哨检查点,太值得期待了。

06:24.340 --> 06:33.500
咱们再看这组黄昏庄园3D场景的对抗,由Kiana与老牌Kwin3.8MaxShire展开直接PK,

06:34.040 --> 06:39.260
这次给到的高难度渲染要求是生成一个极致拟针的黄昏乡村庄园。

06:39.400 --> 06:43.300
大家可以清晰地看到,Kiana生成的庄园简直太惊艳了,

06:43.300 --> 06:51.800
不仅精细地还原了小巧的彩灯串与温馨的屋顶光影,周围还布局了层次丰富的花坛和森林。

06:52.460 --> 07:00.220
光影渲染的整体质感远远超越了下方的老版本,可以说是彻底坐实了它作为下一代大模型的绝对实力。

07:00.220 --> 07:06.100
聊完了代码与3D,咱们再把视线转向另一个卷道飞起的赛道,图像生成。

07:06.660 --> 07:15.540
最近在LM Arena竞技场里,也突然低调上线了一个代号叫Mona Lisa E的全新图像大模型,表现同样非常惹眼。

07:15.660 --> 07:23.140
而要说最锤的铁证,就是用OpenAI官方的验证工具去检测Mona Lisa E跑出来的图片。

07:23.340 --> 07:28.980
系统居然直接识别出了OpenAI自家专属的SynthID隐形水印。

07:28.980 --> 07:35.380
这下可以说是当场破案了,这就意味着OpenAI在图像生成领域也要掏出底牌了。

07:35.760 --> 07:44.660
无论接下来叫Chantypt Image 2.5还是直接升到3.0,画质与控图能力都将迎来脱胎换骨般的制飞跃。

07:44.760 --> 07:50.060
不过就在各大厂商猛砸算力的时候,谷歌这边却传来了一条坏消息。

07:50.300 --> 07:58.960
此前被开源社区寄予厚望的超大开源模型,减码V41200亿,最新爆料显示,已被官方彻底砍掉。

07:58.980 --> 08:14.840
根据泄露的后台界面显示,这款原本拥有1230亿参数,以及262K超百万级上下文窗口的开源旗舰大模型,已经被标记为了取消状态,确定不会再面向公众发布了。

08:14.840 --> 08:20.240
这也侧面印证了,谷歌在开源与避元战略之间正在经历剧烈的阵痛调整。

08:20.760 --> 08:28.660
他们很可能是想把全部计算资源集中起来,全力冲刺下一代避元Gemini,不得不说真挺令人唏嘘的。

08:28.660 --> 08:32.940
而除了OpenAI与谷歌,马斯克的Groak也不甘示弱。

08:33.300 --> 08:41.300
咱们一起来看看这些精美的生成范例,无论是波普风海报,细腻纺织纹理,还是素描步骤拆解。

08:41.840 --> 08:46.360
Groak Image 2.0在文字渲染和审美排版上都极其出色。

08:46.360 --> 08:55.040
按照惯例,看完软件层的神仙打架,咱们在结尾再来看一个极其硬核的巨身智能硬件项目。

08:55.400 --> 09:01.260
东京大学最新展示了一款名为Dragon的空中变形飞行机器人。

09:01.360 --> 09:11.040
它最令人惊叹的地方,就是彻底打破了传统无人机固定的形态限制,能在空中完成极度复杂的自由变体运动。

09:11.040 --> 09:21.080
大家仔细看,Dragon机器人在空中飞行时能精准改变关节构型,甚至能用身体灵活抓取并包裹移动悬挂物体。

09:21.680 --> 09:27.960
在结合了AI控制算法后,它生动展示了巨身智能在复杂空间下的无限潜力。

09:28.320 --> 09:33.500
从底层大模型到巨身智能,AI的进化爆发正全面到来。

09:33.960 --> 09:38.260
感谢你看到这里,这里是大雷早上好,关注频道,咱们下期见。

09:41.040 --> 10:11.020
感谢观看

