0:00.100–0:01.600
zh各位朋友早上好
0:01.600–0:03.933
zh今天咱们就来看看本周AI界
0:03.933–0:06.333
zh几件暗流涌动的军备竞赛
0:06.333–0:09.300
zh从Openai秘密研发的超级新模型
0:09.300–0:12.333
zh到阿里悄悄上架的Qwen新势力
0:12.333–0:13.833
zh信息量直接拉满
0:13.833–0:16.133
zh先看画面这份业内研报
0:16.133–0:19.600
zh里面指明Gemini 3.5 Flash表现平平
0:19.600–0:22.033
zh而Openai正研发规模超越
0:22.033–0:24.033
zh而Openai正研发规模超越Astra的全新预训练模型
0:24.033–0:25.066
zh与此同时
0:25.066–0:26.933
zh阿里团队在LMArena
0:26.933–0:29.600
zh秘密测试代号Kiana的模型
0:29.600–0:32.033
zh其3D渲染能力让人惊艳
0:32.033–0:35.033
zh此外图像生成领域有重磅进展
0:35.033–0:37.300
zh带OpenAI since day水印的
0:37.300–0:39.100
zh蒙娜丽莎已现身竞技场
0:39.100–0:41.100
zh马斯克旗下的Grok image
0:41.100–0:43.500
zh2.0也已经正式发布
0:43.500–0:46.700
zh目前在文生图榜单高居第二
0:46.700–0:49.066
zh综合表现同样不容小觑
0:49.066–0:50.333
zh遗憾的是
0:50.333–0:52.300
zh谷歌原本计划推出的
0:52.300–0:56.833
zh120B超大体量模型Gemma V4 1,200亿
0:56.833–0:59.633
zh近期爆出该项目已经被取消
0:59.633–1:01.066
zh看完这轮大盘概览
1:01.066–1:04.066
zh咱们先来深挖Openai的重磅核弹
1:04.066–1:06.700
zh知名爆料人Chris在推特指出
1:06.700–1:09.300
zhGPT5.5绝不是Openai今年
1:09.300–1:11.100
zh最后一次大规模预训练
1:11.100–1:12.433
zh爆料里特别强调
1:12.533–1:15.400
zh虽然GPT6本身已经足够震撼
1:15.400–1:18.933
zh但Openai在年底前还会掏出代号为
1:18.933–1:20.200
zhbug的超级模型
1:20.200–1:23.000
zh预训练规模将直接创下历史新高
1:23.000–1:25.333
zh推文里甚至极其夸张的声称
1:25.333–1:27.800
zhbug这款新模型的恐怖性能
1:27.800–1:29.933
zh绝对会让之前的fable
1:29.933–1:32.133
zh显得像个原始玩具
1:32.133–1:33.233
zh不过对于它的发布
1:33.233–1:35.700
zh时间线与代号对应关系
1:35.700–1:37.033
zh行业内目前依然
1:37.033–1:38.700
zh存在不少争论与疑虑
1:38.700–1:39.866
zh比如知名博主
1:39.866–1:42.266
zhtokengrammaring就公开反驳
1:42.266–1:45.233
zh指出SEMI analysis在整理这份报告时
1:45.300–1:47.433
zh把7月初的dog信息和
1:47.433–1:49.666
zh后续的Astra给彻底搞混了
1:49.666–1:50.466
zh在他看来
1:50.466–1:53.066
zhdog早在Astra之前就已经
1:53.066–1:55.200
zh在内部报告中出现过
1:55.200–1:57.300
zh因此它极大概率只是
1:57.300–2:00.400
zhAsha早期研发阶段的一个内部代号
2:00.400–2:03.000
zh而不是什么全新的后续迭代产品
2:03.000–2:06.600
zh毕竟Openai内部取代号向来都很随意
2:06.600–2:08.433
zh此前就曾用过像
2:08.433–2:11.000
zhMilthree Milfour这种混乱名称
2:11.000–2:12.933
zh最后才统一叫Asha
2:13.233–2:16.000
zh这也让外界很难做出精准判断
2:16.000–2:19.350
zh所以说,咱们目前依然无法百分百确定,
2:19.350–2:23.443
zhDug到底代表着一个全新的超大模型预训练流,
2:23.443–2:27.351
zh还是只属于同一批预训练中的不同阶段检查点,
2:27.351–2:28.840
zh依旧充满神秘感。
2:28.840–2:29.340
zh依旧充满神秘感
2:29.340–2:33.025
zh而如果把视线转向谷歌,言报给出的结论就更残酷了。
2:33.025–2:37.682
zh文章直接断言,Gimini 3 Pro已经是谷歌技术的高峰,
2:37.682–2:41.840
zh近期Deepmind高层的变动更是加剧了内部焦虑。
2:41.840–2:42.433
zh是加剧了内部焦虑
2:42.433–2:43.933
zh报告甚至预测
2:43.933–2:48.333
zh接下来的Gemini3.5Pro实力仅相当于Opus4.5
2:48.333–2:50.600
zh甚至不如GLM5.2
2:50.600–2:53.133
zh面对Anthropic与Openai的死斗
2:53.133–2:53.933
zh很难招架
2:53.933–2:59.297
zh不过其中最为引人注意的,仍然是这份言报尾部给出的重磅结论。
2:59.297–3:03.366
zhOpenAI已经彻底克服了预训练的技术障碍,
3:03.366–3:06.881
zh规模更为庞大的Dug模型正在全力推进,
3:06.881–3:09.840
zh极可能在今年年底前彻底颠覆行业。
3:09.840–3:10.840
zh极可能在今年年底前彻底颠覆行业
3:10.840–3:12.400
zh聊完海外巨头的暗流涌动
3:12.400–3:14.833
zh咱们把视角转回国内
3:14.833–3:18.433
zh阿里团队最近在LLM Arena的code
3:18.433–3:21.000
zhArena上悄悄上线了一款代号
3:21.000–3:23.833
zh为piano的全新检查点模型
3:23.833–3:25.933
zh不少开发者第一时间拿它
3:25.933–3:28.333
zh跑起了硬核物理弹道测试
3:28.733–3:31.500
zh将提亚娜与Claude OPPO S5以及
3:31.500–3:34.733
zhGPT5.6放在同等提示词下
3:34.733–3:38.000
zh进行3D前端代码生成的大比拼
3:38.000–3:40.761
zh而从最终实测运行效果来看,
3:40.761–3:44.583
zhKiana用3GS生成的弩炮模拟动画
3:44.583–3:46.494
zh可以说是极其逼真,
3:46.494–3:48.830
zh不仅整体结构非常完整,
3:48.830–3:52.440
zh渲染和发射的物理交互更是丝滑顺畅。
3:52.440–3:52.973
zh交互更是丝滑顺畅
3:52.973–3:53.473
zh在我看来
3:53.473–3:55.300
zh这款神秘新模型
3:55.300–3:58.466
zh在前端网页开发与复杂逻辑呈现上
3:58.466–4:01.000
zh展现出的综合素质完全不
4:01.000–4:03.266
zh逊色于目前市场上任何
4:03.266–4:05.600
zh顶尖的第一梯队旗舰模型
4:05.600–4:08.400
zh如果大家也想亲自体验它的实力
4:08.400–4:10.700
zh可以去lmaArena的下拉菜单
4:10.700–4:13.466
zh里选择Beta mode盲测模式
4:13.466–4:15.333
zh随后进入code Arena
4:15.333–4:16.866
zh输入你想要的prompt
4:16.866–4:19.000
zh在提交具体需求之后
4:19.000–4:21.200
zh系统会有两个完全匿名的
4:21.200–4:23.900
zh模型同时在后台生成网页
4:23.900–4:25.866
zh用户需要通过对比双边
4:25.866–4:28.400
zh生成的结果进行盲测投票
4:28.400–4:30.300
zh投票结束后就会揭晓
4:30.300–4:32.400
zh代码到底属于哪两款模型
4:32.400–4:34.266
zh不过由于抽取是随机的
4:34.266–4:37.500
zh想碰上Kiana得运气好或多刷几次
4:37.500–4:39.833
zh下面咱们就来看几个它生成
4:39.833–4:42.233
zh的代表性高难度实战案例
4:42.233–4:45.233
zh咱们先来看这个极其惊艳的案例
4:45.233–4:48.200
zh提示词要求生成一个名为AIRO ONE的360度互动耳机展示页面
4:48.200–4:51.066
zh提示词要求生成一个名为AIRO ONE的360度互动耳机展示页面
4:51.066–4:53.666
zhKiana生成的UI显得极其精致
4:53.666–4:55.533
zh黑金高级感直接拉满
4:55.533–4:56.600
zh更绝的是
4:56.600–4:58.700
zh这个页面不仅支持用鼠标
4:58.700–5:01.700
zh全向拖拽旋转和自由缩放
5:01.700–5:03.833
zh点击耳机上的touch control
5:03.833–5:04.933
zhDISC按鈕
5:04.933–5:07.033
zh还会及时弹出极其精准
5:07.033–5:09.400
zh的技术参数标签与提示
5:09.400–5:10.633
zh完成度非常高
5:10.633–5:13.133
zh而最让人惊叹的则是页面
5:13.133–5:16.000
zh底部的动态配色切换功能
5:16.000–5:17.900
zh当点击不同颜色按钮
5:17.900–5:19.866
zh3D耳机的表面材质与
5:19.866–5:21.900
zh光照渲染会实时改变
5:21.900–5:24.600
zh这种Three.js代码实现水平
5:24.600–5:26.900
zh简直远远超越了大多数对手
5:26.900–5:28.366
zh看完了单独展示
5:28.500–5:29.666
zh咱们再来看一组
5:29.666–5:32.066
zh直观的四方横向对比
5:32.066–5:33.533
zh在同等提示词下
5:33.533–5:35.433
zh生成蒸汽朋克飞艇
5:35.433–5:38.700
zh四个画面分别由Claude Opus 5、Qwen
5:38.700–5:40.733
enQwen、Claude Fastr 5 High
5:40.733–5:42.900
zh以及Qwen 3.8 Max渲染
5:42.900–5:44.300
zh大家仔细看右上角
5:44.300–5:46.833
zhTiana生成的这艘飞艇
5:46.833–5:48.566
zh无论是气囊的网格
5:48.566–5:50.133
zh复杂的金属管道
5:50.133–5:52.700
zh还是悬挂吊舱的细节丰富度
5:52.700–5:54.533
zh都明显碾压了左下角
5:54.533–5:56.666
zhFastr 5 High生成的简化模型
5:56.666–5:59.333
zh虽然左上角Opus5在材质与
5:59.333–6:01.733
zh细节纹理上略微胜出一点点
6:01.733–6:04.300
zh但Qwen展示出的设计合理性
6:04.300–6:07.033
zh还有超强的复杂代码构建能力
6:07.033–6:08.700
zh已经完全能跟顶尖的
6:08.700–6:10.666
zhOpus模型正面交锋了
6:10.666–6:12.900
zh结合刚才这一系列惊人表现
6:12.900–6:14.366
zh业内普遍推测
6:14.366–6:16.366
zh这个代号Qiana的模型
6:16.366–6:18.866
zh极可能就是阿里即将发布的
6:18.866–6:22.233
zhQwen 4.0或Qwen 3.9大更新的
6:22.233–6:24.533
zh前哨检查点太值得期待了
6:24.533–6:26.133
zh咱们再看这组黄昏
6:26.133–6:28.566
zh庄园3D场景的对抗
6:28.566–6:30.466
zh由Qiana與老牌
6:30.466–6:34.066
zhQwen 3.8 Max展开直接PK
6:34.066–6:36.633
zh这次给到的高难度渲染要求是
6:36.633–6:39.433
zh生成一个极致拟真的黄昏乡村庄园
6:39.433–6:40.966
zh大家可以清晰的看到
6:40.966–6:43.700
zhQiana生成的庄园简直太惊艳了
6:43.700–6:46.133
zh不仅精细的还原了小巧的
6:46.133–6:48.766
zh彩灯串与温馨的屋顶光影
6:48.766–6:50.333
zh周围还布局了层次
6:50.333–6:52.466
zh丰富的花坛和森林
6:52.466–6:54.333
zh光影渲染的整体质感
6:54.333–6:56.233
zh远远超越了下方的老版本
6:56.233–6:58.366
zh可以说是彻底坐实了它作为
6:58.366–7:00.366
zh下一代大模型的绝对实力
7:00.366–7:01.900
zh聊完了代码与3D
7:01.900–7:03.366
zh咱们再把视线转向
7:03.366–7:05.266
zh另一个卷到飞起的赛道
7:05.266–7:06.733
zh图像生成
7:06.733–7:09.166
zh最近在LMArena竞技场里
7:09.166–7:11.466
zh也突然低调上线了一个代号叫
7:11.466–7:14.133
zh蒙娜丽莎1的全新图像大模型
7:14.133–7:15.633
zh表现同样非常惹眼
7:15.633–7:17.700
zh而要说最锤的铁证
7:17.700–7:20.633
zh就是用Openai官方的验证工具去
7:20.633–7:23.700
zh检测蒙娜丽莎一跑出来的图片
7:23.700–7:26.266
zh系统居然直接识别出了Openai
7:26.266–7:29.366
zh自家专属的seed ID隐形水印
7:29.366–7:31.300
zh这下可以说是当场破案了
7:31.300–7:33.466
zh这就意味着Openai在图像
7:33.466–7:35.766
zh生成领域也要掏出底牌了
7:35.766–7:38.233
zh无论接下来叫ChatGPT image
7:38.233–7:40.700
zh2.5还是直接升到3.0
7:40.700–7:42.566
zh画质与控图能力都将
7:42.566–7:44.733
zh迎来脱胎换骨般的质飞跃
7:44.733–7:47.833
zh不过就在各大厂商猛砸算力的时候
7:47.833–7:50.533
zh谷歌这边却传来了一条坏消息
7:50.533–7:52.833
zh此前被开源社区寄予厚望的
7:52.833–7:56.133
zh超大开源模型Gemma V4 120B
7:56.133–7:59.133
zh最新爆料显示已被官方彻底砍掉
7:59.133–8:01.500
zh根据泄露的后台界面显示
8:01.500–8:05.533
zh这款原本拥有1,230亿参数以及
8:05.533–8:09.100
zh262k超百万级上下文窗口的开源旗舰
8:09.100–8:12.466
zh大模型已经被标记为了取消状态
8:12.466–8:14.766
zh确定不会再面向公众发布了
8:14.766–8:17.700
zh这也侧面印证了谷歌在开源与闭源
8:17.700–8:20.700
zh战略之间正在经历剧烈的阵痛调整
8:20.700–8:22.266
zh他们很可能是想把
8:22.266–8:23.966
zh全部计算资源集中起来
8:23.966–8:26.700
zh全力冲刺下一代闭源Gemini
8:26.700–8:27.366
zh不得不说
8:27.366–8:28.666
zh真挺令人唏嘘的
8:28.666–8:30.566
zh而除了Openai与谷歌
8:30.566–8:33.233
zh马斯克的Grok也不甘示弱
8:33.233–8:34.233
zh咱们一起来看看
8:34.233–8:36.633
zh这些精美的生成范例
8:36.633–8:38.166
zh无论是波普风海报
8:38.166–8:39.666
zh细腻纺织纹理
8:39.666–8:41.733
zh还是素描步骤拆解
8:41.733–8:44.166
zhGrok image 2.0在文字渲染和
8:44.166–8:46.433
zh审美排版上都极其出色
8:46.433–8:47.333
zh按照惯例
8:47.333–8:49.666
zh看完软件层的神仙打架
8:49.666–8:52.333
zh咱们在结尾再来看一个极其
8:52.333–8:55.366
zh硬核的具身智能硬件项目
8:55.366–8:58.566
zh东京大学最新展示了一款名为
8:58.566–9:01.566
zhDragon的空中变形飞行机器人
9:01.566–9:03.966
zh它最令人惊叹的地方就是彻底
9:03.966–9:07.266
zh打破了传统无人机固定的形态限制
9:07.266–9:09.166
zh能在空中完成极度
9:09.166–9:11.266
zh复杂的自由变体运动
9:11.266–9:12.466
zh大家仔细看
9:12.466–9:14.900
zhDragon机器人在空中飞行时
9:14.900–9:17.133
zh能精准改变关节构形
9:17.133–9:19.333
zh甚至能用身体灵活抓取
9:19.333–9:21.666
zh并包裹移动悬挂物体
9:21.666–9:23.866
zh在结合了AI控制算法后
9:23.866–9:26.266
zh它生动展示了具身智能在
9:26.266–9:28.300
zh复杂空间下的无限潜力
9:28.300–9:31.066
zh从底层大模型到具身智能
9:31.066–9:34.033
zhAI的进化爆发正全面到来
9:34.033–9:35.166
zh感谢你看到这里
9:35.166–9:36.666
zh这里是大雷早上好
9:36.666–9:37.533
zh关注频道
9:37.533–9:38.633
zh咱们下期见
0:00.100–0:01.600
各位朋友早上好
0:01.600–0:03.933
今天咱们就来看看本周AI界
0:03.933–0:06.333
几件暗流涌动的军备竞赛
0:06.333–0:09.300
从Openai秘密研发的超级新模型
0:09.300–0:12.333
到阿里悄悄上架的Qwen新势力
0:12.333–0:13.833
信息量直接拉满
0:13.833–0:16.133
先看画面这份业内研报
0:16.133–0:19.600
里面指明Gemini 3.5 Flash表现平平
0:19.600–0:22.033
而Openai正研发规模超越
0:22.033–0:24.033
而Openai正研发规模超越Astra的全新预训练模型
0:24.033–0:25.066
与此同时
0:25.066–0:26.933
阿里团队在LMArena
0:26.933–0:29.600
秘密测试代号Kiana的模型
0:29.600–0:32.033
其3D渲染能力让人惊艳
0:32.033–0:35.033
此外图像生成领域有重磅进展
0:35.033–0:37.300
带OpenAI since day水印的
0:37.300–0:39.100
蒙娜丽莎已现身竞技场
0:39.100–0:41.100
马斯克旗下的Grok image
0:41.100–0:43.500
2.0也已经正式发布
0:43.500–0:46.700
目前在文生图榜单高居第二
0:46.700–0:49.066
综合表现同样不容小觑
0:49.066–0:50.333
遗憾的是
0:50.333–0:52.300
谷歌原本计划推出的
0:52.300–0:56.833
120B超大体量模型Gemma V4 1,200亿
0:56.833–0:59.633
近期爆出该项目已经被取消
0:59.633–1:01.066
看完这轮大盘概览
1:01.066–1:04.066
咱们先来深挖Openai的重磅核弹
1:04.066–1:06.700
知名爆料人Chris在推特指出
1:06.700–1:09.300
GPT5.5绝不是Openai今年
1:09.300–1:11.100
最后一次大规模预训练
1:11.100–1:12.433
爆料里特别强调
1:12.533–1:15.400
虽然GPT6本身已经足够震撼
1:15.400–1:18.933
但Openai在年底前还会掏出代号为
1:18.933–1:20.200
bug的超级模型
1:20.200–1:23.000
预训练规模将直接创下历史新高
1:23.000–1:25.333
推文里甚至极其夸张的声称
1:25.333–1:27.800
bug这款新模型的恐怖性能
1:27.800–1:29.933
绝对会让之前的fable
1:29.933–1:32.133
显得像个原始玩具
1:32.133–1:33.233
不过对于它的发布
1:33.233–1:35.700
时间线与代号对应关系
1:35.700–1:37.033
行业内目前依然
1:37.033–1:38.700
存在不少争论与疑虑
1:38.700–1:39.866
比如知名博主
1:39.866–1:42.266
tokengrammaring就公开反驳
1:42.266–1:45.233
指出SEMI analysis在整理这份报告时
1:45.300–1:47.433
把7月初的dog信息和
1:47.433–1:49.666
后续的Astra给彻底搞混了
1:49.666–1:50.466
在他看来
1:50.466–1:53.066
dog早在Astra之前就已经
1:53.066–1:55.200
在内部报告中出现过
1:55.200–1:57.300
因此它极大概率只是
1:57.300–2:00.400
Asha早期研发阶段的一个内部代号
2:00.400–2:03.000
而不是什么全新的后续迭代产品
2:03.000–2:06.600
毕竟Openai内部取代号向来都很随意
2:06.600–2:08.433
此前就曾用过像
2:08.433–2:11.000
Milthree Milfour这种混乱名称
2:11.000–2:12.933
最后才统一叫Asha
2:13.233–2:16.000
这也让外界很难做出精准判断
2:16.000–2:19.350
所以说,咱们目前依然无法百分百确定,
2:19.350–2:23.443
Dug到底代表着一个全新的超大模型预训练流,
2:23.443–2:27.351
还是只属于同一批预训练中的不同阶段检查点,
2:27.351–2:28.840
依旧充满神秘感。
2:28.840–2:29.340
依旧充满神秘感
2:29.340–2:33.025
而如果把视线转向谷歌,言报给出的结论就更残酷了。
2:33.025–2:37.682
文章直接断言,Gimini 3 Pro已经是谷歌技术的高峰,
2:37.682–2:41.840
近期Deepmind高层的变动更是加剧了内部焦虑。
2:41.840–2:42.433
是加剧了内部焦虑
2:42.433–2:43.933
报告甚至预测
2:43.933–2:48.333
接下来的Gemini3.5Pro实力仅相当于Opus4.5
2:48.333–2:50.600
甚至不如GLM5.2
2:50.600–2:53.133
面对Anthropic与Openai的死斗
2:53.133–2:53.933
很难招架
2:53.933–2:59.297
不过其中最为引人注意的,仍然是这份言报尾部给出的重磅结论。
2:59.297–3:03.366
OpenAI已经彻底克服了预训练的技术障碍,
3:03.366–3:06.881
规模更为庞大的Dug模型正在全力推进,
3:06.881–3:09.840
极可能在今年年底前彻底颠覆行业。
3:09.840–3:10.840
极可能在今年年底前彻底颠覆行业
3:10.840–3:12.400
聊完海外巨头的暗流涌动
3:12.400–3:14.833
咱们把视角转回国内
3:14.833–3:18.433
阿里团队最近在LLM Arena的code
3:18.433–3:21.000
Arena上悄悄上线了一款代号
3:21.000–3:23.833
为piano的全新检查点模型
3:23.833–3:25.933
不少开发者第一时间拿它
3:25.933–3:28.333
跑起了硬核物理弹道测试
3:28.733–3:31.500
将提亚娜与Claude OPPO S5以及
3:31.500–3:34.733
GPT5.6放在同等提示词下
3:34.733–3:38.000
进行3D前端代码生成的大比拼
3:38.000–3:40.761
而从最终实测运行效果来看,
3:40.761–3:44.583
Kiana用3GS生成的弩炮模拟动画
3:44.583–3:46.494
可以说是极其逼真,
3:46.494–3:48.830
不仅整体结构非常完整,
3:48.830–3:52.440
渲染和发射的物理交互更是丝滑顺畅。
3:52.440–3:52.973
交互更是丝滑顺畅
3:52.973–3:53.473
在我看来
3:53.473–3:55.300
这款神秘新模型
3:55.300–3:58.466
在前端网页开发与复杂逻辑呈现上
3:58.466–4:01.000
展现出的综合素质完全不
4:01.000–4:03.266
逊色于目前市场上任何
4:03.266–4:05.600
顶尖的第一梯队旗舰模型
4:05.600–4:08.400
如果大家也想亲自体验它的实力
4:08.400–4:10.700
可以去lmaArena的下拉菜单
4:10.700–4:13.466
里选择Beta mode盲测模式
4:13.466–4:15.333
随后进入code Arena
4:15.333–4:16.866
输入你想要的prompt
4:16.866–4:19.000
在提交具体需求之后
4:19.000–4:21.200
系统会有两个完全匿名的
4:21.200–4:23.900
模型同时在后台生成网页
4:23.900–4:25.866
用户需要通过对比双边
4:25.866–4:28.400
生成的结果进行盲测投票
4:28.400–4:30.300
投票结束后就会揭晓
4:30.300–4:32.400
代码到底属于哪两款模型
4:32.400–4:34.266
不过由于抽取是随机的
4:34.266–4:37.500
想碰上Kiana得运气好或多刷几次
4:37.500–4:39.833
下面咱们就来看几个它生成
4:39.833–4:42.233
的代表性高难度实战案例
4:42.233–4:45.233
咱们先来看这个极其惊艳的案例
4:45.233–4:48.200
提示词要求生成一个名为AIRO ONE的360度互动耳机展示页面
4:48.200–4:51.066
提示词要求生成一个名为AIRO ONE的360度互动耳机展示页面
4:51.066–4:53.666
Kiana生成的UI显得极其精致
4:53.666–4:55.533
黑金高级感直接拉满
4:55.533–4:56.600
更绝的是
4:56.600–4:58.700
这个页面不仅支持用鼠标
4:58.700–5:01.700
全向拖拽旋转和自由缩放
5:01.700–5:03.833
点击耳机上的touch control
5:03.833–5:04.933
DISC按鈕
5:04.933–5:07.033
还会及时弹出极其精准
5:07.033–5:09.400
的技术参数标签与提示
5:09.400–5:10.633
完成度非常高
5:10.633–5:13.133
而最让人惊叹的则是页面
5:13.133–5:16.000
底部的动态配色切换功能
5:16.000–5:17.900
当点击不同颜色按钮
5:17.900–5:19.866
3D耳机的表面材质与
5:19.866–5:21.900
光照渲染会实时改变
5:21.900–5:24.600
这种Three.js代码实现水平
5:24.600–5:26.900
简直远远超越了大多数对手
5:26.900–5:28.366
看完了单独展示
5:28.500–5:29.666
咱们再来看一组
5:29.666–5:32.066
直观的四方横向对比
5:32.066–5:33.533
在同等提示词下
5:33.533–5:35.433
生成蒸汽朋克飞艇
5:35.433–5:38.700
四个画面分别由Claude Opus 5、Qwen
5:38.700–5:40.733
Qwen、Claude Fastr 5 High
5:40.733–5:42.900
以及Qwen 3.8 Max渲染
5:42.900–5:44.300
大家仔细看右上角
5:44.300–5:46.833
Tiana生成的这艘飞艇
5:46.833–5:48.566
无论是气囊的网格
5:48.566–5:50.133
复杂的金属管道
5:50.133–5:52.700
还是悬挂吊舱的细节丰富度
5:52.700–5:54.533
都明显碾压了左下角
5:54.533–5:56.666
Fastr 5 High生成的简化模型
5:56.666–5:59.333
虽然左上角Opus5在材质与
5:59.333–6:01.733
细节纹理上略微胜出一点点
6:01.733–6:04.300
但Qwen展示出的设计合理性
6:04.300–6:07.033
还有超强的复杂代码构建能力
6:07.033–6:08.700
已经完全能跟顶尖的
6:08.700–6:10.666
Opus模型正面交锋了
6:10.666–6:12.900
结合刚才这一系列惊人表现
6:12.900–6:14.366
业内普遍推测
6:14.366–6:16.366
这个代号Qiana的模型
6:16.366–6:18.866
极可能就是阿里即将发布的
6:18.866–6:22.233
Qwen 4.0或Qwen 3.9大更新的
6:22.233–6:24.533
前哨检查点太值得期待了
6:24.533–6:26.133
咱们再看这组黄昏
6:26.133–6:28.566
庄园3D场景的对抗
6:28.566–6:30.466
由Qiana與老牌
6:30.466–6:34.066
Qwen 3.8 Max展开直接PK
6:34.066–6:36.633
这次给到的高难度渲染要求是
6:36.633–6:39.433
生成一个极致拟真的黄昏乡村庄园
6:39.433–6:40.966
大家可以清晰的看到
6:40.966–6:43.700
Qiana生成的庄园简直太惊艳了
6:43.700–6:46.133
不仅精细的还原了小巧的
6:46.133–6:48.766
彩灯串与温馨的屋顶光影
6:48.766–6:50.333
周围还布局了层次
6:50.333–6:52.466
丰富的花坛和森林
6:52.466–6:54.333
光影渲染的整体质感
6:54.333–6:56.233
远远超越了下方的老版本
6:56.233–6:58.366
可以说是彻底坐实了它作为
6:58.366–7:00.366
下一代大模型的绝对实力
7:00.366–7:01.900
聊完了代码与3D
7:01.900–7:03.366
咱们再把视线转向
7:03.366–7:05.266
另一个卷到飞起的赛道
7:05.266–7:06.733
图像生成
7:06.733–7:09.166
最近在LMArena竞技场里
7:09.166–7:11.466
也突然低调上线了一个代号叫
7:11.466–7:14.133
蒙娜丽莎1的全新图像大模型
7:14.133–7:15.633
表现同样非常惹眼
7:15.633–7:17.700
而要说最锤的铁证
7:17.700–7:20.633
就是用Openai官方的验证工具去
7:20.633–7:23.700
检测蒙娜丽莎一跑出来的图片
7:23.700–7:26.266
系统居然直接识别出了Openai
7:26.266–7:29.366
自家专属的seed ID隐形水印
7:29.366–7:31.300
这下可以说是当场破案了
7:31.300–7:33.466
这就意味着Openai在图像
7:33.466–7:35.766
生成领域也要掏出底牌了
7:35.766–7:38.233
无论接下来叫ChatGPT image
7:38.233–7:40.700
2.5还是直接升到3.0
7:40.700–7:42.566
画质与控图能力都将
7:42.566–7:44.733
迎来脱胎换骨般的质飞跃
7:44.733–7:47.833
不过就在各大厂商猛砸算力的时候
7:47.833–7:50.533
谷歌这边却传来了一条坏消息
7:50.533–7:52.833
此前被开源社区寄予厚望的
7:52.833–7:56.133
超大开源模型Gemma V4 120B
7:56.133–7:59.133
最新爆料显示已被官方彻底砍掉
7:59.133–8:01.500
根据泄露的后台界面显示
8:01.500–8:05.533
这款原本拥有1,230亿参数以及
8:05.533–8:09.100
262k超百万级上下文窗口的开源旗舰
8:09.100–8:12.466
大模型已经被标记为了取消状态
8:12.466–8:14.766
确定不会再面向公众发布了
8:14.766–8:17.700
这也侧面印证了谷歌在开源与闭源
8:17.700–8:20.700
战略之间正在经历剧烈的阵痛调整
8:20.700–8:22.266
他们很可能是想把
8:22.266–8:23.966
全部计算资源集中起来
8:23.966–8:26.700
全力冲刺下一代闭源Gemini
8:26.700–8:27.366
不得不说
8:27.366–8:28.666
真挺令人唏嘘的
8:28.666–8:30.566
而除了Openai与谷歌
8:30.566–8:33.233
马斯克的Grok也不甘示弱
8:33.233–8:34.233
咱们一起来看看
8:34.233–8:36.633
这些精美的生成范例
8:36.633–8:38.166
无论是波普风海报
8:38.166–8:39.666
细腻纺织纹理
8:39.666–8:41.733
还是素描步骤拆解
8:41.733–8:44.166
Grok image 2.0在文字渲染和
8:44.166–8:46.433
审美排版上都极其出色
8:46.433–8:47.333
按照惯例
8:47.333–8:49.666
看完软件层的神仙打架
8:49.666–8:52.333
咱们在结尾再来看一个极其
8:52.333–8:55.366
硬核的具身智能硬件项目
8:55.366–8:58.566
东京大学最新展示了一款名为
8:58.566–9:01.566
Dragon的空中变形飞行机器人
9:01.566–9:03.966
它最令人惊叹的地方就是彻底
9:03.966–9:07.266
打破了传统无人机固定的形态限制
9:07.266–9:09.166
能在空中完成极度
9:09.166–9:11.266
复杂的自由变体运动
9:11.266–9:12.466
大家仔细看
9:12.466–9:14.900
Dragon机器人在空中飞行时
9:14.900–9:17.133
能精准改变关节构形
9:17.133–9:19.333
甚至能用身体灵活抓取
9:19.333–9:21.666
并包裹移动悬挂物体
9:21.666–9:23.866
在结合了AI控制算法后
9:23.866–9:26.266
它生动展示了具身智能在
9:26.266–9:28.300
复杂空间下的无限潜力
9:28.300–9:31.066
从底层大模型到具身智能
9:31.066–9:34.033
AI的进化爆发正全面到来
9:34.033–9:35.166
感谢你看到这里
9:35.166–9:36.666
这里是大雷早上好
9:36.666–9:37.533
关注频道
9:37.533–9:38.633
咱们下期见
0:00.100–0:01.600
zh各位朋友早上好
各位朋友早上好
0:01.600–0:03.933
zh今天咱们就来看看本周AI界
今天咱们就来看看本周AI界
0:03.933–0:06.333
zh几件暗流涌动的军备竞赛
几件暗流涌动的军备竞赛
0:06.333–0:09.300
zh从Openai秘密研发的超级新模型
从Openai秘密研发的超级新模型
0:09.300–0:12.333
zh到阿里悄悄上架的Qwen新势力
到阿里悄悄上架的Qwen新势力
0:12.333–0:13.833
zh信息量直接拉满
信息量直接拉满
0:13.833–0:16.133
zh先看画面这份业内研报
先看画面这份业内研报
0:16.133–0:19.600
zh里面指明Gemini 3.5 Flash表现平平
里面指明Gemini 3.5 Flash表现平平
0:19.600–0:22.033
zh而Openai正研发规模超越
而Openai正研发规模超越
0:22.033–0:24.033
zh而Openai正研发规模超越Astra的全新预训练模型
而Openai正研发规模超越Astra的全新预训练模型
0:24.033–0:25.066
zh与此同时
与此同时
0:25.066–0:26.933
zh阿里团队在LMArena
阿里团队在LMArena
0:26.933–0:29.600
zh秘密测试代号Kiana的模型
秘密测试代号Kiana的模型
0:29.600–0:32.033
zh其3D渲染能力让人惊艳
其3D渲染能力让人惊艳
0:32.033–0:35.033
zh此外图像生成领域有重磅进展
此外图像生成领域有重磅进展
0:35.033–0:37.300
zh带OpenAI since day水印的
带OpenAI since day水印的
0:37.300–0:39.100
zh蒙娜丽莎已现身竞技场
蒙娜丽莎已现身竞技场
0:39.100–0:41.100
zh马斯克旗下的Grok image
马斯克旗下的Grok image
0:41.100–0:43.500
zh2.0也已经正式发布
2.0也已经正式发布
0:43.500–0:46.700
zh目前在文生图榜单高居第二
目前在文生图榜单高居第二
0:46.700–0:49.066
zh综合表现同样不容小觑
综合表现同样不容小觑
0:49.066–0:50.333
zh遗憾的是
遗憾的是
0:50.333–0:52.300
zh谷歌原本计划推出的
谷歌原本计划推出的
0:52.300–0:56.833
zh120B超大体量模型Gemma V4 1,200亿
120B超大体量模型Gemma V4 1,200亿
0:56.833–0:59.633
zh近期爆出该项目已经被取消
近期爆出该项目已经被取消
0:59.633–1:01.066
zh看完这轮大盘概览
看完这轮大盘概览
1:01.066–1:04.066
zh咱们先来深挖Openai的重磅核弹
咱们先来深挖Openai的重磅核弹
1:04.066–1:06.700
zh知名爆料人Chris在推特指出
知名爆料人Chris在推特指出
1:06.700–1:09.300
zhGPT5.5绝不是Openai今年
GPT5.5绝不是Openai今年
1:09.300–1:11.100
zh最后一次大规模预训练
最后一次大规模预训练
1:11.100–1:12.433
zh爆料里特别强调
爆料里特别强调
1:12.533–1:15.400
zh虽然GPT6本身已经足够震撼
虽然GPT6本身已经足够震撼
1:15.400–1:18.933
zh但Openai在年底前还会掏出代号为
但Openai在年底前还会掏出代号为
1:18.933–1:20.200
zhbug的超级模型
bug的超级模型
1:20.200–1:23.000
zh预训练规模将直接创下历史新高
预训练规模将直接创下历史新高
1:23.000–1:25.333
zh推文里甚至极其夸张的声称
推文里甚至极其夸张的声称
1:25.333–1:27.800
zhbug这款新模型的恐怖性能
bug这款新模型的恐怖性能
1:27.800–1:29.933
zh绝对会让之前的fable
绝对会让之前的fable
1:29.933–1:32.133
zh显得像个原始玩具
显得像个原始玩具
1:32.133–1:33.233
zh不过对于它的发布
不过对于它的发布
1:33.233–1:35.700
zh时间线与代号对应关系
时间线与代号对应关系
1:35.700–1:37.033
zh行业内目前依然
行业内目前依然
1:37.033–1:38.700
zh存在不少争论与疑虑
存在不少争论与疑虑
1:38.700–1:39.866
zh比如知名博主
比如知名博主
1:39.866–1:42.266
zhtokengrammaring就公开反驳
tokengrammaring就公开反驳
1:42.266–1:45.233
zh指出SEMI analysis在整理这份报告时
指出SEMI analysis在整理这份报告时
1:45.300–1:47.433
zh把7月初的dog信息和
把7月初的dog信息和
1:47.433–1:49.666
zh后续的Astra给彻底搞混了
后续的Astra给彻底搞混了
1:49.666–1:50.466
zh在他看来
在他看来
1:50.466–1:53.066
zhdog早在Astra之前就已经
dog早在Astra之前就已经
1:53.066–1:55.200
zh在内部报告中出现过
在内部报告中出现过
1:55.200–1:57.300
zh因此它极大概率只是
因此它极大概率只是
1:57.300–2:00.400
zhAsha早期研发阶段的一个内部代号
Asha早期研发阶段的一个内部代号
2:00.400–2:03.000
zh而不是什么全新的后续迭代产品
而不是什么全新的后续迭代产品
2:03.000–2:06.600
zh毕竟Openai内部取代号向来都很随意
毕竟Openai内部取代号向来都很随意
2:06.600–2:08.433
zh此前就曾用过像
此前就曾用过像
2:08.433–2:11.000
zhMilthree Milfour这种混乱名称
Milthree Milfour这种混乱名称
2:11.000–2:12.933
zh最后才统一叫Asha
最后才统一叫Asha
2:13.233–2:16.000
zh这也让外界很难做出精准判断
这也让外界很难做出精准判断
2:16.000–2:19.350
zh所以说,咱们目前依然无法百分百确定,
所以说,咱们目前依然无法百分百确定,
2:19.350–2:23.443
zhDug到底代表着一个全新的超大模型预训练流,
Dug到底代表着一个全新的超大模型预训练流,
2:23.443–2:27.351
zh还是只属于同一批预训练中的不同阶段检查点,
还是只属于同一批预训练中的不同阶段检查点,
2:27.351–2:28.840
zh依旧充满神秘感。
依旧充满神秘感。
2:28.840–2:29.340
zh依旧充满神秘感
依旧充满神秘感
2:29.340–2:33.025
zh而如果把视线转向谷歌,言报给出的结论就更残酷了。
而如果把视线转向谷歌,言报给出的结论就更残酷了。
2:33.025–2:37.682
zh文章直接断言,Gimini 3 Pro已经是谷歌技术的高峰,
文章直接断言,Gimini 3 Pro已经是谷歌技术的高峰,
2:37.682–2:41.840
zh近期Deepmind高层的变动更是加剧了内部焦虑。
近期Deepmind高层的变动更是加剧了内部焦虑。
2:41.840–2:42.433
zh是加剧了内部焦虑
是加剧了内部焦虑
2:42.433–2:43.933
zh报告甚至预测
报告甚至预测
2:43.933–2:48.333
zh接下来的Gemini3.5Pro实力仅相当于Opus4.5
接下来的Gemini3.5Pro实力仅相当于Opus4.5
2:48.333–2:50.600
zh甚至不如GLM5.2
甚至不如GLM5.2
2:50.600–2:53.133
zh面对Anthropic与Openai的死斗
面对Anthropic与Openai的死斗
2:53.133–2:53.933
zh很难招架
很难招架
2:53.933–2:59.297
zh不过其中最为引人注意的,仍然是这份言报尾部给出的重磅结论。
不过其中最为引人注意的,仍然是这份言报尾部给出的重磅结论。
2:59.297–3:03.366
zhOpenAI已经彻底克服了预训练的技术障碍,
OpenAI已经彻底克服了预训练的技术障碍,
3:03.366–3:06.881
zh规模更为庞大的Dug模型正在全力推进,
规模更为庞大的Dug模型正在全力推进,
3:06.881–3:09.840
zh极可能在今年年底前彻底颠覆行业。
极可能在今年年底前彻底颠覆行业。
3:09.840–3:10.840
zh极可能在今年年底前彻底颠覆行业
极可能在今年年底前彻底颠覆行业
3:10.840–3:12.400
zh聊完海外巨头的暗流涌动
聊完海外巨头的暗流涌动
3:12.400–3:14.833
zh咱们把视角转回国内
咱们把视角转回国内
3:14.833–3:18.433
zh阿里团队最近在LLM Arena的code
阿里团队最近在LLM Arena的code
3:18.433–3:21.000
zhArena上悄悄上线了一款代号
Arena上悄悄上线了一款代号
3:21.000–3:23.833
zh为piano的全新检查点模型
为piano的全新检查点模型
3:23.833–3:25.933
zh不少开发者第一时间拿它
不少开发者第一时间拿它
3:25.933–3:28.333
zh跑起了硬核物理弹道测试
跑起了硬核物理弹道测试
3:28.733–3:31.500
zh将提亚娜与Claude OPPO S5以及
将提亚娜与Claude OPPO S5以及
3:31.500–3:34.733
zhGPT5.6放在同等提示词下
GPT5.6放在同等提示词下
3:34.733–3:38.000
zh进行3D前端代码生成的大比拼
进行3D前端代码生成的大比拼
3:38.000–3:40.761
zh而从最终实测运行效果来看,
而从最终实测运行效果来看,
3:40.761–3:44.583
zhKiana用3GS生成的弩炮模拟动画
Kiana用3GS生成的弩炮模拟动画
3:44.583–3:46.494
zh可以说是极其逼真,
可以说是极其逼真,
3:46.494–3:48.830
zh不仅整体结构非常完整,
不仅整体结构非常完整,
3:48.830–3:52.440
zh渲染和发射的物理交互更是丝滑顺畅。
渲染和发射的物理交互更是丝滑顺畅。
3:52.440–3:52.973
zh交互更是丝滑顺畅
交互更是丝滑顺畅
3:52.973–3:53.473
zh在我看来
在我看来
3:53.473–3:55.300
zh这款神秘新模型
这款神秘新模型
3:55.300–3:58.466
zh在前端网页开发与复杂逻辑呈现上
在前端网页开发与复杂逻辑呈现上
3:58.466–4:01.000
zh展现出的综合素质完全不
展现出的综合素质完全不
4:01.000–4:03.266
zh逊色于目前市场上任何
逊色于目前市场上任何
4:03.266–4:05.600
zh顶尖的第一梯队旗舰模型
顶尖的第一梯队旗舰模型
4:05.600–4:08.400
zh如果大家也想亲自体验它的实力
如果大家也想亲自体验它的实力
4:08.400–4:10.700
zh可以去lmaArena的下拉菜单
可以去lmaArena的下拉菜单
4:10.700–4:13.466
zh里选择Beta mode盲测模式
里选择Beta mode盲测模式
4:13.466–4:15.333
zh随后进入code Arena
随后进入code Arena
4:15.333–4:16.866
zh输入你想要的prompt
输入你想要的prompt
4:16.866–4:19.000
zh在提交具体需求之后
在提交具体需求之后
4:19.000–4:21.200
zh系统会有两个完全匿名的
系统会有两个完全匿名的
4:21.200–4:23.900
zh模型同时在后台生成网页
模型同时在后台生成网页
4:23.900–4:25.866
zh用户需要通过对比双边
用户需要通过对比双边
4:25.866–4:28.400
zh生成的结果进行盲测投票
生成的结果进行盲测投票
4:28.400–4:30.300
zh投票结束后就会揭晓
投票结束后就会揭晓
4:30.300–4:32.400
zh代码到底属于哪两款模型
代码到底属于哪两款模型
4:32.400–4:34.266
zh不过由于抽取是随机的
不过由于抽取是随机的
4:34.266–4:37.500
zh想碰上Kiana得运气好或多刷几次
想碰上Kiana得运气好或多刷几次
4:37.500–4:39.833
zh下面咱们就来看几个它生成
下面咱们就来看几个它生成
4:39.833–4:42.233
zh的代表性高难度实战案例
的代表性高难度实战案例
4:42.233–4:45.233
zh咱们先来看这个极其惊艳的案例
咱们先来看这个极其惊艳的案例
4:45.233–4:48.200
zh提示词要求生成一个名为AIRO ONE的360度互动耳机展示页面
提示词要求生成一个名为AIRO ONE的360度互动耳机展示页面
4:48.200–4:51.066
zh提示词要求生成一个名为AIRO ONE的360度互动耳机展示页面
提示词要求生成一个名为AIRO ONE的360度互动耳机展示页面
4:51.066–4:53.666
zhKiana生成的UI显得极其精致
Kiana生成的UI显得极其精致
4:53.666–4:55.533
zh黑金高级感直接拉满
黑金高级感直接拉满
4:55.533–4:56.600
zh更绝的是
更绝的是
4:56.600–4:58.700
zh这个页面不仅支持用鼠标
这个页面不仅支持用鼠标
4:58.700–5:01.700
zh全向拖拽旋转和自由缩放
全向拖拽旋转和自由缩放
5:01.700–5:03.833
zh点击耳机上的touch control
点击耳机上的touch control
5:03.833–5:04.933
zhDISC按鈕
DISC按鈕
5:04.933–5:07.033
zh还会及时弹出极其精准
还会及时弹出极其精准
5:07.033–5:09.400
zh的技术参数标签与提示
的技术参数标签与提示
5:09.400–5:10.633
zh完成度非常高
完成度非常高
5:10.633–5:13.133
zh而最让人惊叹的则是页面
而最让人惊叹的则是页面
5:13.133–5:16.000
zh底部的动态配色切换功能
底部的动态配色切换功能
5:16.000–5:17.900
zh当点击不同颜色按钮
当点击不同颜色按钮
5:17.900–5:19.866
zh3D耳机的表面材质与
3D耳机的表面材质与
5:19.866–5:21.900
zh光照渲染会实时改变
光照渲染会实时改变
5:21.900–5:24.600
zh这种Three.js代码实现水平
这种Three.js代码实现水平
5:24.600–5:26.900
zh简直远远超越了大多数对手
简直远远超越了大多数对手
5:26.900–5:28.366
zh看完了单独展示
看完了单独展示
5:28.500–5:29.666
zh咱们再来看一组
咱们再来看一组
5:29.666–5:32.066
zh直观的四方横向对比
直观的四方横向对比
5:32.066–5:33.533
zh在同等提示词下
在同等提示词下
5:33.533–5:35.433
zh生成蒸汽朋克飞艇
生成蒸汽朋克飞艇
5:35.433–5:38.700
zh四个画面分别由Claude Opus 5、Qwen
四个画面分别由Claude Opus 5、Qwen
5:38.700–5:40.733
enQwen、Claude Fastr 5 High
Qwen、Claude Fastr 5 High
5:40.733–5:42.900
zh以及Qwen 3.8 Max渲染
以及Qwen 3.8 Max渲染
5:42.900–5:44.300
zh大家仔细看右上角
大家仔细看右上角
5:44.300–5:46.833
zhTiana生成的这艘飞艇
Tiana生成的这艘飞艇
5:46.833–5:48.566
zh无论是气囊的网格
无论是气囊的网格
5:48.566–5:50.133
zh复杂的金属管道
复杂的金属管道
5:50.133–5:52.700
zh还是悬挂吊舱的细节丰富度
还是悬挂吊舱的细节丰富度
5:52.700–5:54.533
zh都明显碾压了左下角
都明显碾压了左下角
5:54.533–5:56.666
zhFastr 5 High生成的简化模型
Fastr 5 High生成的简化模型
5:56.666–5:59.333
zh虽然左上角Opus5在材质与
虽然左上角Opus5在材质与
5:59.333–6:01.733
zh细节纹理上略微胜出一点点
细节纹理上略微胜出一点点
6:01.733–6:04.300
zh但Qwen展示出的设计合理性
但Qwen展示出的设计合理性
6:04.300–6:07.033
zh还有超强的复杂代码构建能力
还有超强的复杂代码构建能力
6:07.033–6:08.700
zh已经完全能跟顶尖的
已经完全能跟顶尖的
6:08.700–6:10.666
zhOpus模型正面交锋了
Opus模型正面交锋了
6:10.666–6:12.900
zh结合刚才这一系列惊人表现
结合刚才这一系列惊人表现
6:12.900–6:14.366
zh业内普遍推测
业内普遍推测
6:14.366–6:16.366
zh这个代号Qiana的模型
这个代号Qiana的模型
6:16.366–6:18.866
zh极可能就是阿里即将发布的
极可能就是阿里即将发布的
6:18.866–6:22.233
zhQwen 4.0或Qwen 3.9大更新的
Qwen 4.0或Qwen 3.9大更新的
6:22.233–6:24.533
zh前哨检查点太值得期待了
前哨检查点太值得期待了
6:24.533–6:26.133
zh咱们再看这组黄昏
咱们再看这组黄昏
6:26.133–6:28.566
zh庄园3D场景的对抗
庄园3D场景的对抗
6:28.566–6:30.466
zh由Qiana與老牌
由Qiana與老牌
6:30.466–6:34.066
zhQwen 3.8 Max展开直接PK
Qwen 3.8 Max展开直接PK
6:34.066–6:36.633
zh这次给到的高难度渲染要求是
这次给到的高难度渲染要求是
6:36.633–6:39.433
zh生成一个极致拟真的黄昏乡村庄园
生成一个极致拟真的黄昏乡村庄园
6:39.433–6:40.966
zh大家可以清晰的看到
大家可以清晰的看到
6:40.966–6:43.700
zhQiana生成的庄园简直太惊艳了
Qiana生成的庄园简直太惊艳了
6:43.700–6:46.133
zh不仅精细的还原了小巧的
不仅精细的还原了小巧的
6:46.133–6:48.766
zh彩灯串与温馨的屋顶光影
彩灯串与温馨的屋顶光影
6:48.766–6:50.333
zh周围还布局了层次
周围还布局了层次
6:50.333–6:52.466
zh丰富的花坛和森林
丰富的花坛和森林
6:52.466–6:54.333
zh光影渲染的整体质感
光影渲染的整体质感
6:54.333–6:56.233
zh远远超越了下方的老版本
远远超越了下方的老版本
6:56.233–6:58.366
zh可以说是彻底坐实了它作为
可以说是彻底坐实了它作为
6:58.366–7:00.366
zh下一代大模型的绝对实力
下一代大模型的绝对实力
7:00.366–7:01.900
zh聊完了代码与3D
聊完了代码与3D
7:01.900–7:03.366
zh咱们再把视线转向
咱们再把视线转向
7:03.366–7:05.266
zh另一个卷到飞起的赛道
另一个卷到飞起的赛道
7:05.266–7:06.733
zh图像生成
图像生成
7:06.733–7:09.166
zh最近在LMArena竞技场里
最近在LMArena竞技场里
7:09.166–7:11.466
zh也突然低调上线了一个代号叫
也突然低调上线了一个代号叫
7:11.466–7:14.133
zh蒙娜丽莎1的全新图像大模型
蒙娜丽莎1的全新图像大模型
7:14.133–7:15.633
zh表现同样非常惹眼
表现同样非常惹眼
7:15.633–7:17.700
zh而要说最锤的铁证
而要说最锤的铁证
7:17.700–7:20.633
zh就是用Openai官方的验证工具去
就是用Openai官方的验证工具去
7:20.633–7:23.700
zh检测蒙娜丽莎一跑出来的图片
检测蒙娜丽莎一跑出来的图片
7:23.700–7:26.266
zh系统居然直接识别出了Openai
系统居然直接识别出了Openai
7:26.266–7:29.366
zh自家专属的seed ID隐形水印
自家专属的seed ID隐形水印
7:29.366–7:31.300
zh这下可以说是当场破案了
这下可以说是当场破案了
7:31.300–7:33.466
zh这就意味着Openai在图像
这就意味着Openai在图像
7:33.466–7:35.766
zh生成领域也要掏出底牌了
生成领域也要掏出底牌了
7:35.766–7:38.233
zh无论接下来叫ChatGPT image
无论接下来叫ChatGPT image
7:38.233–7:40.700
zh2.5还是直接升到3.0
2.5还是直接升到3.0
7:40.700–7:42.566
zh画质与控图能力都将
画质与控图能力都将
7:42.566–7:44.733
zh迎来脱胎换骨般的质飞跃
迎来脱胎换骨般的质飞跃
7:44.733–7:47.833
zh不过就在各大厂商猛砸算力的时候
不过就在各大厂商猛砸算力的时候
7:47.833–7:50.533
zh谷歌这边却传来了一条坏消息
谷歌这边却传来了一条坏消息
7:50.533–7:52.833
zh此前被开源社区寄予厚望的
此前被开源社区寄予厚望的
7:52.833–7:56.133
zh超大开源模型Gemma V4 120B
超大开源模型Gemma V4 120B
7:56.133–7:59.133
zh最新爆料显示已被官方彻底砍掉
最新爆料显示已被官方彻底砍掉
7:59.133–8:01.500
zh根据泄露的后台界面显示
根据泄露的后台界面显示
8:01.500–8:05.533
zh这款原本拥有1,230亿参数以及
这款原本拥有1,230亿参数以及
8:05.533–8:09.100
zh262k超百万级上下文窗口的开源旗舰
262k超百万级上下文窗口的开源旗舰
8:09.100–8:12.466
zh大模型已经被标记为了取消状态
大模型已经被标记为了取消状态
8:12.466–8:14.766
zh确定不会再面向公众发布了
确定不会再面向公众发布了
8:14.766–8:17.700
zh这也侧面印证了谷歌在开源与闭源
这也侧面印证了谷歌在开源与闭源
8:17.700–8:20.700
zh战略之间正在经历剧烈的阵痛调整
战略之间正在经历剧烈的阵痛调整
8:20.700–8:22.266
zh他们很可能是想把
他们很可能是想把
8:22.266–8:23.966
zh全部计算资源集中起来
全部计算资源集中起来
8:23.966–8:26.700
zh全力冲刺下一代闭源Gemini
全力冲刺下一代闭源Gemini
8:26.700–8:27.366
zh不得不说
不得不说
8:27.366–8:28.666
zh真挺令人唏嘘的
真挺令人唏嘘的
8:28.666–8:30.566
zh而除了Openai与谷歌
而除了Openai与谷歌
8:30.566–8:33.233
zh马斯克的Grok也不甘示弱
马斯克的Grok也不甘示弱
8:33.233–8:34.233
zh咱们一起来看看
咱们一起来看看
8:34.233–8:36.633
zh这些精美的生成范例
这些精美的生成范例
8:36.633–8:38.166
zh无论是波普风海报
无论是波普风海报
8:38.166–8:39.666
zh细腻纺织纹理
细腻纺织纹理
8:39.666–8:41.733
zh还是素描步骤拆解
还是素描步骤拆解
8:41.733–8:44.166
zhGrok image 2.0在文字渲染和
Grok image 2.0在文字渲染和
8:44.166–8:46.433
zh审美排版上都极其出色
审美排版上都极其出色
8:46.433–8:47.333
zh按照惯例
按照惯例
8:47.333–8:49.666
zh看完软件层的神仙打架
看完软件层的神仙打架
8:49.666–8:52.333
zh咱们在结尾再来看一个极其
咱们在结尾再来看一个极其
8:52.333–8:55.366
zh硬核的具身智能硬件项目
硬核的具身智能硬件项目
8:55.366–8:58.566
zh东京大学最新展示了一款名为
东京大学最新展示了一款名为
8:58.566–9:01.566
zhDragon的空中变形飞行机器人
Dragon的空中变形飞行机器人
9:01.566–9:03.966
zh它最令人惊叹的地方就是彻底
它最令人惊叹的地方就是彻底
9:03.966–9:07.266
zh打破了传统无人机固定的形态限制
打破了传统无人机固定的形态限制
9:07.266–9:09.166
zh能在空中完成极度
能在空中完成极度
9:09.166–9:11.266
zh复杂的自由变体运动
复杂的自由变体运动
9:11.266–9:12.466
zh大家仔细看
大家仔细看
9:12.466–9:14.900
zhDragon机器人在空中飞行时
Dragon机器人在空中飞行时
9:14.900–9:17.133
zh能精准改变关节构形
能精准改变关节构形
9:17.133–9:19.333
zh甚至能用身体灵活抓取
甚至能用身体灵活抓取
9:19.333–9:21.666
zh并包裹移动悬挂物体
并包裹移动悬挂物体
9:21.666–9:23.866
zh在结合了AI控制算法后
在结合了AI控制算法后
9:23.866–9:26.266
zh它生动展示了具身智能在
它生动展示了具身智能在
9:26.266–9:28.300
zh复杂空间下的无限潜力
复杂空间下的无限潜力
9:28.300–9:31.066
zh从底层大模型到具身智能
从底层大模型到具身智能
9:31.066–9:34.033
zhAI的进化爆发正全面到来
AI的进化爆发正全面到来
9:34.033–9:35.166
zh感谢你看到这里
感谢你看到这里
9:35.166–9:36.666
zh这里是大雷早上好
这里是大雷早上好
9:36.666–9:37.533
zh关注频道
关注频道
9:37.533–9:38.633
zh咱们下期见
咱们下期见
影片筆記:比GPT-6更可怕?OpenAI秘密模型Doug曝光,AI圈炸裂!Scarier Than GPT-6? OpenAI's Secret Model 'Doug' Leaked!
一句話總結
影片盤點近期 AI 領域的激烈競爭與技術突破,重點揭露 OpenAI 內部代號混亂的超級預訓練模型(涉及 Bug/Dog/Astra 等),阿里代號 Kiana/Piano 模型在 3D 與代碼生成上的卓越表現,以及 Google 戰略調整與 Anthropic、Grok 等廠商的最新動態。
核心重點
- OpenAI 內部模型代號混亂與超級預訓練:
- 爆料人 Chris 指出 GPT 5.5 並非最後一次大規模預訓練,年底將推出代號為 "Bug" 的超級模型,預訓練規模創新高。
- 博主 Tokengrammaring 反駁,認為 "Dog" 和 "Astra" 可能被混淆,"Dog" 可能只是 "Asha" (或 Astra) 早期研發階段的內部代號。
- OpenAI 內部代號(如 Milthree, Milfour)混亂,難以判斷 "Dug" (或 Bug/Dog) 是全新預訓練流還是同一批預訓練的不同檢查點。
- 圖像生成領域出現代號「蒙娜麗莎 1」的新模型,經 OpenAI 官方驗證工具檢測帶有專屬 Seed ID 隱形水印。
- 阿里 (Alibaba) 新模型 Kiana / Piano 的強大實力:
- 在 LMArena Code Arena 測試中,代號 "Kiana" (或稱 "Piano") 的檢查點模型表現卓越。
- 在 3D 前端代碼生成、物理彈道測試中,與 Claude Opus S5、GPT 5.6 進行盲測對比時展現優勢。
- 案例包括 AIRO ONE 360 度互動耳機展示(Three.js 實現)、蒸汽朋克飛艇四方對比、黃昏莊園 3D 場景 PK,均顯示其設計合理性與複雜代碼構建能力。
- 業界推測極可能為阿里即將發布的 Qwen 4.0 或 Qwen 3.9 大更新的前哨檢查點。
- Google 的技術瓶頸與戰略調整:
- 報告結論:Gemini 3 Pro 已是谷歌技術高峰。
- 預測 Gemini 3.5 Pro 實力僅相當於 Opus 4.5,甚至不如 GLM 5.2。
- DeepMind 高層變動加劇內部焦慮。
- 原計劃推出的超大體量開源模型 Gemma V4 120B (1,230 億參數,262k 上下文窗口) 已被取消,顯示谷歌將資源集中於下一代閉源 Gemini。
- 其他廠商與硬體創新:
- Anthropic:Opus 系列仍具競爭力,但面臨巨大壓力。
- Grok Image 2.0:马斯克旗下產品正式發布,在文生圖榜單高居第二,審美與文字渲染出色。
- 具身智能:東京大學展示名為 "Dragon" 的空中變形飛行機器人,展現複雜空間下的具身智能潛力。
詳細大綱
I. 行業概覽與預訓練模型競賽
- OpenAI 的超級模型研發
- 爆料人 Chris 指出 GPT 5.5 並非最後一次大規模預訓練。
- 年底將推出代號為 "Bug" 的超級模型,預訓練規模創新高。
- 性能預測:可能讓之前的 "Fable" 顯得像原始玩具。
- 代號爭議:
- 博主 Tokengrammaring 反駁,認為 "Dog" 和 "Astra" 可能被混淆。
- "Dog" 可能只是 "Asha" (或 Astra) 早期研發階段的內部代號,而非全新迭代。
- OpenAI 內部代號混亂(如 Milthree, Milfour),難以精準判斷 "Dug" (或 Bug/Dog) 是全新預訓練流還是同一批預訓練的不同檢查點。
- Google 的技術瓶頸與戰略調整
- 報告結論:Gemini 3 Pro 已是谷歌技術高峰。
- 預測 Gemini 3.5 Pro 實力僅相當於 Opus 4.5,甚至不如 GLM 5.2。
- DeepMind 高層變動加劇內部焦慮。
- Gemma V4 120B 取消:
- 原計劃擁有 1,230 億參數及 262k 上下文窗口。
- 已被標記為取消,不再面向公眾發布。
- 推測谷歌將資源集中於下一代閉源 Gemini。
II. 阿里 (Alibaba) 新模型實測:代號 Kiana / Piano
- 測試環境:LMArena 的 Code Arena。
- 模型表現:
- 在 3D 前端代碼生成、物理彈道測試中表現驚艷。
- 與 Claude Opus S5、GPT 5.6 進行盲測對比。
- 案例 1:AIRO ONE 360 度互動耳機展示
- UI 精緻,黑金風格。
- 支持鼠標全向拖拽、旋轉、縮放。
- 點擊按鈕觸發精準技術參數標籤。
- 底部動態配色切換,Three.js 代碼實現水平超越多數對手。
- 案例 2:蒸汽朋克飛艇四方對比
- 對比對象:Claude Opus 5, Qwen, Claude Fastr 5 High, Qwen 3.8 Max。
- Kiana 生成的飛艇在網格、金屬管道、懸掛吊艙細節上碾壓 Fastr 5 High。
- 雖 Opus 5 在材質紋理略勝,但 Kiana 的設計合理性與複雜代碼構建能力足以與 Opus 正面交鋒。
- 案例 3:黃昏莊園 3D 場景 PK
- 對比對象:Kiana vs. Qwen 3.8 Max。
- Kiana 生成的莊園在彩燈、光影、花壇、森林層次感上遠超老版本。
- 測試方法:LMArena Beta Mode 盲測,隨機抽取模型進行投票。
- 業界推測:極可能為阿里即將發布的 Qwen 4.0 或 Qwen 3.9 大更新的前哨檢查點。
III. 圖像生成領域進展
- OpenAI 圖像模型
- LMArena 出現代號「蒙娜麗莎 1」的新模型。
- 關鍵證據:使用 OpenAI 官方驗證工具檢測,圖片帶有 OpenAI 專屬 Seed ID 隱形水印。
- 預測未來版本(ChatGPT Image 2.5 或 3.0)在畫質與控圖能力上有質飛躍。
- Grok Image 2.0
- 马斯克旗下產品正式發布。
- 在文生圖榜單高居第二。
- 範例包括波普風海報、細膩紡織紋理、素描步驟拆解,文字渲染與審美排版出色。
IV. 具身智能與硬體創新
- 東京大學 "Dragon" 項目
- 空中變形飛行機器人。
- 打破傳統無人機固定形態限制。
- 能在空中完成複雜自由變體運動,改變關節構形。
- 能靈活抓取並包裹移動懸掛物體。
- 結合 AI 控制算法,展示具身智能在複雜空間下的潛力。
工具 / 模型 / 名詞整理
- 模型與產品名稱:
- OpenAI (公司)
- GPT 5.5
- GPT 6
- Bug (OpenAI 新模型代號)
- Fable (疑似舊模型名稱)
- Dog (OpenAI 內部代號)
- Astra / Asha (OpenAI 內部代號,文中混用)
- Milthree / Milfour (OpenAI 內部代號)
- Dug (文中提及,疑為 Bug 或 Dog 的聽寫錯誤)
- Gemini 3.5 Flash (Google)
- Gemini 3 Pro (Google)
- Gemini 3.5 Pro (Google)
- Opus 4.5 (Anthropic)
- GLM 5.2 (智譜 AI?)
- Kiana / Piano (阿里新模型代號,文中混用)
- Claude Opus S5 (Anthropic)
- GPT 5.6 (OpenAI)
- AIRO ONE (案例中的產品名)
- Three.js (前端庫)
- Claude Fastr 5 High (Anthropic)
- Qwen 3.8 Max (阿里)
- Qwen 4.0 / Qwen 3.9 (阿里)
- 蒙娜麗莎 1 (OpenAI 圖像模型代號)
- ChatGPT Image 2.5 / 3.0 (預測中的 OpenAI 產品)
- Gemma V4 120B (Google 開源模型)
- Grok Image 2.0 (马斯克旗下)
- Dragon (東京大學飛行機器人)
- LMArena / Code Arena (測試平台)
- Beta Mode (LMArena 測試模式)
- 工具與技術:
- OpenAI 官方驗證工具 (用於檢測水印)
- Seed ID 隱形水印
- 3D 渲染
- 前端代碼生成
- 物理彈道測試
- 預訓練 (Pre-training)
- 檢查點 (Checkpoint)
- 具身智能 (Embodied AI)
操作流程整理
- OpenAI 新模型水印檢測流程:
- 在 LMArena 發現代號「蒙娜麗莎 1」的新模型。
- 使用 OpenAI 官方驗證工具對生成的圖片進行檢測。
- 確認圖片帶有 OpenAI 專屬 Seed ID 隱形水印,證實其為 OpenAI 官方模型。
- 阿里 Kiana/Piano 模型盲測流程:
- 進入 LMArena 的 Code Arena。
- 選擇 Beta Mode 進行盲測,隨機抽取模型。
- 針對特定場景(如 AIRO ONE 耳機、蒸汽朋克飛艇、黃昏莊園)進行 3D 前端代碼生成與物理模擬測試。
- 將 Kiana 的輸出與 Claude Opus S5、GPT 5.6、Qwen 3.8 Max 等進行對比投票。
- 評估指標包括 UI 精緻度、代碼複雜度、物理合理性、光影效果等。
值得注意的限制或風險
- 模型代號與版本混亂:
- OpenAI 內部代號(Bug, Dog, Dug, Astra, Asha, Milthree, Milfour)使用混亂,難以準確對應實際發布的模型版本。
- 阿里模型代號 Kiana 與 Piano 混用,需確認是否為同一模型的不同階段名稱。
- 多個模型版本號(如 GPT 5.5/5.6, Gemini 3.5 Pro, Opus 4.5/S5, GLM 5.2, Qwen 3.8 Max/4.0)在影片中出現,需查證是否為真實發布名稱或口誤。
- 數據與參數描述不一致:
- Gemma V4 的參數數量在文中分別描述為 "120B" 和 "1,230 億" (或 "1,200 億"),數值對應存在疑義。
- "262k 上下文窗口" 與 "超百萬" 的描述需進一步確認是否為同一數值的不同表述。
- 技術細節查證需求:
- OpenAI 是否確實使用 "Seed ID" 作為隱形水印技術名稱。
- 東京大學 "Dragon" 飛行機器人項目是否真實存在且名稱準確。
- Grok Image 2.0 是否已正式發布並確實高居文生圖榜單第二。
- LMArena 的 "Beta Mode" 是否為真實存在的測試功能名稱。
逐字稿辨識疑點
- 代號名稱混亂與聽寫錯誤:
- 文中多次出現代號不一致,如 "Bug"、"Dog"、"Dug"、"Astra"、"Asha"。博主 Tokengrammaring 指出報告將 "Dog" 和 "Astra" 搞混,但逐字稿中這些名稱交替出現,無法確定最終正確代號。
- "Dug" 出現於 "Dug 到底代表著...",疑為 "Bug" 或 "Dog" 的聽寫錯誤。
- "Kiana" 與 "Piano" 指代同一個阿里模型,文中交替使用。
- "Fable" 作為 OpenAI 舊模型名稱,需查證是否為 "GPT-4" 或其他模型的誤聽。
- "Opus 4.5"、"GLM 5.2"、"GPT 5.6"、"Claude Opus S5"、"Claude Fastr 5 High" 等版本號與命名組合,需查證是否為真實發布名稱或口誤(例如 Fastr 可能為 Fast)。
- "120B" 與 "1,230 億" 參數描述,文中先說 120B 後說 1,230 億,數值對應需查證。
- "262k 超百萬級上下文窗口",262k 通常指 262,000,與 "超百萬" 描述一致,但需確認是否為 262k 或 1M+ 的誤述。
- "Seed ID" 水印,需查證 OpenAI 是否確實使用此特定名稱的隱形水印技術。
- "Dragon" 機器人,需查證東京大學是否確實發布此名稱的項目。
- "Qwen 3.8 Max",需查證 Qwen 系列是否有此具體版本號。
- "Milthree", "Milfour",需查證是否為 OpenAI 內部真實代號。
- "Tokengrammaring",需查證博主真實名稱。
- "Chris",需查證爆料人真實身份。
- "SEMI analysis",需查證是否為 "SemiAnalysis" 的誤聽。
- "言報",疑為 "研报" 的聽寫錯誤。
- "提亞娜",疑為 "Kiana" 的聽寫錯誤。
- "1,200 億" 與 "120B",文中先說 120B 後說 1,200 億,數值單位需查證。
- "Gemma V4 1,200 億",文中先說 Gemma V4 120B 後說 1,200 億,需查證是否為同一模型的不同參數描述或誤述。
- "Openai since day 水印",疑為 "OpenAI 官方驗證工具檢測出的 Seed ID 隱形水印" 的誤述或聽寫錯誤。
- "蒙娜麗莎已現身競技場",需查證是否為真實發布的模型代號。
- "Grok image 2.0",需查證是否已正式發布。
- "Dragon 空中變形飛行機器人",需查證是否為真實項目。
- "東京大學",需查證是否為該項目的發布機構。
- "具身智能",需查證是否為該項目的正確技術分類。
- "大雷早上好",需查證是否為頻道名稱或主播名稱。
- "LLM Arena" 與 "LMArena",需查證是否為同一平台的不同稱呼。
- "Code Arena",需查證是否為 LMArena 的特定模塊。
- "Beta mode 盲測模式",需查證是否為 LMArena 的真實功能名稱。
- "Prompt",需查證是否為 "提示詞" 的英文混用。
- "UI",需查證是否為 "用戶界面" 的縮寫。
- "Three.js",需查證是否為正確的前端庫名稱。
- "Steam Punk" (蒸汽朋克),需查證是否為案例中的正確風格描述。
- "Touch Control Disc 按鈕",需查證是否為案例中的正確 UI 元素名稱。
- "Seed ID",需查證是否為
尚未產生學習筆記
請在 Telegram 指令最後加上「學習」,例如:videonote 網址 英文 雙語 學習