WEBVTT

00:00.000 --> 00:15.460
欢迎来到WorkBetty进阶蓝皮书的22章。这一章我们聊一个特别实用的是,怎么把一本书,一系列视频蒸留成Agent能主动调用的Skill。核心就三步,读书,蒸留,用起来。

00:15.460 --> 00:32.500
很多人都有这个困惑,书读了不少,真要用的时候却想不起来。恋爱也一样,他训练时读过很多经典,但回答常常是一堆正确的废话,每个字都对,就是没有可落地的步骤。

00:33.180 --> 00:37.240
知识经流要解决的,就是这种学了用不上的问题。

00:37.240 --> 00:48.140
知识经流,简单来说,就是把书或视频里的方法论,提纯成一个个代处发条件,代执行步骤的Skill。

00:48.780 --> 01:01.360
就像化学经流暗费点分离混合物,它按框架、原则、暗粒、反粒,数于五个维度,把知识分离成纯净组分,只把真正有用的提纯成可执行单元。

01:01.360 --> 01:16.680
Tanger Scale用六个阶段把一整本书蒸留成一套Skill,先整书理解,在五个Agent并行提取,然后三重验证筛选,接着构造Skill,建立链接,最后压力测试。

01:17.340 --> 01:24.620
以文案创作完全手册为例,整本书最终变成一套可以调用,可以测试的Skill集合。

01:24.620 --> 01:35.920
阶段0很关键,不从摘金句开始,而是先读清整本书的骨架,这一步决定了后面提取的质量上限。

01:36.580 --> 01:45.340
阶段1让五个Agent从五个维度并行扫描全文,各自独立工作,互不干扰,避免单线阅读时的视角遗漏。

01:45.340 --> 01:55.640
阶段1.5是三重验证筛选,每个候选单元必须过三关,没过就淘汰,宁缺无赖。

01:56.040 --> 02:00.480
一本书通常50到100个候选,最后只留10到25个。

02:01.140 --> 02:08.700
阶段2构造Skill,最核心的是设计触发条件,没有触发条件,Agent根本不知道什么时候该调用它。

02:08.700 --> 02:19.480
阶段4座链接,把Skill之间的关系连成知识网络,这样遇到复杂问题,Agent能选一组Skill而不是单个。

02:20.120 --> 02:30.820
阶段5是压力测试,用诱饵测试故意给不该触发的场景,看Skill能不能忍住不激活,再用真实问题验证它给的是不是可落地的步骤。

02:30.820 --> 02:44.600
征流完的产物是一套结构清晰的Skill集合,有Rimi说明,有每个Skill的独立文件,有记录关系的Index,还有待测试用力的Test目录。

02:45.060 --> 02:51.040
而且测试用力兼容Darwin Scale,可以自动进化,持续优化,分数只升不降。

02:53.580 --> 02:56.360
有人会问,这和Rack有什么区别?

02:56.360 --> 03:06.440
Rack解决的是知识管理,让你能查到书里有什么,知识经流解决的是知识运用,让Agent在对的时刻主动拿出对的框架。

03:07.080 --> 03:09.940
当你不知道该问什么的时候,Rack帮不了你。

03:10.540 --> 03:16.260
他也吸收了Carpacy的LLM wiki思路,但目标不同,两者并不忽斥。

03:19.200 --> 03:26.340
Tanger Scale第二版增加了视频蒸留,先用Video Downloader把视频下载,提取音频,转写成文字。

03:26.360 --> 03:27.900
再进入六阶段Sub。

03:28.500 --> 03:32.980
支持YouTube和B站,长视频,推荐用ASR API转写。

03:33.640 --> 03:41.540
多个同主题视频还能合并蒸留,自动取重,而视频获取和文本蒸留职责分离,各自演进。

03:44.080 --> 03:45.780
什么材料适合蒸留?

03:45.780 --> 03:57.160
方法论密度高的书最适合,五星,访谈和课程视频也不错,长视频播客可用,金句散文类就一般了,小说叙事文学基本不适合。

03:57.820 --> 04:05.680
还有一个潜质条件,蒸留前最好自己先读过一遍,蒸留是阅读后的结构化工具,不是替代阅读。

04:05.680 --> 04:19.100
知识经流是Token消耗密集型的,主要花在多Agent并行提取和验证上,建议用轻量模型做提取,强模型做验证和构造。

04:19.760 --> 04:29.740
好在产物可以直接分享复用,把GitHub仓库地址给Agent,它就能自动安装使用,社区里同一本书不必每个人重复蒸留。

04:29.740 --> 04:44.900
最后提醒几个误区,训练过的书也要蒸留,因为小众和新书,AI大概率没读过,而且蒸留的价值在触发条件,蒸留完还是要读书,它是补充不是替代。

04:45.220 --> 04:52.040
AI给建议不等于能直接执行,决策还是人的责任,覆盖也不是越广越好,边界要控住。

04:52.380 --> 04:58.420
以温达的AI入门课为例,26个视频就能蒸留成一套Skill集合。

04:58.420 --> 05:06.720
知识经流是Skill的一种生产方式和Seg封装并行,产物可以在同一个Agent框架下混合使用。

