0:00.000–0:01.560
点击一下识别说话人
0:01.560–0:04.140
就会识别出视频的7个说话人
0:04.140–0:07.340
并将字幕按照步图说话人完成分割
0:07.340–0:09.820
不少小伙伴提建议
0:09.820–0:11.480
期望好玩字幕软件
0:11.480–0:14.820
增加类似Energy Labs的说话人识别功能
0:14.820–0:17.000
新的版本已经加上了
0:17.000–0:19.060
接下来来看一下如何使用
0:19.060–0:21.960
首先需要下载说话人识别模型
0:21.960–0:24.200
点击下载转入模型
0:24.200–0:27.200
你会看到两个新的说话人识别模型
0:27.200–0:29.000
一个是通院模型
0:29.000–0:31.160
一个是英语专院模型
0:31.160–0:33.860
老用户点击下载即可
0:33.860–0:34.940
新用户的话
0:34.940–0:36.980
当你下载转入模型的时候
0:36.980–0:40.440
程序会自动下载通院说话人识别模型
0:40.440–0:42.420
这是一个蓝人杀的视频
0:42.420–0:44.120
共有7个说话人
0:44.120–0:45.880
先使用转入功能
0:45.880–0:47.200
转入出字幕
0:47.200–0:53.260
可以切换到段落试图
0:53.260–0:57.540
该试图操作跟Energy Labs的字幕编辑器很相似
0:57.540–1:00.480
可以看到没有识别说话人之前
1:00.480–1:03.780
不同说话人的字幕是混在段落中的
1:03.780–1:05.920
点击识别说话人
1:05.920–1:08.060
要设置说话人的数量
1:08.060–1:11.060
你可以开启自动识别说话人的数量
1:11.060–1:14.780
默认已经开启了匹配已注册说话人的功能
1:14.780–1:18.180
点击这里可以查看已注册的说话人
1:18.180–1:20.180
点击执行等待一会儿
1:20.180–1:23.420
可以看到段落按照说话人分割完成了
1:23.420–1:25.620
可以试听一下几个片段
1:25.620–1:27.060
天亮了
1:27.060–1:29.060
昨天晚上是个平安夜
1:29.060–1:31.500
哎呀
1:31.500–1:32.700
都是
1:32.700–1:33.200
哎
1:33.200–1:34.100
都照我
1:34.100–1:35.060
都说人都会照我
1:35.060–1:37.060
昨天晚上为什么没叫我起来
1:37.060–1:38.500
就很奇怪
1:38.500–1:40.060
从一号玩家开始发言
1:40.060–1:42.180
可以看到分割是比较准确的
1:42.180–1:43.940
但是难免会有错误
1:43.940–1:47.780
比如这两人的声音很像就没有准确的识别
1:47.780–1:50.820
另外语音句子比较短的情况下面
1:50.820–1:52.820
也会容易识别错误
1:52.820–1:56.420
号数会在未来的版本中持续优化准确率
1:56.420–1:58.820
下一步就需要修改说话人
1:58.820–2:01.860
并将说话人注册到声文库中
2:01.860–2:04.020
点击说话人图标
2:04.020–2:06.500
这里可以修改说话人的名称
2:06.500–2:07.620
修改后
2:07.620–2:10.660
该句子以及后续该说话人的句子
2:10.660–2:13.260
说话人的名称都会被修改掉
2:13.260–2:15.820
你也可以在这里选择说话人
2:15.820–2:19.500
也可以在这里选择已注册声文的说话人
2:19.500–2:21.100
点击注册说话人
2:21.100–2:24.140
会将说话人注册到声文库中
2:24.140–2:26.380
当你识别说话人的时候
2:26.380–2:28.140
开启匹配开关
2:28.140–2:30.940
就会匹配声文库中的说话人了
2:30.940–2:34.220
你可以在设置中找到说话人设置
2:34.220–2:36.620
可以看到已注册的说话人
2:36.620–2:39.420
注意不同的说话人识别模型
2:39.420–2:41.180
声文库是不通用的
2:41.180–2:43.740
了解了操作就可以完成整个视频
2:43.740–2:45.660
字幕的说话人修改
2:45.660–2:49.820
完成后再次识别该视频或是同类的视频
2:49.820–2:53.100
就会准确的识别出不同的说话人了
2:53.100–2:56.460
那么如何过滤出不同说话人的字幕呢
2:56.460–2:58.940
点击这里的说话人选择框
2:58.940–3:02.060
你可以选择显示不同说话人的字幕
3:02.060–3:06.540
这个过滤操作在文稿章节试图也是生效的
3:06.540–3:11.020
常见的愿途是用户要复制出指定说话人的文稿
3:11.020–3:16.620
如果你不希望显示开始时间与显示说话人
3:16.620–3:18.620
可以点这里的两个开关
3:18.620–3:22.460
点击导出类录就可以将文稿导出了
3:22.460–3:27.020
如何导出带有说话人的srt 文件呢
3:27.020–3:29.900
点击导出打开说话人开关
3:29.900–3:33.500
即可导出带说话人的srt 字幕文件了
0:00.000–0:01.560
(此句尚無繁中翻譯)
0:01.560–0:04.140
(此句尚無繁中翻譯)
0:04.140–0:07.340
(此句尚無繁中翻譯)
0:07.340–0:09.820
(此句尚無繁中翻譯)
0:09.820–0:11.480
(此句尚無繁中翻譯)
0:11.480–0:14.820
(此句尚無繁中翻譯)
0:14.820–0:17.000
(此句尚無繁中翻譯)
0:17.000–0:19.060
(此句尚無繁中翻譯)
0:19.060–0:21.960
(此句尚無繁中翻譯)
0:21.960–0:24.200
(此句尚無繁中翻譯)
0:24.200–0:27.200
(此句尚無繁中翻譯)
0:27.200–0:29.000
(此句尚無繁中翻譯)
0:29.000–0:31.160
(此句尚無繁中翻譯)
0:31.160–0:33.860
(此句尚無繁中翻譯)
0:33.860–0:34.940
(此句尚無繁中翻譯)
0:34.940–0:36.980
(此句尚無繁中翻譯)
0:36.980–0:40.440
(此句尚無繁中翻譯)
0:40.440–0:42.420
(此句尚無繁中翻譯)
0:42.420–0:44.120
(此句尚無繁中翻譯)
0:44.120–0:45.880
(此句尚無繁中翻譯)
0:45.880–0:47.200
(此句尚無繁中翻譯)
0:47.200–0:53.260
(此句尚無繁中翻譯)
0:53.260–0:57.540
(此句尚無繁中翻譯)
0:57.540–1:00.480
(此句尚無繁中翻譯)
1:00.480–1:03.780
(此句尚無繁中翻譯)
1:03.780–1:05.920
(此句尚無繁中翻譯)
1:05.920–1:08.060
(此句尚無繁中翻譯)
1:08.060–1:11.060
(此句尚無繁中翻譯)
1:11.060–1:14.780
(此句尚無繁中翻譯)
1:14.780–1:18.180
(此句尚無繁中翻譯)
1:18.180–1:20.180
(此句尚無繁中翻譯)
1:20.180–1:23.420
(此句尚無繁中翻譯)
1:23.420–1:25.620
(此句尚無繁中翻譯)
1:25.620–1:27.060
(此句尚無繁中翻譯)
1:27.060–1:29.060
(此句尚無繁中翻譯)
1:29.060–1:31.500
(此句尚無繁中翻譯)
1:31.500–1:32.700
(此句尚無繁中翻譯)
1:32.700–1:33.200
(此句尚無繁中翻譯)
1:33.200–1:34.100
(此句尚無繁中翻譯)
1:34.100–1:35.060
(此句尚無繁中翻譯)
1:35.060–1:37.060
(此句尚無繁中翻譯)
1:37.060–1:38.500
(此句尚無繁中翻譯)
1:38.500–1:40.060
(此句尚無繁中翻譯)
1:40.060–1:42.180
(此句尚無繁中翻譯)
1:42.180–1:43.940
(此句尚無繁中翻譯)
1:43.940–1:47.780
(此句尚無繁中翻譯)
1:47.780–1:50.820
(此句尚無繁中翻譯)
1:50.820–1:52.820
(此句尚無繁中翻譯)
1:52.820–1:56.420
(此句尚無繁中翻譯)
1:56.420–1:58.820
(此句尚無繁中翻譯)
1:58.820–2:01.860
(此句尚無繁中翻譯)
2:01.860–2:04.020
(此句尚無繁中翻譯)
2:04.020–2:06.500
(此句尚無繁中翻譯)
2:06.500–2:07.620
(此句尚無繁中翻譯)
2:07.620–2:10.660
(此句尚無繁中翻譯)
2:10.660–2:13.260
(此句尚無繁中翻譯)
2:13.260–2:15.820
(此句尚無繁中翻譯)
2:15.820–2:19.500
(此句尚無繁中翻譯)
2:19.500–2:21.100
(此句尚無繁中翻譯)
2:21.100–2:24.140
(此句尚無繁中翻譯)
2:24.140–2:26.380
(此句尚無繁中翻譯)
2:26.380–2:28.140
(此句尚無繁中翻譯)
2:28.140–2:30.940
(此句尚無繁中翻譯)
2:30.940–2:34.220
(此句尚無繁中翻譯)
2:34.220–2:36.620
(此句尚無繁中翻譯)
2:36.620–2:39.420
(此句尚無繁中翻譯)
2:39.420–2:41.180
(此句尚無繁中翻譯)
2:41.180–2:43.740
(此句尚無繁中翻譯)
2:43.740–2:45.660
(此句尚無繁中翻譯)
2:45.660–2:49.820
(此句尚無繁中翻譯)
2:49.820–2:53.100
(此句尚無繁中翻譯)
2:53.100–2:56.460
(此句尚無繁中翻譯)
2:56.460–2:58.940
(此句尚無繁中翻譯)
2:58.940–3:02.060
(此句尚無繁中翻譯)
3:02.060–3:06.540
(此句尚無繁中翻譯)
3:06.540–3:11.020
(此句尚無繁中翻譯)
3:11.020–3:16.620
(此句尚無繁中翻譯)
3:16.620–3:18.620
(此句尚無繁中翻譯)
3:18.620–3:22.460
(此句尚無繁中翻譯)
3:22.460–3:27.020
(此句尚無繁中翻譯)
3:27.020–3:29.900
(此句尚無繁中翻譯)
3:29.900–3:33.500
(此句尚無繁中翻譯)
0:00.000–0:01.560
点击一下识别说话人
(此句尚無繁中翻譯)
0:01.560–0:04.140
就会识别出视频的7个说话人
(此句尚無繁中翻譯)
0:04.140–0:07.340
并将字幕按照步图说话人完成分割
(此句尚無繁中翻譯)
0:07.340–0:09.820
不少小伙伴提建议
(此句尚無繁中翻譯)
0:09.820–0:11.480
期望好玩字幕软件
(此句尚無繁中翻譯)
0:11.480–0:14.820
增加类似Energy Labs的说话人识别功能
(此句尚無繁中翻譯)
0:14.820–0:17.000
新的版本已经加上了
(此句尚無繁中翻譯)
0:17.000–0:19.060
接下来来看一下如何使用
(此句尚無繁中翻譯)
0:19.060–0:21.960
首先需要下载说话人识别模型
(此句尚無繁中翻譯)
0:21.960–0:24.200
点击下载转入模型
(此句尚無繁中翻譯)
0:24.200–0:27.200
你会看到两个新的说话人识别模型
(此句尚無繁中翻譯)
0:27.200–0:29.000
一个是通院模型
(此句尚無繁中翻譯)
0:29.000–0:31.160
一个是英语专院模型
(此句尚無繁中翻譯)
0:31.160–0:33.860
老用户点击下载即可
(此句尚無繁中翻譯)
0:33.860–0:34.940
新用户的话
(此句尚無繁中翻譯)
0:34.940–0:36.980
当你下载转入模型的时候
(此句尚無繁中翻譯)
0:36.980–0:40.440
程序会自动下载通院说话人识别模型
(此句尚無繁中翻譯)
0:40.440–0:42.420
这是一个蓝人杀的视频
(此句尚無繁中翻譯)
0:42.420–0:44.120
共有7个说话人
(此句尚無繁中翻譯)
0:44.120–0:45.880
先使用转入功能
(此句尚無繁中翻譯)
0:45.880–0:47.200
转入出字幕
(此句尚無繁中翻譯)
0:47.200–0:53.260
可以切换到段落试图
(此句尚無繁中翻譯)
0:53.260–0:57.540
该试图操作跟Energy Labs的字幕编辑器很相似
(此句尚無繁中翻譯)
0:57.540–1:00.480
可以看到没有识别说话人之前
(此句尚無繁中翻譯)
1:00.480–1:03.780
不同说话人的字幕是混在段落中的
(此句尚無繁中翻譯)
1:03.780–1:05.920
点击识别说话人
(此句尚無繁中翻譯)
1:05.920–1:08.060
要设置说话人的数量
(此句尚無繁中翻譯)
1:08.060–1:11.060
你可以开启自动识别说话人的数量
(此句尚無繁中翻譯)
1:11.060–1:14.780
默认已经开启了匹配已注册说话人的功能
(此句尚無繁中翻譯)
1:14.780–1:18.180
点击这里可以查看已注册的说话人
(此句尚無繁中翻譯)
1:18.180–1:20.180
点击执行等待一会儿
(此句尚無繁中翻譯)
1:20.180–1:23.420
可以看到段落按照说话人分割完成了
(此句尚無繁中翻譯)
1:23.420–1:25.620
可以试听一下几个片段
(此句尚無繁中翻譯)
1:25.620–1:27.060
天亮了
(此句尚無繁中翻譯)
1:27.060–1:29.060
昨天晚上是个平安夜
(此句尚無繁中翻譯)
1:29.060–1:31.500
哎呀
(此句尚無繁中翻譯)
1:31.500–1:32.700
都是
(此句尚無繁中翻譯)
1:32.700–1:33.200
哎
(此句尚無繁中翻譯)
1:33.200–1:34.100
都照我
(此句尚無繁中翻譯)
1:34.100–1:35.060
都说人都会照我
(此句尚無繁中翻譯)
1:35.060–1:37.060
昨天晚上为什么没叫我起来
(此句尚無繁中翻譯)
1:37.060–1:38.500
就很奇怪
(此句尚無繁中翻譯)
1:38.500–1:40.060
从一号玩家开始发言
(此句尚無繁中翻譯)
1:40.060–1:42.180
可以看到分割是比较准确的
(此句尚無繁中翻譯)
1:42.180–1:43.940
但是难免会有错误
(此句尚無繁中翻譯)
1:43.940–1:47.780
比如这两人的声音很像就没有准确的识别
(此句尚無繁中翻譯)
1:47.780–1:50.820
另外语音句子比较短的情况下面
(此句尚無繁中翻譯)
1:50.820–1:52.820
也会容易识别错误
(此句尚無繁中翻譯)
1:52.820–1:56.420
号数会在未来的版本中持续优化准确率
(此句尚無繁中翻譯)
1:56.420–1:58.820
下一步就需要修改说话人
(此句尚無繁中翻譯)
1:58.820–2:01.860
并将说话人注册到声文库中
(此句尚無繁中翻譯)
2:01.860–2:04.020
点击说话人图标
(此句尚無繁中翻譯)
2:04.020–2:06.500
这里可以修改说话人的名称
(此句尚無繁中翻譯)
2:06.500–2:07.620
修改后
(此句尚無繁中翻譯)
2:07.620–2:10.660
该句子以及后续该说话人的句子
(此句尚無繁中翻譯)
2:10.660–2:13.260
说话人的名称都会被修改掉
(此句尚無繁中翻譯)
2:13.260–2:15.820
你也可以在这里选择说话人
(此句尚無繁中翻譯)
2:15.820–2:19.500
也可以在这里选择已注册声文的说话人
(此句尚無繁中翻譯)
2:19.500–2:21.100
点击注册说话人
(此句尚無繁中翻譯)
2:21.100–2:24.140
会将说话人注册到声文库中
(此句尚無繁中翻譯)
2:24.140–2:26.380
当你识别说话人的时候
(此句尚無繁中翻譯)
2:26.380–2:28.140
开启匹配开关
(此句尚無繁中翻譯)
2:28.140–2:30.940
就会匹配声文库中的说话人了
(此句尚無繁中翻譯)
2:30.940–2:34.220
你可以在设置中找到说话人设置
(此句尚無繁中翻譯)
2:34.220–2:36.620
可以看到已注册的说话人
(此句尚無繁中翻譯)
2:36.620–2:39.420
注意不同的说话人识别模型
(此句尚無繁中翻譯)
2:39.420–2:41.180
声文库是不通用的
(此句尚無繁中翻譯)
2:41.180–2:43.740
了解了操作就可以完成整个视频
(此句尚無繁中翻譯)
2:43.740–2:45.660
字幕的说话人修改
(此句尚無繁中翻譯)
2:45.660–2:49.820
完成后再次识别该视频或是同类的视频
(此句尚無繁中翻譯)
2:49.820–2:53.100
就会准确的识别出不同的说话人了
(此句尚無繁中翻譯)
2:53.100–2:56.460
那么如何过滤出不同说话人的字幕呢
(此句尚無繁中翻譯)
2:56.460–2:58.940
点击这里的说话人选择框
(此句尚無繁中翻譯)
2:58.940–3:02.060
你可以选择显示不同说话人的字幕
(此句尚無繁中翻譯)
3:02.060–3:06.540
这个过滤操作在文稿章节试图也是生效的
(此句尚無繁中翻譯)
3:06.540–3:11.020
常见的愿途是用户要复制出指定说话人的文稿
(此句尚無繁中翻譯)
3:11.020–3:16.620
如果你不希望显示开始时间与显示说话人
(此句尚無繁中翻譯)
3:16.620–3:18.620
可以点这里的两个开关
(此句尚無繁中翻譯)
3:18.620–3:22.460
点击导出类录就可以将文稿导出了
(此句尚無繁中翻譯)
3:22.460–3:27.020
如何导出带有说话人的srt 文件呢
(此句尚無繁中翻譯)
3:27.020–3:29.900
点击导出打开说话人开关
(此句尚無繁中翻譯)
3:29.900–3:33.500
即可导出带说话人的srt 字幕文件了
(此句尚無繁中翻譯)
影片筆記:说话人识别详细使用教程—haoone 字幕软件 V11 上新,对齐 elevenlabs 的说话人识别功能
一句話總結
本影片介紹了 haoone 字幕軟體 V11 版本新增的「說話人識別」功能,該功能參考了 Energy Labs 的設計,支援下載特定模型(如通院模型、英語專院模型)以自動分割字幕段落、註冊說話人至聲文庫,並提供基於說話人的字幕過濾與 SRT 導出功能,同時提醒用戶注意聲音相似或語句過短時的識別準確度問題。
核心重點
- 功能背景:回應用戶建議,V11 版本新增了類似 Energy Labs 的說話人識別功能,旨在將字幕按說話人進行分割。
- 模型下載機制:
- 用戶需手動下載說話人識別模型。
- 提供「通院模型」與「英語專院模型」兩種選擇。
- 新用戶在點擊下載轉入模型時,程序會自動下載「通院說話人識別模型」。
- 識別操作流程:
- 生成字幕後切換至段落視圖,點擊「識別說話人」。
- 可設定說話人數量,並開啟「自動識別數量」或「匹配已註冊說話人」功能。
- 識別完成後,段落會按說話人分割。
- 準確性與限制:
- 系統能大致準確識別(如以「藍人殺」7個說話人為例)。
- 常見錯誤情境包括:聲音相似者難以識別、語句較短時易識別錯誤。
- 號數表示未來版本將持續優化準確率。
- 說話人管理與聲文庫:
- 可修改說話人名稱,修改後該句及後續該說話人的名稱會同步更新。
- 可將說話人「註冊」至聲文庫,識別時若開啟匹配開關,將匹配聲文庫中的說話人。
- 重要限制:不同的說話人識別模型,其聲文庫不通用。
- 字幕過濾與導出:
- 可透過說話人選擇框過濾顯示不同說話人的字幕(此過濾在文稿章節視圖亦生效)。
- 常見用途為複製指定說話人的文稿。
- 可關閉「顯示開始時間」與「顯示說話人」開關以簡化顯示。
- 導出帶有說話人的 SRT 文件:點擊導出並打開說話人開關即可。
詳細大綱
1. 功能背景與更新
- 回應用戶建議,新增類似 Energy Labs 的說話人識別功能。
- 新版本已整合此功能,可將字幕按說話人進行分割。
2. 模型下載與準備
- 需先下載說話人識別模型。
- 提供兩種模型:通院模型、英語專院模型。
- 老用戶需手動點擊下載;新用戶在點擊下載轉入模型時,程序會自動下載通院說話人識別模型。
3. 識別操作流程
- 使用轉入功能生成字幕後,切換至段落視圖。
- 點擊「識別說話人」,設定說話人數量(可開啟自動識別數量)。
- 預設開啟「匹配已註冊說話人」功能,可查看已註冊列表。
- 執行識別後,段落會按說話人分割完成。
4. 識別準確性與限制
- 以藍人殺影片(7個說話人)為例,從第一號玩家開始發言,分割大致準確。
- 常見錯誤情境:聲音相似者難以準確識別、語句較短時易識別錯誤。
- 號數表示未來版本將持續優化準確率。
5. 說話人註冊與管理
- 點擊說話人圖標可修改名稱,修改後該句及後續該說話人的名稱會同步更新。
- 可選擇已註冊聲文的說話人,點擊「註冊說話人」將其加入聲文庫。
- 識別時若開啟匹配開關,將匹配聲文庫中的說話人。
- 可在設置中找到說話人設置查看已註冊名單。
- 注意:不同的說話人識別模型,其聲文庫不通用。
6. 字幕過濾與導出
- 完成識別後,可再次識別該視頻或同類視頻以提高準確度。
- 透過說話人選擇框,可過濾顯示不同說話人的字幕(此過濾在文稿章節視圖亦生效)。
- 常見用途:複製指定說話人的文稿。
- 可關閉「顯示開始時間」與「顯示說話人」開關以簡化顯示。
- 點擊「導出字幕」可導出文稿。
- 導出帶有說話人的 SRT 文件:點擊導出並打開說話人開關即可。
工具 / 模型 / 名詞整理
- Energy Labs:影片中提及作為功能參考對象的軟體或服務。
- 通院模型:說話人識別模型之一,新用戶自動下載的模型。
- 英語專院模型:說話人識別模型之一。
- 轉入模型:程序自動下載的模型,新用戶點擊下載時觸發。
- 聲文庫:用於註冊和匹配說話人的資料庫。
- SRT:字幕文件格式,支援導出帶有說話人標記的文件。
- 藍人殺:影片中用於演示識別準確度的視頻名稱。
- 步圖:逐字稿中出現的詞彙,意指分割字幕的依據或視圖,具體含義不明。
- 號數:逐字稿中提及與準確率優化相關的詞彙,具體指代不明。
- 願途:逐字稿中提及的詞彙,意指「用途」,但原文如此。
操作流程整理
- 下載模型:
- 老用戶:手動點擊下載說話人識別模型(通院模型或英語專院模型)。
- 新用戶:點擊下載轉入模型,程序自動下載通院說話人識別模型。
- 生成與識別字幕:
- 使用轉入功能生成字幕。
- 切換至段落視圖。
- 點擊「識別說話人」。
- 設定說話人數量(可選擇開啟自動識別數量)。
- 確認開啟「匹配已註冊說話人」功能(預設開啟)。
- 執行識別,段落按說話人分割。
- 管理說話人:
- 點擊說話人圖標修改名稱(同步更新該句及後續該說話人名稱)。
- 選擇已註冊聲文的說話人,點擊「註冊說話人」加入聲文庫。
- 在設置中查看說話人設置及已註冊名單。
- 過濾與導出:
- 透過說話人選擇框過濾顯示不同說話人的字幕(文稿章節視圖亦生效)。
- (可選)關閉「顯示開始時間」與「顯示說話人」開關以簡化顯示。
- 點擊「導出字幕」,打開說話人開關,導出帶有說話人的 SRT 文件。
值得注意的限制或風險
- 聲文庫不通用:不同的說話人識別模型,其聲文庫不通用,註冊的說話人無法跨模型使用。
- 識別準確度限制:
- 未來優化:號數表示未來版本將持續優化準確率,暗示當前版本可能存在不完美之處。
逐字稿辨識疑點
- 步圖:逐字稿中出現「將字幕按照步圖說話人完成分割」,疑為「步圖」為聽寫錯誤,可能意指「步驟」或特定視圖名稱,但無法確認。
- 轉入模型:逐字稿多次提及「下載轉入模型」、「程序會自動下載通院說話人識別模型」,其中「轉入」一詞在語境中稍顯突兀,疑為「轉錄」或特定模型名稱的聽誤,需查證。
- 通院模型 / 英語專院模型:逐字稿中明確提及「通院」與「英語專院」,疑為「通用」與「英語專用」的聽誤,但依規則保留原樣。
- 藍人殺:逐字稿中提及「這是一個藍人殺的視頻」,疑為特定影片名稱或聽誤(如「藍人秀」或其他),需查證。
- 號數:逐字稿中提及「號數會在未來的版本中持續優化準確率」,疑為「準確率」或「識別率」的聽誤,但依規則保留原樣。
- 願途:逐字稿中提及「常見的願途是用戶要複製出指定說話人的文稿」,疑為「用途」的聽誤,但依規則保留原樣。
可延伸追問
- 「通院模型」與「英語專院模型」的具體區別是什麼?是否僅限於語言差異?
- 「轉入模型」是否為軟體內的特定功能名稱,還是聽誤?
- 「藍人殺」具體是指哪部影片或哪種類型的內容?
- 若識別錯誤,手動修正的具體操作步驟為何?
- 聲文庫的數據是否會隨軟體更新而保留?
尚未產生學習筆記
請在 Telegram 指令最後加上「學習」,例如:videonote 網址 英文 雙語 學習