0:00.000–0:01.830
点击一下识别说话人,
0:01.830–0:04.392
就会识别出视频的7个说话人,
0:04.392–0:07.320
并将字幕按照步图说话人完成分割。
0:08.220–0:09.656
不少小伙伴提建议,
0:09.656–0:11.091
请问好玩字幕软件,
0:11.091–0:14.760
增加类似Enever Labs的说话人识别功能。
0:15.260–0:19.040
新的版本已经加上了,接下来来看一下如何使用。
0:19.480–0:24.180
首先需要下载说话人识别模型,点击下载转入模型。
0:24.180–0:31.120
你会看到两个新的说话人识别模型,一个是通院模型,一个是英语专院模型。
0:31.740–0:33.660
老用户点击下载即可。
0:34.100–0:40.400
新用户的话,当你下载转入模型的时候,程序会自动下载通院说话人识别模型。
0:40.820–0:44.060
这是一个蓝人杀的视频,共有7个说话人。
0:44.500–0:47.180
先使用转入功能,转入出字幕。
0:51.380–0:53.220
可以切换到段落试图。
0:53.220–0:57.540
该视图操作跟Enever Labs的字幕编辑器很相似。
0:58.220–1:03.780
可以看到没有识别说话人之前,不同说话人的字幕是混在段落中的。
1:04.540–1:08.020
点击识别说话人,要设置说话人的数量。
1:08.480–1:11.000
你可以开启自动识别说话人的数量。
1:11.340–1:14.720
木软已经开启了匹配已注册说话人的功能。
1:15.300–1:18.120
点击这里可以查看已注册的说话人。
1:18.120–1:23.620
点击执行,等待一会儿,可以看到段落按照说话人分割完成了。
1:24.120–1:25.740
可以试听一下几个片段。
1:26.440–1:29.140
天亮了,昨天晚上是个平安夜。
1:29.440–1:35.440
哎呀,都是,哎呀,都是,都照我,都说人都会照我。
1:35.580–1:37.120
昨天晚上为什么没叫我起来?
1:37.640–1:38.500
就很奇怪。
1:38.500–1:44.220
可以看到分割是比较准确的,但是难免会有错误。
1:44.540–1:47.620
比如这两人的声音很像,就没有准确的识别。
1:48.240–1:52.760
另外,语音句子比较短的情况下面,也会容易识别错误。
1:53.140–1:56.220
号数会在未来的版本中持续优化准确率。
1:56.720–2:01.700
下一步就需要修改说话人,并将说话人注册到声文库中。
2:02.500–2:06.380
点击说话人图标,这里可以修改说话人的名称。
2:06.380–2:13.120
修改后,该句子以及后续该说话人的句子,说话人的名称都会被修改掉。
2:13.740–2:19.420
你也可以在这里选择说话人,也可以在这里选择已注册声文的说话人。
2:19.640–2:24.040
点击注册说话人,会将说话人注册到声文库中。
2:24.600–2:30.860
当你识别说话人的时候,开启匹配开关,就会匹配声文库中的说话人了。
2:31.440–2:36.360
你可以在设置中找到说话人设置,可以看到已注册的说话人。
2:36.380–2:41.180
注意,不同的说话人识别模型,声文库是不通用的。
2:41.400–2:45.220
了解了操作,就可以完成整个视频字幕的说话人修改。
2:45.980–2:49.836
完成后,再次识别该视频或者是同类的视频,
2:49.836–2:52.920
就会准确地识别出不同的说话人了。
2:53.340–2:56.220
那么如何过滤出不同说话人的字幕呢?
2:56.220–2:59.020
点击这里的说话人选择框。
2:59.020–3:01.900
你可以选择显示不同说话人的字幕。
3:01.900–3:06.060
这个过滤操作在文稿章节试图也是生效的。
3:06.060–3:10.360
常见的愿选择是,用户要复制出指定说话人的文稿。
3:12.660–3:18.340
如果你不希望显示开始时间与显示说话人,可以点这里的两个开关。
3:19.240–3:22.240
点击导出内容,就可以将文稿导出了。
3:23.540–3:26.540
如何导出带有说话人的SRT文件呢?
3:26.940–3:29.520
点击导出,打开说话人开关。
3:30.060–3:33.460
即可导出带说话人的SRT字幕文件了。
3:33.460–3:35.460
点击导出,打开说话人的SRT字幕文件了。
3:35.460–3:36.460
点击导出,打开说话人的SRT字幕文件了。
3:36.460–3:36.967
点击导出,打开说话人的SRT字幕文件了。
0:00.000–0:01.830
点击一下识别说话人,
0:01.830–0:04.392
就会识别出视频的7个说话人,
0:04.392–0:07.320
并将字幕按照步图说话人完成分割。
0:08.220–0:09.656
不少小伙伴提建议,
0:09.656–0:11.091
请问好玩字幕软件,
0:11.091–0:14.760
增加类似Enever Labs的说话人识别功能。
0:15.260–0:19.040
新的版本已经加上了,接下来来看一下如何使用。
0:19.480–0:24.180
首先需要下载说话人识别模型,点击下载转入模型。
0:24.180–0:31.120
你会看到两个新的说话人识别模型,一个是通院模型,一个是英语专院模型。
0:31.740–0:33.660
老用户点击下载即可。
0:34.100–0:40.400
新用户的话,当你下载转入模型的时候,程序会自动下载通院说话人识别模型。
0:40.820–0:44.060
这是一个蓝人杀的视频,共有7个说话人。
0:44.500–0:47.180
先使用转入功能,转入出字幕。
0:51.380–0:53.220
可以切换到段落试图。
0:53.220–0:57.540
该视图操作跟Enever Labs的字幕编辑器很相似。
0:58.220–1:03.780
可以看到没有识别说话人之前,不同说话人的字幕是混在段落中的。
1:04.540–1:08.020
点击识别说话人,要设置说话人的数量。
1:08.480–1:11.000
你可以开启自动识别说话人的数量。
1:11.340–1:14.720
木软已经开启了匹配已注册说话人的功能。
1:15.300–1:18.120
点击这里可以查看已注册的说话人。
1:18.120–1:23.620
点击执行,等待一会儿,可以看到段落按照说话人分割完成了。
1:24.120–1:25.740
可以试听一下几个片段。
1:26.440–1:29.140
天亮了,昨天晚上是个平安夜。
1:29.440–1:35.440
哎呀,都是,哎呀,都是,都照我,都说人都会照我。
1:35.580–1:37.120
昨天晚上为什么没叫我起来?
1:37.640–1:38.500
就很奇怪。
1:38.500–1:44.220
可以看到分割是比较准确的,但是难免会有错误。
1:44.540–1:47.620
比如这两人的声音很像,就没有准确的识别。
1:48.240–1:52.760
另外,语音句子比较短的情况下面,也会容易识别错误。
1:53.140–1:56.220
号数会在未来的版本中持续优化准确率。
1:56.720–2:01.700
下一步就需要修改说话人,并将说话人注册到声文库中。
2:02.500–2:06.380
点击说话人图标,这里可以修改说话人的名称。
2:06.380–2:13.120
修改后,该句子以及后续该说话人的句子,说话人的名称都会被修改掉。
2:13.740–2:19.420
你也可以在这里选择说话人,也可以在这里选择已注册声文的说话人。
2:19.640–2:24.040
点击注册说话人,会将说话人注册到声文库中。
2:24.600–2:30.860
当你识别说话人的时候,开启匹配开关,就会匹配声文库中的说话人了。
2:31.440–2:36.360
你可以在设置中找到说话人设置,可以看到已注册的说话人。
2:36.380–2:41.180
注意,不同的说话人识别模型,声文库是不通用的。
2:41.400–2:45.220
了解了操作,就可以完成整个视频字幕的说话人修改。
2:45.980–2:49.836
完成后,再次识别该视频或者是同类的视频,
2:49.836–2:52.920
就会准确地识别出不同的说话人了。
2:53.340–2:56.220
那么如何过滤出不同说话人的字幕呢?
2:56.220–2:59.020
点击这里的说话人选择框。
2:59.020–3:01.900
你可以选择显示不同说话人的字幕。
3:01.900–3:06.060
这个过滤操作在文稿章节试图也是生效的。
3:06.060–3:10.360
常见的愿选择是,用户要复制出指定说话人的文稿。
3:12.660–3:18.340
如果你不希望显示开始时间与显示说话人,可以点这里的两个开关。
3:19.240–3:22.240
点击导出内容,就可以将文稿导出了。
3:23.540–3:26.540
如何导出带有说话人的SRT文件呢?
3:26.940–3:29.520
点击导出,打开说话人开关。
3:30.060–3:33.460
即可导出带说话人的SRT字幕文件了。
3:33.460–3:35.460
点击导出,打开说话人的SRT字幕文件了。
3:35.460–3:36.460
点击导出,打开说话人的SRT字幕文件了。
3:36.460–3:36.967
点击导出,打开说话人的SRT字幕文件了。
0:00.000–0:01.830
点击一下识别说话人,
点击一下识别说话人,
0:01.830–0:04.392
就会识别出视频的7个说话人,
就会识别出视频的7个说话人,
0:04.392–0:07.320
并将字幕按照步图说话人完成分割。
并将字幕按照步图说话人完成分割。
0:08.220–0:09.656
不少小伙伴提建议,
不少小伙伴提建议,
0:09.656–0:11.091
请问好玩字幕软件,
请问好玩字幕软件,
0:11.091–0:14.760
增加类似Enever Labs的说话人识别功能。
增加类似Enever Labs的说话人识别功能。
0:15.260–0:19.040
新的版本已经加上了,接下来来看一下如何使用。
新的版本已经加上了,接下来来看一下如何使用。
0:19.480–0:24.180
首先需要下载说话人识别模型,点击下载转入模型。
首先需要下载说话人识别模型,点击下载转入模型。
0:24.180–0:31.120
你会看到两个新的说话人识别模型,一个是通院模型,一个是英语专院模型。
你会看到两个新的说话人识别模型,一个是通院模型,一个是英语专院模型。
0:31.740–0:33.660
老用户点击下载即可。
老用户点击下载即可。
0:34.100–0:40.400
新用户的话,当你下载转入模型的时候,程序会自动下载通院说话人识别模型。
新用户的话,当你下载转入模型的时候,程序会自动下载通院说话人识别模型。
0:40.820–0:44.060
这是一个蓝人杀的视频,共有7个说话人。
这是一个蓝人杀的视频,共有7个说话人。
0:44.500–0:47.180
先使用转入功能,转入出字幕。
先使用转入功能,转入出字幕。
0:51.380–0:53.220
可以切换到段落试图。
可以切换到段落试图。
0:53.220–0:57.540
该视图操作跟Enever Labs的字幕编辑器很相似。
该视图操作跟Enever Labs的字幕编辑器很相似。
0:58.220–1:03.780
可以看到没有识别说话人之前,不同说话人的字幕是混在段落中的。
可以看到没有识别说话人之前,不同说话人的字幕是混在段落中的。
1:04.540–1:08.020
点击识别说话人,要设置说话人的数量。
点击识别说话人,要设置说话人的数量。
1:08.480–1:11.000
你可以开启自动识别说话人的数量。
你可以开启自动识别说话人的数量。
1:11.340–1:14.720
木软已经开启了匹配已注册说话人的功能。
木软已经开启了匹配已注册说话人的功能。
1:15.300–1:18.120
点击这里可以查看已注册的说话人。
点击这里可以查看已注册的说话人。
1:18.120–1:23.620
点击执行,等待一会儿,可以看到段落按照说话人分割完成了。
点击执行,等待一会儿,可以看到段落按照说话人分割完成了。
1:24.120–1:25.740
可以试听一下几个片段。
可以试听一下几个片段。
1:26.440–1:29.140
天亮了,昨天晚上是个平安夜。
天亮了,昨天晚上是个平安夜。
1:29.440–1:35.440
哎呀,都是,哎呀,都是,都照我,都说人都会照我。
哎呀,都是,哎呀,都是,都照我,都说人都会照我。
1:35.580–1:37.120
昨天晚上为什么没叫我起来?
昨天晚上为什么没叫我起来?
1:37.640–1:38.500
就很奇怪。
就很奇怪。
1:38.500–1:44.220
可以看到分割是比较准确的,但是难免会有错误。
可以看到分割是比较准确的,但是难免会有错误。
1:44.540–1:47.620
比如这两人的声音很像,就没有准确的识别。
比如这两人的声音很像,就没有准确的识别。
1:48.240–1:52.760
另外,语音句子比较短的情况下面,也会容易识别错误。
另外,语音句子比较短的情况下面,也会容易识别错误。
1:53.140–1:56.220
号数会在未来的版本中持续优化准确率。
号数会在未来的版本中持续优化准确率。
1:56.720–2:01.700
下一步就需要修改说话人,并将说话人注册到声文库中。
下一步就需要修改说话人,并将说话人注册到声文库中。
2:02.500–2:06.380
点击说话人图标,这里可以修改说话人的名称。
点击说话人图标,这里可以修改说话人的名称。
2:06.380–2:13.120
修改后,该句子以及后续该说话人的句子,说话人的名称都会被修改掉。
修改后,该句子以及后续该说话人的句子,说话人的名称都会被修改掉。
2:13.740–2:19.420
你也可以在这里选择说话人,也可以在这里选择已注册声文的说话人。
你也可以在这里选择说话人,也可以在这里选择已注册声文的说话人。
2:19.640–2:24.040
点击注册说话人,会将说话人注册到声文库中。
点击注册说话人,会将说话人注册到声文库中。
2:24.600–2:30.860
当你识别说话人的时候,开启匹配开关,就会匹配声文库中的说话人了。
当你识别说话人的时候,开启匹配开关,就会匹配声文库中的说话人了。
2:31.440–2:36.360
你可以在设置中找到说话人设置,可以看到已注册的说话人。
你可以在设置中找到说话人设置,可以看到已注册的说话人。
2:36.380–2:41.180
注意,不同的说话人识别模型,声文库是不通用的。
注意,不同的说话人识别模型,声文库是不通用的。
2:41.400–2:45.220
了解了操作,就可以完成整个视频字幕的说话人修改。
了解了操作,就可以完成整个视频字幕的说话人修改。
2:45.980–2:49.836
完成后,再次识别该视频或者是同类的视频,
完成后,再次识别该视频或者是同类的视频,
2:49.836–2:52.920
就会准确地识别出不同的说话人了。
就会准确地识别出不同的说话人了。
2:53.340–2:56.220
那么如何过滤出不同说话人的字幕呢?
那么如何过滤出不同说话人的字幕呢?
2:56.220–2:59.020
点击这里的说话人选择框。
点击这里的说话人选择框。
2:59.020–3:01.900
你可以选择显示不同说话人的字幕。
你可以选择显示不同说话人的字幕。
3:01.900–3:06.060
这个过滤操作在文稿章节试图也是生效的。
这个过滤操作在文稿章节试图也是生效的。
3:06.060–3:10.360
常见的愿选择是,用户要复制出指定说话人的文稿。
常见的愿选择是,用户要复制出指定说话人的文稿。
3:12.660–3:18.340
如果你不希望显示开始时间与显示说话人,可以点这里的两个开关。
如果你不希望显示开始时间与显示说话人,可以点这里的两个开关。
3:19.240–3:22.240
点击导出内容,就可以将文稿导出了。
点击导出内容,就可以将文稿导出了。
3:23.540–3:26.540
如何导出带有说话人的SRT文件呢?
如何导出带有说话人的SRT文件呢?
3:26.940–3:29.520
点击导出,打开说话人开关。
点击导出,打开说话人开关。
3:30.060–3:33.460
即可导出带说话人的SRT字幕文件了。
即可导出带说话人的SRT字幕文件了。
3:33.460–3:35.460
点击导出,打开说话人的SRT字幕文件了。
点击导出,打开说话人的SRT字幕文件了。
3:35.460–3:36.460
点击导出,打开说话人的SRT字幕文件了。
点击导出,打开说话人的SRT字幕文件了。
3:36.460–3:36.967
点击导出,打开说话人的SRT字幕文件了。
点击导出,打开说话人的SRT字幕文件了。
尚未產生學習筆記
請在 Telegram 指令最後加上「學習」,例如:videonote 網址 英文 雙語 學習