影片筆記:只需要简单几部设置,大幅提升沉浸式翻译质量!!
YouTube 影片框會固定在左上方;點擊右側逐字稿時間戳可跳到對應時間。
一句話總結
本影片教學如何針對非 Pro 會員的「沉浸式翻譯」瀏覽器插件,透過調整 OpenAI 模型的請求參數(如 Token 數量、段落數)及提示詞(Prompt),模擬智能上下文翻譯功能,從而顯著提升網頁文章與 YouTube 字幕的翻譯準確度與連貫性。
核心重點
目標受眾:未購買「沉浸式翻譯」Pro 會員的使用者。
核心原理:透過增加每次請求處理的文本長度(Token)與段落數,讓 AI 能結合更多上下文進行翻譯,解決單句翻譯導致的語意斷裂問題。
關鍵設定:
- 調大「每秒請求數」(Tokens/字數)。
- 拉大「每次請求的最大字符數」與「最大段落數」。
- 針對網頁與字幕分別配置專屬的提示詞(Prompt)。
驗證結果:優化後的翻譯在語意連貫性、專有名詞處理及整體流暢度上,明顯優於未調整前的單句翻譯效果。
詳細大綱
一、 前置條件與準備
- 軟體基礎:必須安裝並使用「沉浸式翻譯」瀏覽器插件。
- 模型選擇:必須選擇基於 OpenAI 或其他任意 AI 模型的翻譯服務。
- 必要配置:使用者需已配置好相關的 API Key。
- 會員限制:本教學針對非 Pro 會員,旨在透過設定彌補功能缺失。
二、 核心設定步驟
進入插件設置界面,選擇 OpenAI 模型後,進行以下關鍵參數調整:
每秒請求數(Tokens/字數)
- 定義:代表每秒請求的字數或 Token 長度。
- 建議值:建議調大,例如設置為 1000。
- 原理:若設置過小(如 1 或 3),AI 可能只翻譯部分字詞(如漏掉複數 S),導致語意錯誤(如將 "8" 誤譯為單數形式)。調大後可確保完整語意被識別。
- 注意:若使用第三方服務,可設置較大數值;若使用官方 OpenAI,可忽略其連接數限制,直接拉滿。
模擬上下文翻譯(非 Pro 會員替代方案)
- Pro 會員功能:智能上下文翻譯會先理解全文內容,再進行翻譯,效果更佳。
- 非 Pro 會員設定:
- 每次請求的最大字符數:建議設置為 128,000(即 128k Token 上限)。
- 每次請求的最大段落數:建議拉滿,設置為 1000。
- 目的:透過一次讀取更多英文字段和段落,讓 AI 結合大段上下文進行翻譯,提升準確度。
提示詞(Prompt)配置
- 網頁翻譯提示詞:複製插件預設或文中提供的針對網頁翻譯的系統提示詞。
- 字幕翻譯提示詞:針對字幕請求,使用專門的提示詞(文中提及「提示譯」相關設定)。
- 操作:將對應的提示詞複製並應用於相應的翻譯場景設置中。
三、 測試與效果對比
- 網頁文章測試:
- 設置完成後點擊測試,返回時間可能較長。
- 優化後效果:翻譯內容連貫,如「美國購物車會面臨全面汽車關稅的衝擊」、「珍妮克林迪省吃減用換掉舊車」等語意清晰。
- 優化前對比:未設置或設置不當時,出現語意斷裂或錯誤,如「曾經迪靠的省持兼用」、「佛基尼亞一家二十年轉時」等明顯錯譯或語句不通。
- 備註:若網頁有緩存,可能影響即時對比效果,建議清除緩存或重新加載。
- YouTube 字幕測試:
- 調整播放速度以應對翻譯延遲。
- 整體字幕翻譯效果被評價為「非常可以」,證明該設定對影片字幕同樣有效。
四、 總結建議
- 盡可能拉大「每秒請求的最大數」。
- 在「更多選項」中拉大「每次請求的最大文本長度」與「最大段落數」。
- 正確配置針對網頁與字幕的提示詞。
- 透過簡單配置即可顯著提升翻譯品質,建議使用者自行對比優化前後的效果。
工具 / 模型 / 名詞整理
- 沉浸式翻譯(Immersion Translate):瀏覽器插件名稱。
- OpenAI:AI 模型提供商。
- Pro 會員:沉浸式翻譯的付費會員等級。
- YouTube:影片平台,用於測試字幕翻譯。
- API Key:配置 AI 模型所需的金鑰。
- Token:AI 處理文本的基本單位,文中提及 128k 上限。
- Properties:文中提及的系統身份翻譯相關屬性(疑點:語境不明確)。
- disk:文中提及的翻譯選項或模式(疑點:聽似「默認」或特定模式名稱,需查證)。
- OMM:文中提及的設置狀態或模式(疑點:聽似口誤,需查證)。
操作流程整理
安裝與配置:安裝「沉浸式翻譯」插件,並配置好 OpenAI 或其他 AI 模型的 API Key。
進入設置:打開插件設置界面,選擇 OpenAI 模型。
調整請求參數:
- 將「每秒請求數」調大(建議值如 1000)。
- 在「更多選項」中,將「每次請求的最大字符數」設置為 128,000。
- 將「每次請求的最大段落數」拉滿(建議值如 1000)。
配置提示詞:
- 複製針對網頁翻譯的系統提示詞並應用。
- 複製針對字幕翻譯的提示詞並應用。
測試與驗證:
- 打開網頁文章進行測試,觀察翻譯連貫性(建議清除緩存後測試)。
- 打開 YouTube 影片進行字幕測試,調整播放速度以應對延遲。
對比效果:對比優化前後的翻譯質量,確認語意是否清晰、連貫。
值得注意的限制或風險
- 翻譯時間增加:由於增加了每次請求處理的 Token 數量和段落數,翻譯返回時間可能會變長。
- 緩存影響:網頁若有緩存,可能影響即時對比效果,建議清除緩存或重新加載以獲得準確的對比結果。
- 第三方服務限制:若使用第三方 OpenAI 服務,需注意其連接數限制,可設置較大數值;若使用官方 OpenAI,則可忽略連接數限制直接拉滿。
- 非 Pro 功能模擬:此方法為非 Pro 會員的替代方案,雖能提升效果,但並非官方原生的「智能上下文翻譯」功能。
逐字稿辨識疑點
- 「Properties」:文中提到「這是針對以系統身份翻譯的,這個 Properties」,語意不明,疑為口誤或特定術語。
- 「OMM」:文中提到「因為當時設置成是 OMM 嘛」,疑為口誤或特定縮寫,需查證。
- 「disk」:文中提到「我們選擇 disk,這個我沒有進行設置的」,疑為聽寫錯誤,可能指「默認」或其他翻譯選項名稱。
- 「珍妮克林迪」:翻譯結果中的專有名詞,疑為人名音譯錯誤(可能為 Jennifer 或其他人名),但依規則保留原樣。
- 「省持兼用」:翻譯結果中的詞彙,疑為「省吃減用」的聽寫或翻譯錯誤。
- 「佛基尼亞」:翻譯結果中的地名,疑為「Virginia」(維吉尼亞)的音譯,但依規則保留原樣。
- 「丁著標筋成」:翻譯結果中的詞彙,語意不通,疑為嚴重翻譯錯誤或聽寫錯誤。
- 「文明國家」:翻譯結果中的詞彙,語意不明,疑為聽寫或翻譯錯誤。
- 「周四」:翻譯結果中反覆出現「周四」,疑為人名或專有名詞的錯誤翻譯。
- 「能量在幾英里外」:翻譯結果中的詞彙,疑為「舊車」或相關名詞的錯誤翻譯。
- 「被到的指導看」:翻譯結果中的詞彙,語意不通,疑為聽寫錯誤。
可延伸追問
- 對於不同語言對(如中翻英、英翻日),這些參數設置是否需要同樣調整?
- 如果 API Key 的額度有限,拉大 Token 數量是否會導致費用增加或額度耗盡更快?
- 除了 OpenAI,其他 AI 模型(如 Anthropic, Google Gemini)在沉浸式翻譯中是否適用相同的參數設置邏輯?
- 如何判斷一個網頁是否受緩存影響,以及清除緩存的最佳實踐是什麼?
- 文中提到的「提示譯」具體包含哪些內容?是否有公開的提示詞模板可供參考?
逐字稿時間軸
右側可一路往下捲;左側影片框會固定。點擊時間戳會讓左側影片跳到對應秒數。
00:00:02.100 → 00:00:10.000
大家好, 关于沉浸式翻译呢, 我相信大家现在用的翻译软件上来说, 沉浸式翻译这个软件现在应该是用的比较多的。
00:00:15.680 → 00:00:23.680
今天呢, 就给几个小伙伴分享一下, 如果说我们不是pro会员的情况下, 我们有哪些手段, 只需要简单几步的设置, 就能大批量提升我们整体的一个翻译质量。
00:00:24.380 → 00:00:32.380
但是前提呢, 我们要是使用基于我们OpenAI的其他任意的这种, 就是AI模型翻译的这种情况才能提升。
00:00:33.030 → 00:00:35.860
你前提, 你已经有配置的这种各种的K了。
00:00:36.240 → 00:00:39.900
好, 接下来呢, 就开始我们简单的正式的设置。
00:00:40.245 → 00:00:45.200
首先呢, 我们在浏览器插件呢, 打开我们这个沉浸式翻译的这个插件。
00:00:45.630 → 00:00:49.180
我们点击左下角这个设置, 我们进到设置界面。
00:00:49.970 → 00:00:55.440
进到设置界面呢, 我们要选择, 就是说, 我们要选择OpenAI这个模型。
00:00:55.580 → 00:00:57.660
那么你有其他的模型, 你选其他的也可以。
00:00:57.880 → 00:00:59.360
它下面呢, 都是一样的。
00:00:59.750 → 00:01:02.860
这个时候呢, 它会有一个自定义, 配置的一个界面。
00:01:03.260 → 00:01:04.960
这个时候呢, 都已经配置好了。
00:01:05.180 → 00:01:08.600
好, 接下来呢, 就开始正式的设置了。
00:01:09.000 → 00:01:13.600
首先呢, 给大家分享一下, 第一个设置, 每秒的请求数。
00:01:14.290 → 00:01:20.780
也就是说, 你每秒大概要请求多少的这个字数。
00:01:21.660 → 00:01:22.900
这里呢, 给大家说一下。
00:01:23.800 → 00:01:31.800
如果说, 简单来说, 如果说你设置为1的情况, 比如说呢, 我这个翻译的时候, 我有一个字段。 比如说这英文里面, 比如说随便找一个英文。
00:01:35.510 → 00:01:39.400
比如说你每次, 你翻译的时候, 比如说最大的长度, 我这里选择3, 对不对?
00:01:39.760 → 00:01:42.860
选择3呢, 它有可能只是这个8, 对不对?
00:01:42.960 → 00:01:46.420
8呢, 它比如说它翻译3, 那可能它就这个8, 对吧?
00:01:46.560 → 00:01:50.420
那么少了一个S的描述符, 那么它是多了一个变量。
00:01:50.640 → 00:01:55.640
那么它可能翻译出来呢, 它的效果就不一样了。 我明明是一个8, 对不对?
00:01:55.720 → 00:01:57.520
你翻译一个8, 对吧?
00:01:57.720 → 00:02:04.700
那么你肯定就不太一样了。 其实你通过谷歌翻译, 这样翻译出来, 它其实, 我们通过这里AI翻译出来, 看没有?
00:02:04.980 → 00:02:05.980
我们看它, 对吧?
00:02:06.200 → 00:02:11.480
那么如果说, 你这个长度提高之后, 我加上S之后呢, 看没有?
00:02:11.600 → 00:02:13.120
它就是这是了, 对吧?
00:02:13.520 → 00:02:17.720
那么, 这就完全, 这整体结合下来呢, 就是完全的不一样了, 对吧?
00:02:17.900 → 00:02:23.900
那么这个时候呢, 大家一定要把这个数量呢, 调节起来。
00:02:28.020 → 00:02:36.020
这个每秒的请求数, 就是你的, 大概是你的一个, 呃, 就是你的一个, 呃, 就是你的一个, 呃, token的一个长度吧。
00:02:36.220 → 00:02:42.020
大概就是你的, 呃, 每秒请求数, 就是你当前服务器上, 你能承受的最大的请求数。
00:02:42.400 → 00:02:44.820
那么这个呢, 一般你都用了第三方了, 对不对?
00:02:44.920 → 00:02:46.980
那你调大点吧, 个是百千嘛, 对吧?
00:02:46.981 → 00:02:49.600
我就停个, 我就设置个一千嘛, 对吧?
00:02:50.460 → 00:02:51.600
它大了, 它就排队嘛。
00:02:51.720 → 00:02:53.000
反正你这个地方就设置多点。
00:02:54.820 → 00:03:02.820
当然了, 这里呢, 也有一个设置, 我们可以看到, 如果说你是用的, 呃, 官方的这个, 呃, open AI的这个呢, 它这里呢, 也会有一个官方的,
00:03:03.185 → 00:03:05.780
一个设置的一个连接数啊, 我们这里不用管。
00:03:05.880 → 00:03:09.180
你反正这里呢, 你就跟我一样, 莫得是最大的, 就可以了。
00:03:09.530 → 00:03:17.200
还有一个非常重要的就是, 呃, 如果说你是pro会员的情况下呢, 你就可以启用这个智能的上下文翻译了啊。
00:03:17.630 → 00:03:22.620
启用后呢, 系统呢, 先理解全文的内容, 让翻译呢, 更加的准确。
00:03:23.085 → 00:03:28.640
也就说呀, 它会, 按道理说呢, 它翻译英文的时候呢, 它并不说只翻译这一段, 对不对?
00:03:28.920 → 00:03:34.460
其实呢, 它会直接把整个当前所有的这些信息啊, 全部翻译一遍。
00:03:34.820 → 00:03:40.220
那么你才能知道当前讲大概是什么, 那结合上下文翻译出来的这个更有效。
00:03:40.470 → 00:03:43.640
那么如果说我们不是pro会员, 那怎么办呢?
00:03:44.020 → 00:03:51.600
那么我肯定就要自己去配置的啊, 就在下面这两个配置的, 就是呢, 每次请求的最大字符数。
00:03:53.560 → 00:04:01.560
最大字符数呢, 其实这个呢, 就是它, 我们当时配的那个, 呃, 就是AI的, 它每次请求的最大的一个, 呃, token啊, 就是我们的token数。
00:04:04.835 → 00:04:12.460
那么这里呢, 最大的一个token数呢, 一般来说都是128k, 那么就是个十百千万十万, 你就配成十二万就可以了啊。
00:04:12.640 → 00:04:16.940
我们这里呢, 就可以配成个十百千万十万, 对吧?
00:04:17.100 → 00:04:18.880
十二万八, 那么就可以了。
00:04:20.960 → 00:04:28.960
其实, 如果说你有这个, 直接启用这个AI文, 上下文翻译, 那么相当于说呀, 它会默认的去, 呃, 去把整个文结合起来翻译。
00:04:29.720 → 00:04:37.720
那么我们不是pro会员, 那么我们肯定就要通过这种方式, 我们一次呢, 尽可能的多读取这些英文的字段, 段落。
00:04:38.020 → 00:04:45.220
那么它可能会结合这一大段翻译出来的效果, 它会上下文有更多, 它翻译的效果呢, 会更强, 对吧?
00:04:45.785 → 00:04:50.880
还有一个呢, 就是我们每次请求的最大的一个段落数, 也是一样的。
00:04:51.260 → 00:04:57.600
这个呢, 就是说, 我们结合的每次的一次请求的段落, 比如说你一次请求这么一个, 那肯定不行, 对不对?
00:04:57.880 → 00:05:00.500
那么我们一次请求这么多, 那么肯定效果更好一些, 对吧?
00:05:00.800 → 00:05:06.460
那个这个呢, 你也是拉满, 我们就是一千, 我们一千就行了, 一千, 对不对?
00:05:09.840 → 00:05:17.840
好, 下面呢, 下面呢, 就是第二种翻译的, 第二种呢, 就是说, 我们都知道, 关于, 呃, 其实呢, 关于我们OpenAI, 或者是其他的, 它其实都是需要,
00:05:19.200 → 00:05:27.200
它默认, 只不过是提示的, 就是默认给的一些这些命令, 啊, 这是呢, 针对于, 以系统身份翻译的, 这个Properties, 就是这个呢,
00:05:28.020 → 00:05:36.020
我们针对于网页翻译的, 啊, 我们把这个复制一下, 好, 我们把这个, 你都按照网页的翻译, 把它复制下来, 把这个, 啊, 就可以了, 复制下来,
00:05:36.160 → 00:05:43.120
好, 第二个呢, 是针对于什么, 第二个呢, 是针对于, 我们看看, 这个是针对于网页翻译的, 对不对?
00:05:45.340 → 00:05:53.340
你可以看一下, 还有一个是什么, 这个呢, 我们就把它给复制成一样的, 啊, 都是一样的, 这个也是一样, 这个也一样, 这个呢, 还有一个, 这个是 请求字幕的, 对不对?
00:05:58.120 → 00:06:06.120
字幕的呢, 我们就用这个提示译, 啊, 大家用这个提示译, 是针对于字幕的, 好, 我们针对于字幕的, 那么, 每次 字幕请求最大段的数呢, 我们这里呢,
00:06:06.520 → 00:06:09.060
也设成1000, 啊, 我们都设成1000, 对不对?
00:06:09.340 → 00:06:17.340
好, 这个时候呢, 我已经 保存完了, 保存完了, 我们点击测试一下。 OK, 可以了, 对不对?
00:06:17.580 → 00:06:20.560
好, 这个时候呢, 我就用这篇文章 给大家看一下效果。
00:06:21.750 → 00:06:24.040
好, 因为我当时设置成是OMM嘛, 对吧?
00:06:36.140 → 00:06:44.140
啊, 由于这里呢, 当然你升, 就是说你设置的这个字段段落数可能比较长呢, 它这个返回的时间也有可能比较长一些, 哎, 看, 下面有些已经返回了。 好, OK, 已经回来了, 对吧?
00:06:51.930 → 00:06:57.210
他翻译呢, 是情况只会更糟, 美国购物车 会面临全面汽车关税的冲击, 对吧?
00:07:00.830 → 00:07:08.830
然后两年来, 珍妮克林迪省吃减用, 啊, 就会换掉那辆在家门口被盗几年以外被发现的 以报废 的一个旧车, 哎, 我们可以看到, 啊, 看到没有?
00:07:09.070 → 00:07:11.850
我们觉得整体它的效果还是可以的, 对不对?
00:07:11.990 → 00:07:12.990
我们可以看到。
00:07:13.980 → 00:07:20.470
好, 我们可以看到, 现在整个行业都乱套了, 啊, 我们可以看到, 效果来说呢, 还是比较不错的, 对不对?
00:07:20.920 → 00:07:27.150
对, 我们再对比一个, 我们就说没有去设置这种的呢, 我们看它翻译效果, 啊, 这个呢是设置完的, 对不对?
00:07:27.210 → 00:07:28.070
按照优化来的, 对吧?
00:07:28.210 → 00:07:35.830
好, 我们这呢, 回车下, 我们选择另外一个翻译, 隐形, 我们选择disk, 这个我没有进行设置的, 啊, 我们点击翻译一下。
00:07:47.980 → 00:07:55.180
好, 两年来, 啊, 我们这里再重新的打开一个网页吧, 这样来我其实大家看不清, 啊, 这个时候呢, 我再把这个, 对变成我刚才经过调试之后的, 对吧?
00:07:57.580 → 00:07:59.100
就是, 我们点击, 选择。
00:08:00.980 → 00:08:02.100
好, 我们可以看一下。
00:08:03.820 → 00:08:09.540
两年来, 曾经迪一直靠固定收入省持兼用, 以换掉的能量在几英里外, 被到的指导看。
00:08:10.840 → 00:08:18.840
等下来, 曾经迪靠的省持兼用, 哦, 周四, 她的, 周四, 她的, 佛基尼亚一家二十年转时, 丁着标筋成, 上一个跟文明国家, 我们看一下下面这个。
00:08:24.080 → 00:08:32.080
周四, 好, 有可能她这个网页呢, 进行一个缓存, 啊, 有些进行一个, 进行了一个缓存, 她这个会缓存, 也就是说, 针对我上个缓存完的网页, 她就不会再重新翻译了。
00:08:33.770 → 00:08:35.080
好, 可能效果看是一样的。
00:08:35.460 → 00:08:43.460
目前来说呢, 经过设置完了, 大家可以看到这个新闻效果还是整体比较可以的。 好, 那么我在针对于视频字幕, 我们就拿YouTube来说啊, YouTube。
00:08:47.095 → 00:08:48.860
好, OK, 我们这里往这里拉。
00:08:55.720 → 00:09:00.370
好, 这是, 好, 现在开始翻译了啊, 我们可以看到。
00:09:04.330 → 00:09:07.470
好, 有点卡, 我们把这个轻轻度呢, 调的低一点点。
00:09:20.660 → 00:09:28.660
我们这里可以看到, 它整体这个字幕的这个, 这个翻译。 哎, 我们再拖一下。 看到没有?
00:09:35.645 → 00:09:43.645
整体翻译效果, 我觉得整体字幕的翻译效果还是, 呃, 非常可以的。 我们再拉一下。 还没有?
00:09:52.610 → 00:09:54.890
整体的字幕的翻译效果也是可以的啊。
00:09:55.050 → 00:09:58.590
这里呢, 我给大家呢, 整体在总结下, 其实就很简单。
00:09:58.950 → 00:10:00.390
啊, 就是只需要第一个。
00:10:01.550 → 00:10:09.550
就是尽可能呢, 基于你当前的这个, 呃, 翻译器呢, 尽可能呢, 把你的第一个每秒, 每秒请求的最大数呢, 拉长点。
00:10:10.050 → 00:10:12.410
那么呢, 一次翻译的值就会多一些, 对吧。
00:10:12.910 → 00:10:20.610
还有一个呢, 就是, 在你的这个, 更多选项这里呢, 每次请求的最大文本长度, 你也可以基于。
00:10:20.985 → 00:10:25.250
这个呢, 拉长一点, 还有每次请求的一个, 最大的一个段落数。
00:10:25.650 → 00:10:32.130
啊, 还有下面呢, 这些, 这几个, 啊, 就是一个提示词, 还针对字幕翻译的一个提示词。
00:10:32.500 → 00:10:34.770
大家呢, 可以复制我文中的, 就可以了。
00:10:35.110 → 00:10:39.690
那么, 通过这简单的配置之后呢, 你的这个效果, 绝对会和之前的不一样的。
00:10:40.065 → 00:10:42.110
啊, 大家呢, 就自己进行一个对比了啊。
00:10:42.410 → 00:10:49.050
好, 今天呢, 给各位小伙伴分享一下, 大幅提高我们曾经是翻译效果的这个小技巧, 就到这里。
00:10:49.250 → 00:10:52.911
欢迎大家呢, 多多关注我的频道, 点个单, 谢谢。 。