前段时间我分享过开源的 MOSS-TTS 1.5 它的配音效果 足以比肩主流的闭源模型 先来听听这段效果 配一佐咸鲜的火腿同炖 汤色渐渐乳白 鲜味丝丝缕缕漫上舌尖 这是春天最温柔的一封回信 MOSS-TTS 是 OpenMOSS 团队开源的一个语音模型家族 支持零样本语音克隆 实时语音和 31 种语言 对话模型在主观评测中 甚至打赢了豆包和 Gemini 2.5 Pro 它的核心能力是高保真 最优性能的零样本语音克隆 支持长文本和长语音生成 支持拼音音标与时长精细控制 支持随时插入停顿等等 但很多人和我一样卡在同一个地方 显存不够 本地根本跑不起来 今天官方下场 这个问题得到了解决 I'm always looking for one voice Finally that voice came into the picture With a thousand voices I have a thousand stories MossLand 是一个以语音为核心的 一站式 AI 创作平台 最关键的是它已经接入了 MOSS-TTS 1.5 也就是说 那个你在本地跑不动的顶级模型 现在打开浏览器就能直接用 而且它远不止一个 TTS 那么简单 接下来 我带你把它的核心功能过一遍 你会发现 它基本把声音这件事的上下游 全包了 先看压箱底的语音合成 这也是整个平台效果最能打的地方 输入文字 选一个音色 点 生成 一段自然 到不像 AI 的语音就出来了 它支持单人合成 比如这样 而在贝茜看来 铁证如山的事实面前 毋庸置疑 大卫·戈尔就是真凶 也支持多人对话合成 比如这段 早上好呀 各位正在通勤 上学 晨跑 或者刚刚睁开眼睛的朋友们 这里是早安 101 我是阿晨 大家早安 我是小夏 今天又是充满可能性的一天 希望我们的声音 能陪你开启一个好心情 不知道你现在是在地铁上 公交车里 还是一边喝咖啡一边收听节目呢 音色库里没有你要的音色 那就自己造 你可以上传一段音频 复刻出高度相似的音色 你也可以什么都不传 直接用一句话描述 比如低沉慵懒带点烟嗓的男声 让它给你生成对应的音色 造好的音色最后都能存进 你自己的音色库 再往上是一整套开箱即用的 AI 应用 包括视频配音 播客 数字人等等 比如这段视频 拿钱 做我的朋友 还是继续竞选 你选一个 里面有一个词说错了 现在只需要上传这段视频 等它识别出文字 把错误的地方一改 就能一键修正 模型会按照原视频的语气 情绪重新配音 效果是这样的 做我的女朋友 还是继续竞选 你选一个 你还能给视频换上全新的音色 拿钱 做我的朋友 还是继续竞选 你选一个 更狠的是 它能一键把中文视频 转成其他语言的配音版本 Take the cash, be my friend Or keep running. Choose one. 在播客方面 你可以输入一个主题 它先帮你生成文案 你确认后一键生成配音 配乐 混音一条龙 出来的就是能直接发布的成品 在数字人方面支持形象和动作控制 最高 1080P 规格 另外 工具集里还提供了丰富的 一站式工具 一键添加字幕 视频剪辑 音频提取 以及视频图片格式转换等等 是的 它还支持图片和视频生成 接入了可灵 Seedance 即梦这些主流模型 我随手用它生成的几段视频 简单拼了一下 得到一个 30 秒的片子 大家直接看效果 你心里根本没有这个家 检测到行为异常 分析中 早 你自己也吃啊 最后所有这些能力它都开放了 API 想接入自己工作流的 开发者也能直接调用 好了各位 以上就是今天视频的全部内容 欢迎关注订阅 点赞收藏 咱们下个视频见