WaveShift 是什么
WaveShift 把已经做好的视频翻译并配音。你给它一个文件或一条链接——YouTube、B 站,或者直接的视频地址——它还你同一条视频,只是换了种语言在说,原说话人的音色和原背景音乐都还在。
支持英语、中文、日语、韩语、西班牙语、法语、德语、葡萄牙语、俄语、意大利语。
不用等它跑完就能看
多数配音工具要你等整条渲染结束。WaveShift 边产出边推流:第一段混好就能开始播,后面的继续生成并自然接上。对一条长视频来说,这是「等完整片长」和「泡杯咖啡的工夫就能开始看」的区别。
这是整个系统围绕着建的那一个设计决定,也是为什么这条流水线从头到尾是按段组织而不是按文件组织的。
它到底怎么工作
先把人声和背景音分开,所以音乐和环境声能活下来,不会跟着对白一起被抹平。人声带说话人归属地转写,翻译时看上下文而不是逐句孤立地翻,再按说话人锁定的参考音重新合成——同一个人不会说到一半换了副嗓子。
译文长度很少正好等于原文,所以时长是被当作一个明确问题来解的:每句话被装进它自己的时间槽;装不下且提速会超出舒适语速时,宁可改写得更短,也不硬赶。配好的人声再混回被保留下来的背景音,最后打包成可流式播放的形态。
WaveShift 不是什么
它不是数字人产品。没有合成主播,没有口型重定向,也不生成说话人头像。你要的如果是这些,HeyGen 和 Synthesia 做得很好——我们在对比页里就是这么写的。
它也不是带审校流程、席位管理和翻译记忆库的企业本地化套件。它是一个把成片快速、准确地换成另一种语言的工具。
只按真正交付的部分计费
任务开始时,WaveShift 按源视频时长预扣一笔。任务结束时,只按实际交付的配音音频计费,剩下的退回余额。最终扣费永远不会超过预扣的那个数。
如果任务是因为我们这边的原因失败的——系统、网络或未知错误——不收费。分钟是预付的,永不过期,也没有订阅。
谁在做
WaveShift 由一个很小的团队开发和运维,跑在 Cloudflare Workers 上,GPU 推理按需拉起。这个形态是刻意的约束:它让服务足够便宜,才能按交付分钟计价,而不是按人头按月收。
这也意味着你直接在跟写代码的人说话。你报的 bug,是能修它的人在读。
联系我们
有问题、发现 bug,或者哪里配坏了?写信给我们,是真人在看: support@waveshift.net
另见: 最近更新了什么.
