开源视频翻译配音工具,一键串联语音识别、字幕翻译、AI 配音与视频合成,可自由混搭 Faster-Whisper、DeepSeek、Edge-TTS 等 30 多个本地或在线渠道,免登录无功能限制。

适合搬运外语教程/讲座做本地化的内容创作者 · 愿意折腾本地模型的技术型用户 · 有批量视频翻译需求的团队

亮点

  1. 全链路一键跑完

    识别、翻译、配音、合成四步自动串成流水线,直接产出带目标语言字幕和配音的新视频

  2. 模型渠道自由混搭

    ASR、翻译、TTS 三层各自可选本地模型或在线 API,Ollama、DeepSeek、Edge-TTS 想省钱想求质量都能配

  3. 每一步都能人工校对

    识别、翻译、配音阶段均可暂停手动改稿,避免机器错译直接被烧进成片

  4. 三种使用形态

    桌面 GUI、WebUI 网页端、CLI 命令行都有,本地手动处理和服务器批量跑都覆盖

取舍

选它的理由

  • 识别、翻译、配音全流程打通,不用在多个工具间倒腾文件
  • 本地模型 + 免费渠道能做到零成本纯离线跑
  • 每步可暂停校对,成片质量比全自动黑盒可控得多
  • GPL-V3 开源、无登录无卡密,2023 年至今持续更新

先想清楚

  • 想要开箱即用、点两下就出片的傻瓜工具
  • 对配音口型、语速同步有商业级要求
  • 设备只有低配无显卡笔记本且视频很长
  • 模型/API 配置项极多,第一次上手容易被参数劝退

安全警示

  • 官网发布防骗声明:淘宝、闲鱼、拼多多等平台在售的付费版本均非官方授权,存在被二次打包的风险,应只从 GitHub 或官方文档站获取
  • 使用 ChatGPT、DeepSeek、Azure 等在线渠道时,音频与字幕内容会上传至第三方服务商,处理敏感素材建议改用本地模型
  • Windows 预打包版体积大且需自行下载模型文件,第三方镜像站(如聚合下载站)的分发包无法核验完整性
  • 截至目前未检索到针对 pyVideoTrans 自身的 CVE、供应链投毒或数据泄露事件报道

基于公开资料与 AI 分析整理,仅供参考,请自行核实。

同类推荐

查看全部

更多「音视频工具」软件

软鉴 SoftMemo

AI 整理的软件知识库

AI 整理软件资料、版本动态、更新通知、订阅权益与对比分析,沉淀可复用的工具知识。