开源视频翻译配音工具,一键串联语音识别、字幕翻译、AI 配音与视频合成,可自由混搭 Faster-Whisper、DeepSeek、Edge-TTS 等 30 多个本地或在线渠道,免登录无功能限制。
适合搬运外语教程/讲座做本地化的内容创作者 · 愿意折腾本地模型的技术型用户 · 有批量视频翻译需求的团队
亮点
全链路一键跑完
识别、翻译、配音、合成四步自动串成流水线,直接产出带目标语言字幕和配音的新视频
模型渠道自由混搭
ASR、翻译、TTS 三层各自可选本地模型或在线 API,Ollama、DeepSeek、Edge-TTS 想省钱想求质量都能配
每一步都能人工校对
识别、翻译、配音阶段均可暂停手动改稿,避免机器错译直接被烧进成片
三种使用形态
桌面 GUI、WebUI 网页端、CLI 命令行都有,本地手动处理和服务器批量跑都覆盖
取舍
选它的理由
- 识别、翻译、配音全流程打通,不用在多个工具间倒腾文件
- 本地模型 + 免费渠道能做到零成本纯离线跑
- 每步可暂停校对,成片质量比全自动黑盒可控得多
- GPL-V3 开源、无登录无卡密,2023 年至今持续更新
先想清楚
- 想要开箱即用、点两下就出片的傻瓜工具
- 对配音口型、语速同步有商业级要求
- 设备只有低配无显卡笔记本且视频很长
- 模型/API 配置项极多,第一次上手容易被参数劝退
安全警示
- 官网发布防骗声明:淘宝、闲鱼、拼多多等平台在售的付费版本均非官方授权,存在被二次打包的风险,应只从 GitHub 或官方文档站获取
- 使用 ChatGPT、DeepSeek、Azure 等在线渠道时,音频与字幕内容会上传至第三方服务商,处理敏感素材建议改用本地模型
- Windows 预打包版体积大且需自行下载模型文件,第三方镜像站(如聚合下载站)的分发包无法核验完整性
- 截至目前未检索到针对 pyVideoTrans 自身的 CVE、供应链投毒或数据泄露事件报道
基于公开资料与 AI 分析整理,仅供参考,请自行核实。
同类推荐
查看全部更多「音视频工具」软件
WhisperSubTranslate
音视频工具开源本地运行的桌面字幕工具:用 whisper.cpp 把视频语音转成 SRT 字幕,再用内置腾讯 Hy-MT2 模型离线翻译成 15 种语言,也可接 DeepL、GPT、Gemini 等在线引擎,视频全程不上传。
mpv-Yaozhi
音视频工具开源面向 Windows 的 mpv 第三方整合包,自编译 mpv/FFmpeg/SDL2 核心,专攻 Dolby Vision、HDR Vivid、AV3A 沉浸声、5.1.4 至 9.1.6 具名多声道 PCM 与 HDR 图形字幕,并深度汉化 uosc 界面、内置弹幕与网盘直链播放。
ComfyUI-RH-MiniMax-H3
音视频工具开源把 MiniMax-H3 音视频联合生成模型接入 ComfyUI 的插件,支持文生视频+音频、首尾帧驱动和多模态参考三种任务,靠 INT8 量化与分层卸载在单张 24GB 显卡上跑完整流程。
Stash-Jellyfin Proxy
音视频工具开源一款 Python 代理服务器,通过模拟 Jellyfin HTTP API,让 Infuse、Swiftfin 等兼容播放器直接浏览与串流 Stash 媒体库,实现无缝的媒体消费体验。
Shutter Encoder
音视频工具开源由视频剪辑师开发的开源转码工具,用图形界面封装 FFmpeg,支持几乎所有音视频图像格式,并能对部分编码做无重编码剪切、字幕烧录与批量队列输出。
JAVM
音视频工具开源基于 Tauri 2 + Vue 3 + Rust 的桌面端 JAV 媒体库管理器,把本地扫描入库、番号刮削、下载队列和内置播放截图串成一条流水线,数据存本地 SQLite。
AI 整理的软件知识库
AI 整理软件资料、版本动态、更新通知、订阅权益与对比分析,沉淀可复用的工具知识。