pyVideoTrans是一款十分优秀的视频翻译工具,软件功能强大,操作简单易用,拥有语音转录、文字配音和字幕翻译等功能,支持20多种语言互译,且无功能限制,还内置高质量的语音合成技术,让翻译后的文本转化为自然流畅的配音,满足用户的各种使用需求,有需要的小伙伴赶快下载使用吧!

pyVideoTrans软件特色

1、翻译视频并配音

将视频中的声音翻译成另一种语言的配音,并嵌入该语言的字幕。

2、音频或视频转换成字幕

音频、视频文件中的人声,识别为单词并导出为srt字幕文件。

pyVideoTrans4.10

3、批量字幕创建配音

根据本地现有srt字幕文件创建配音,支持单个或批量字幕。

4、批量字幕翻译

将一个或多个srt字幕文件翻译成其他语言的字幕文件。

5、音频、视频、字幕合并

音频文件、视频文件、字幕文件被合并成一个视频文件。

6、将音频和视频分开

从视频中分离出音频文件和无声视频。

pyVideoTrans4.10

pyVideoTrans软件功能

1、全自动视频翻译、音频翻译:智能识别转录音视频中的说话声,生成源语言字幕文件,再翻译为目标语言字幕文件,接着进行配音,最后将新的音频与字幕合成到原视频中,一气呵成。

2、语音转录/音视频转字幕:批量将视频或音频文件中的人类说话声,精准转录为带时间轴的 SRT 字幕文件。

3、语音合成/文字转语音 (TTS):利用多种先进的 TTS 渠道,为您的文本或 SRT 字幕文件生成高质量、自然流畅的配音。

4、SRT 字幕文件翻译:支持批量翻译 SRT 字幕文件,保留原有时间码和格式,并提供多种双语字幕样式。

pyVideoTrans软件安装步骤

1、在本站下载软件安装包,解压完成后,进入文件夹,找到 sp.exe 文件,双击运行即可。

pyVideoTrans4.10

pyVideoTrans软件更新日志

v4.10

支持 FireRedTTS3 / Index-tts 2.5

优化单视频模式下字幕编辑界面

DeepL/Edge-TTS等个别渠道区分pt/pt-br /es/es-419语言代码

添加 uz 语言

修复其他已知bug

v4.09

支持 index-tts 2.5

修复 Faster_whisper_xxl.exe 报错

优化字幕翻译提示词

恢复导入本地源语言字幕按钮,仅单视频模式下生效

微软翻译已无法使用,报错时自动使用本地模型M2M100(内置)替换

语音识别 增加Moss-Transcribe-Diarize模型,90分钟内音视频支持直接返回说话人

语音识别 Huggingface_ASR渠道 增加模型Audio8/ARK-ASR-0.6B ibm-granite/granite-speech-4.1-2b

配音渠道增加higgs-audio-v3-tts-4b模型,CUDA加速需10G+显存,CPU运行需20G+内存

F5-TTS 增加 越南语、土耳其语支持

修复其他已知bug

v4.08

修复未选配音时字幕可能为空问题

优化单视频模式下字幕编辑/重新配音

优化 whisper.cpp 渠道,Windows版内置

优化模型下载

优化UI界面

批量翻译视频时,增加删除某个任务按钮

v4.07

优化单视频模式,增加视频播放预览,方便核对字幕

优化高级选项UI界面

重型TTS渠道使用单独进程执行

v4.06

配音渠道 ConfuciusTTS / OmniVoice 改为内置

优化音频加速、视频慢速算法

升级 chatterbox-tts 到v3.0

优化启动速度

使用本地已有srt字幕文件时支持带有说话人标志

v4.05

OmniVoice 改为内置

修复 Qwen-TTS

支持 小米mimo-v2.5-asr 作为语音识别渠道

翻译渠道增加 Hy-MT2-1.8B 作为本地字幕翻译渠道

v4.03

支持网易有道的 Confucius4-TTS

修复 max_workders must be greater then 0

修复 Qwen-ASR 错误

优化报错提示

优化启动速度

修复 音视频变速 多进程问题

修复faster-whisper子进程崩溃导致Resegment永久等待错误

修复原地保存/输出到原位置等几处bug

优化模型下载进度显示

高级选项中增加输出视频帧率选项(固定帧率或可变帧率)

优化标点符号处理,增加删除标点

高级选项中增加用于二次识别时的最长语音持续时长和最短语音持续时长

v4.01

chatterbox 改为内置

修复几处bug(qwen-tts/gpt-sovits/openai)

移除 gTTS 配音渠道

v4.00

Moss-TTS-Nano 改为内置

恢复标点模型改用 sherpa-onnx

TTS supertonic-2升级到3

移除语音识别--豆包音视频字幕生成

移除配音渠道-豆包语音1.0

高级选项-视频输出-增加输出mkv格式

除 GPT-SoVITS 外,其他需要参考音频的配音渠道,统一设置窗口

底层代码重构

下载地址

远程下载