AI 视频自动翻译双语字幕
转写字幕 · 翻译 · 压制
AI智能转写,直连 DeepSeek 大语言模型校对纠错语法,支持已有字幕导入翻译。轻松导出高质量、样式自定义的双语字幕。
Windows 8及以上
(64-bit)
支持 CUDA、CPU 加速
高精度识别与多语言
一键音视频转写,覆盖 100+ 全球语种
内置高精度 Whisper 引擎,支持自动识别视频中的人声并转换为精准文本。无需提前准备文本,导入 MP4、MKV、MP3 等任意音视频文件即可秒级识别,轻松完成多语种翻译。
- 支持英、日、韩、法、德、西等 100+ 语种互译
- 自动识别多角色说话人,智能区分背景音与人声
语音识别与翻译设置
源语言识别:
自动检测
(English) ▼
目标语言 1:
中文 (简体) ▼
目标语言 2:
日语 (Japanese) ▼
VAD 静音切分增强
开始转写与翻译
AI 智能语法修正对比
Whisper 原始转写
含口语冗余/同音错字
"Um, so basically... standard model is, uh, clear, right?"
原始识别:嗯,所以基本上... 标准模型是,呃,清楚的对吧?
大模型语法修正 + 智能润色
精炼流畅
"The standard model provides high precision and clarity."
修正译文:标准模型能提供极高的精准度与清晰度。
大模型智能校对
大模型自动语法修正,抹平口语冗余
语音识别出的文本往往包含“嗯、啊”等语气词或同音错别字。软件内置 LLM 大模型校对模块,能智能剔除口吃重复,修复语法错误,自动补全缺失标点,输出媲美精修出版物级别的字幕。
- 自动过滤“呃、这个、那个”等无意义口语垫字
- 基于大语言模型修复转写中的同音字与颠倒倒装句
精准时间轴控制
自定义智能断句,长句一键灵活拆分
告别屏幕上密密麻麻的“长篇大论”。你可以根据单行最大字数、屏幕宽度或停顿间隔自定义断句规则。遇到过长的字幕,按下快捷键即可实时拆分时间轴并自动重组语句。
- 支持按“字符长度 / 静音停顿 / 标点符号”按需断句
- 快捷键一键合并/拆分字幕卡片,时间轴自动按比例重新分配
字幕拆分与断句规则设置
单行最大字数:
20 字符
最小停顿间隔:
300 ms
00:01.200 -> 00:03.500
This is a long sentence that needs to be split.
↓ 快捷按光标拆分为两行 ↓
00:01.200 -> 00:02.300
This is a long sentence
00:02.300 -> 00:03.500
that needs to be split.
字幕样式与压制渲染面板
字体类型:
思源黑体 Bold ▼
文字字号:
24 px
文字/背景/描边色彩:
自定义双语字幕预览效果
Custom Subtitle Preview Effect
导出格式:
SRT / VTT /
硬字幕MP4
个性化外观与多格式导出
自定义字幕样式,一键烧录或导出 SRT
丰富的字幕外观自定义选项,字体、字号、文本颜色、描边、阴影与背景底框均可自由微调。既可导出标准 SRT/VTT 文本文件,也能一键将高清字幕烧录压制至视频中。