软件概述
把整批视频的去字幕工作,整理成一次可检查、可继续的处理任务。无论是清理自有短视频中的旧字幕、为课程重新排版字幕,还是为不同投放版本整理营销素材,都可以先用一个代表片段确认区域和效果,再对多个文件或整个文件夹批量执行。
软件将硬字幕修复与软字幕轨道移除分开处理:前者需要重绘字幕遮挡区域,提供 STTN、LaMa、OpenCV 三种方式;后者直接移除可关闭的内嵌字幕轨道,不重绘视频画面。两种需求不能用同一种效果承诺来概括。
当前版本在本机 CPU 上计算,不需要独立显卡。字幕区域可预览框选,输出另存并自动处理重名,已完成结果与批次记录保留,适合按场景分批整理素材。背景修复是估算,不等于恢复被字幕盖住的原始内容。
多文件与文件夹批处理支持混合拖入视频与文件夹,按需扫描子目录,逐个处理,不必反复手工添加单个素材。
四种模式按素材选择硬字幕可比较时序修复、图像修复和快速修补;内嵌软字幕使用单独的轨道移除模式。
原文件保留,任务可继续结果另存、重名自动编号,记录成功、失败和跳过项,可继续最近批次并导出处理清单。
四种处理模式怎么选
STTN 时序修复
适合:普通硬字幕,优先做短片对照。
处理方式:利用相邻视频帧修复所选矩形,按批处理并保留相邻帧上下文。
可调项目:字幕区域、CPU 线程、每批帧数、帧缓冲预算、画质与音轨。
注意:不使用“仅检测到的文字/整个区域”切换,也不依赖文字检测模型。框选过大可能影响人物、标志及其他内容。
LaMa 图像修复
适合:固定字幕,或希望与 STTN 比较的片段。
处理方式:逐帧估算字幕区域背景,可只修补检测到的文字,也可修补整个矩形。
可调项目:轻量/精确检测、遮罩扩张、区域推理边长、LaMa CPU 加速、画质与音轨。
注意:逐帧结果可能产生帧间闪烁;增大推理边长和检测精度会增加耗时与内存,不代表结果一定更好。
OpenCV 快速修补
适合:小字、纯色背景或快速试验。
处理方式:利用周围像素进行修补,可选择文字检测遮罩或整个指定区域。
可调项目:字幕区域、检测模型、遮罩扩张、CPU 线程、画质与音轨。
注意:对复杂纹理、建筑、人脸等背景效果有限;应以实际对照为准。
仅移除软字幕轨道
适合:播放器中可以关闭的内嵌字幕。
处理方式:删除内嵌字幕轨道,复制第一条视频流并按音轨设置封装为 MP4,不进行画面重绘。
可调项目:输入范围、输出路径、最短时长与音轨设置;无需字幕区域。
注意:不能清除烧录文字,也不是删除旁边的 SRT/ASS 文件。原视频编码不兼容 MP4 时会报错,需选择重新编码的修复模式或另行转换。
批量输入、扫描与文件整理
输入可以是多个视频,也可以是多个文件夹与视频混合。使用浏览按钮、拖入或手动路径输入建立本次范围;手动填写多个路径时用英文分号分隔。一次浏览或拖入会替换当前输入,不是无限追加到旧列表。
开启“遍历子目录”会扫描下级目录;不开启时只处理所选文件夹直接包含的视频。扫描按扩展名筛选,不跟随目录链接与系统目录联接,并排除输入目录内部的输出树。
扫描列表支持 MP4、MKV、MOV、AVI、M4V、WEBM、FLV、WMV、TS、MTS、M2TS、MPEG、MPG、VOB、3GP,可自行调整扩展名。扩展名只用于筛选,实际读取还取决于文件完整性、视频轨道和解码支持。
设置最短时长后,小于该秒数的文件标记为跳过,0 表示不限制。开启递归扫描后可选择保持相对目录结构;多个主文件夹会使用各自名称区分,关闭保留结构则集中保存。输出后缀默认为“_去字幕”,冲突时自动增加 _1、_2 等数字。
区域预览与跨分辨率应用
点击“区域预览”,选择字幕位置有代表性的视频,调整时间查看画面,在预览中拖出矩形并使用此区域。这里是字幕位置预览,不是运行模型后的修复效果预览;效果需要实际处理短片检查。
也可填写左、上、右、下四个百分比,左上角为 0%,右下角为 100%。默认区域为左 0%、上 78%、右 100%、下 100%,即底部 22%。实际使用应收紧到字幕附近,避免把人脸、标志或需要保留的文字包括进去。
区域按相对比例应用到不同分辨率,但不自动追踪移动字幕,也不为每个视频自动选择不同位置。字幕位置、比例或排版差异较大的素材应分批设置,检查多个时间点后再执行。
文字检测与整块区域修补
仅检测到的文字:适用于 LaMa/OpenCV,在框选区域内检测文字,只修补检测遮罩。可选择轻量检测或精确检测;未检测到文字的帧不进行局部修补,但硬字幕模式仍会重新编码输出。
整个指定区域:同样适用于 LaMa/OpenCV,直接修补整个矩形,可应对检测漏字,但矩形内即使没有文字也会被重绘。应尽量框紧字幕,不宜把整幅画面作为常规修补范围。
遮罩扩张:在文字检测遮罩边缘向外扩张,界面支持 0~30 像素,默认 5,可帮助处理描边残留;扩张过大也会多改动背景。STTN 不使用这两种范围切换和文字检测设置,软字幕移除则不需要图像区域。
CPU 处理与内存设置
模型推理与文字检测在本机 CPU 上执行,无需独立显卡或 CUDA。视频按顺序逐个处理,不是同时对多个视频运行多个模型。CPU 线程可调整,默认根据处理器数量设置且不超过 12;更多线程不一定更快。
STTN 每批帧数可设 1~48,默认 8。帧缓冲预算可设 64~4096 MB,默认 512 MB;实际每批帧数会受预算约束。预算针对原始画面缓冲,模型、推理张量和其他组件还占用额外内存,不能理解为进程总内存硬上限。
LaMa 修补区域推理最大边长可设 256~2048,默认 960;调整的是推理区域,不改变最终视频分辨率。LaMa CPU 加速默认开启,保留同一模型、FP32 精度、逐帧处理及推理尺寸,主要调整内存布局和计算优化;可能有微小浮点差异,可关闭进行对照。
高清长片、复杂场景和较精细检测可能明显慢于视频播放速度。源码对每帧超过 33,554,432 像素的素材拒绝处理,超大素材应先另行降低分辨率。建议先处理短片确认效果和耗时,再安排完整批次,并为输出和系统临时目录准备空间。
MP4 输出、画质与编码选择
STTN、LaMa、OpenCV 三种硬字幕模式均输出 H.264 / MP4,保留源视频尺寸。常规偶数尺寸使用 YUV420;奇数宽或高时使用 YUV444 保留尺寸,播放器兼容性应另行确认。
CRF 范围为 0~35,默认 18,常用 18~23。较小值通常意味着较高编码画质与更大文件,但不能补回模型修复细节,也不能把去字幕结果变成真实背景。编码速度可选 ultrafast、veryfast、fast、medium、slow,默认 fast;慢档通常更利于压缩,不会加快模型推理。
软字幕模式复制原视频流并封装为 MP4,不使用 CRF 或图像修复参数;原视频编码不兼容 MP4 时会失败。各模式处理第一条视频轨道,是否保留声音由音轨设置决定,字幕轨道、数据流和附件不写入结果。
输出另存,重名自动编号,不替换原视频。即使局部修复区域外没有重绘,整段硬字幕视频仍经过重新编码,不应宣传为全片像素级无损。
音轨保留、AAC 与静音输出
默认勾选“保留全部音轨”,将输入中的音轨编码为 AAC,便于封装为 MP4,适合保留讲解、背景音乐或多语言音轨。
也可选择“原样复制”音频,避免音频重新编码;原音频格式无法写入 MP4 时会报错,应改为 AAC 后重试。这里的原样复制只说明音频流处理方式,不代表硬字幕修复的视频画面无损。
取消保留音轨后,结果为静音视频。没有音轨的视频不需要补造声音。软件不做语音识别、配音或音频内容编辑。
停止、继续与失败重试
任务列表、配置与处理状态保存在本地批次数据库。点击停止后先等待当前计算阶段退出,超过 5 秒仍未结束则终止本批次处理进程;已完成输出保留,未完成临时结果会清理。
重新打开软件可点击“继续上次”,继续最近批次的待处理项并重试失败项,成功项不会重复处理。这是按视频文件继续任务,不是从上次中断的那一帧精确续算;未完成的视频需要重新处理。
继续时使用该批次原来的输入、输出和参数。要更换算法、区域、画质等设置,请点击开始建立新批次。已经成功但随后被手工删除的输出,不会仅因继续上次就自动重建;重新处理应新建批次。
扫描后的源文件如果发生大小或修改时间变化,软件会报告错误,建议新建批次。单个文件失败会记录原因并继续队列中的其他待处理视频;查看记录后针对原因调整。相同批次不能在多个窗口中同时运行。
按场景配置的实际示例
课程批量整理:输入课程文件夹,选择独立结果目录,开启遍历子目录与保持原路径结构。先预览底部字幕位置,试用 STTN、每批 8 帧并保留音轨,短片效果通过后再处理各章节。
固定位置的解说字幕:可试 LaMa+仅检测到的文字,框住字幕带,先用默认 5 像素遮罩扩张;描边仍有残留时,用短片比较精确检测和稍大的扩张值,同时检查背景与闪烁。
纯色产品介绍短片:小字和简单背景可先尝试 OpenCV,收紧区域并查看连续播放效果;若背景纹理复杂,再与 STTN、LaMa 对照。
可关闭的 MKV 字幕:先在播放器中关闭字幕确认类型;确为内嵌软字幕时选择软字幕轨道移除,无需框选。输出 MP4;如原视频流编码不兼容,需要更换处理方式。
多个来源文件夹汇总:混合拖入并遍历子目录,关闭保持结构集中导出。同名结果自动编号;导出任务 CSV 后,按输入与输出路径核对对应关系。
进度、日志与 5 列任务记录
导出任务记录 CSV 包含以下 5 列,覆盖整批任务而非仅最近日志。输出路径应结合任务状态核对。
1. 序号
当前批次的任务记录序号,用于定位条目。
2. 输入文件
待处理视频的完整来源路径,便于核对原素材。
3. 输出文件
该条任务记录的目标输出路径;应结合状态确认文件是否已成功生成,不能只凭路径认定成功。
4. 状态
成功、待处理、处理中、失败或跳过,反映导出时的任务状态。
5. 错误说明
失败原因或跳过说明,例如视频短于最短时长、文件被修改或编码不兼容。
六步完成批量去字幕
1. 准备软件并登录保持 EXE 与配套 FFmpeg、模型资源的目录关系,登录网站账号确认使用权益,准备足够的结果和临时存储空间。
2. 选择批量输入和保存目录选择多个视频、文件夹或混合拖入,设置是否遍历子目录与保持路径结构。结果目录与输入主目录分开,按需设置格式和最短时长筛选。
3. 判断字幕类型并选模式可关闭的内嵌软字幕选择轨道移除;已经烧录的硬字幕先用 STTN 试验,固定字幕或简单背景可对照 LaMa 与 OpenCV。
4. 框选区域并试跑短片硬字幕模式中使用区域预览,查看多个时间点并收紧矩形,确认文字检测、画质和音轨选项。先处理短片检查连续播放效果。
5. 开始整批处理确认设置后点击开始,等待扫描、模型加载和逐个视频修复,查看当前帧数、数量和日志。需要中断时使用停止按钮。
6. 检查结果与导出记录打开结果目录,核对字幕修复、声音和播放兼容性,导出 CSV 检查失败或跳过项;相同条件下继续最近批次,修改参数则新建批次。
使用说明与结果解读
效果应通过连续播放对照,而不只是看单帧。硬字幕修复估算被遮挡背景,可能出现模糊、纹理变化或帧间闪烁;复杂背景、人物经过及字幕覆盖面积会影响结果。不能保证完全无痕或还原真实细节。
区域外不参与局部修补,不代表整段输出像素级不变:硬字幕视频会重新编码,色彩和压缩表现也应检查。软字幕模式不重绘画面,但仍受 MP4 编码兼容性及音轨设置影响。
软件不包含剪辑时间线、新字幕制作、语音转写、翻译或自动配音。用户可把结果交给其他编辑工具继续完成自媒体、课程或营销视频制作。示例用于说明配置,不代表固定速度或实际客户效果。