功能
从音频到成片字幕,NextSub 覆盖识别、对齐、后期处理与推送到剪辑软件的全流程。
字幕生成 免费
导入音频或视频,选择语言,一键生成带时间轴的字幕。基于本地 GGUF 模型,识别完成后自动做字级对齐, 减少时间轴漂移;长音频后台线程处理,界面不卡。
- 支持 wav / mp3 / m4a / mp4 / mkv 等常见格式
- 中 / 英 / 日 / 法 / 德 / 西 / 意 / 葡 八种语言
- CPU 可用,NVIDIA 显卡支持 CUDA 加速;也可选 Vulkan 后端
文稿匹配 免费
已经有文稿(口播稿、字幕稿、翻译稿)时,把文稿和音频一起导入:NextSub 会把文稿按字级时间戳对齐到声音上, 比纯识别更准确,也方便改稿后快速重新对齐。
- 文稿缺少标点或口语化表达,也能匹配
- 字级时间戳,字幕切分更自然
字幕后期处理 完整版
识别完成后的“打磨”环节,专门解决中文口播字幕里最常见的几类问题。每一步都会先给出报告,逐条确认后再应用, 且可以整体撤销。
- 智能转换(洗稿):中文数字与单位符号化,例如「五兆帕」→「5MPa」、「三十九项」→「39项」
- 智能分割:过长的字幕按标点与语义自动断开,避免一行顶满屏幕
- 智能合并:被停顿切碎的短碎片(≤4 字且 ≤0.8 秒)并回相邻字幕
- 去口水词:整条只由「嗯 / 啊 / 呃」等语气词构成的字幕直接删除,词表可自定义
AI 处理(自带 API Key)免费
接入你自己的大模型服务(OpenAI 兼容 / 各家 API 均可),用来做翻译、润色、纠错、口语转书面语等。 NextSub 不代收 AI 费用——你直接用自己的账号,改不了价、也没有次数限制。
批量处理 完整版
一次丢进多个文件,后台依次完成识别与对齐,结果统一导出。适合整理成系列素材、整季片子。
达芬奇 / Premiere Pro 集成 免费
装一个桥接扩展,就能在剪辑软件里直接完成「拉音频 → 在 NextSub 处理 → 推字幕回时间线」,不用手动导出导入。
- 达芬奇 Resolve:从当前时间线拉取音轨;处理完把 SRT 推回时间线,并可选给洗稿过的字幕打标记
- Premiere Pro:拉取序列音频;导入字幕为字幕轨(Caption Track)
集成示例、安装方式见 教程。
导出与时间轴工具 免费
- 导出格式:SRT / ASS / LRC / VTT / 纯文本
- ASS 可设置字体、字号、颜色、描边、位置
- 时间轴平移、整体延音、每行字幕单独微调
- 输出区支持撤销/重做,导入的 SRT 也能继续编辑
免费版 vs 完整版
| 能力 | 免费版 | 完整版 |
|---|---|---|
| 字幕生成 / 文稿匹配 | ✓ 不限次数 | ✓ |
| 导出(SRT/ASS/LRC/VTT/TXT) | ✓ | ✓ |
| 达芬奇 / Premiere 集成 | ✓ | ✓ |
| AI 处理(自带 API Key) | ✓ | ✓ |
| 智能转换(洗稿) | — | ✓ |
| 智能分割 / 智能合并 / 去口水词 | — | ✓ |
| 批量处理 | — | ✓ |