Mcc字幕识别文稿匹配 / 剪映同款API能力

About

做视频后期的朋友,处理字幕应该算是家常便饭了。

现在剪映自带的字幕识别是 SVIP 功能,不开会员用不了;网上很多第三方字幕工具,要么收费不低,中文识别效果也参差不齐。于是有大佬做了这款桌面小工具 Mcc字幕识别文稿匹配,专门对接剪映的字幕识别、文稿匹配 API,免费可本地使用。

工具基于 Avalonia (VisualBasic.NET)开发,调用火山引擎-豆包语音API,因此,需要自行前往火山引擎后台注册APIKEY
字幕识别
文稿匹配

软件功能

  1. 字幕识别
    导入音视频文件,填入你自己申请的火山语音 API 密钥,直接调用接口做语音转文字。
    拿到识别结果之后,对接剪映文稿匹配接口,直接生成时间轴字幕,不用手动一点点打轴。
  2. 文稿匹配
    手上已经整理好完整口播文稿,可以上传文稿,自动把文字和音频对齐时间轴。
    生成好字幕,导出 SRT,直接丢进 PR、剪映、DaVinci 这些剪辑软件直接用。
划重点:工具本身完全免费,但是火山语音 API 是需要自己去申请密钥、按调用量计费,工具只是帮你封装调用逻辑,不内置 API 额度。

设置界面

简单使用流程

  1. 准备音 / 视频素材;
  2. 填入自己申请的火山语音 API Key;
  3. 二选一:上传音视频做字幕识别 / 上传现成文稿做文稿匹配;
  4. 等待处理完成,导出标准 SRT 字幕文件;
  5. 把 SRT 导入剪辑软件继续干活。

预览字幕效果


下载软件

版本:1.0.0
构建日期:2026-08-24
文件大小:66.9 MB
本站下载 (速度略慢)
百度网盘下载 (你最好有网盘会员)
软件本体完全免费

提示:下载后的zip压缩包,必须完整解压后才能使用,双击 MccVoxSub.exe 启动程序。

搭配Agent

本软件支持 cli 命令调用
核心功能:生成字幕

MccVoxSub.exe -input "媒体文件路径" [-text "文稿文件(txt/docx)"] [-output "输出srt路径"]

更多示例

:: 纯音频识别,输出到默认位置(video.srt)

MccVoxSub.exe -input "D:\视频\video.mp4"

:: 文稿打轴模式,指定输出路径
MccVoxSub.exe -input "D:\视频\video.mp4" -text "D:\文稿\台词.docx" -output "D:\输出\final.srt"

:: 脚本中判断结果
MccVoxSub.exe -input "a.wav" && echo 成功 || echo 失败

API 配置

MccVoxSub.exe -set "appid" "token" "secret"   :: 一次性设置三项
MccVoxSub.exe -set-appid "值"                  :: 单独设置 AppID
MccVoxSub.exe -set-token "值"                  :: 单独设置 Access Token
MccVoxSub.exe -set-secret "值"                 :: 单独设置 Secret Key
MccVoxSub.exe -set-clear                       :: 清除所有 API 设置
MccVoxSub.exe -set-test                        :: 测试 API 连通性,输出 True/False

信息查询

MccVoxSub.exe -v      :: 版本 / 作者 / 构建日期
MccVoxSub.exe -md5    :: 主程序自校验 MD5(小写 32 位 hex),可用于完整性校验
MccVoxSub.exe -st     :: 统计信息:运行次数 / 处理媒体数 / 累计处理时长 / 估算费用
MccVoxSub.exe -help   :: 输出内置帮助(--help、-h、-? 等价)

自检与调试

MccVoxSub.exe -input-test "媒体文件"   :: 测试压缩转码链路,成功输出 True,失败输出原因

一些局限问题

  • 当前版本只支持 Windows 平台;
  • 真正花钱的地方是火山 API 调用,工具本体不收费;
  • 字幕效果取决于 API 识别质量,如果音频杂音大、口音重,识别照样会出错,后期依旧需要校对字幕;
  • 文稿匹配要求文稿内容和音频口播尽量一致,错字、语序乱掉会影响对齐效果。

整体就是一个很务实的小工具,适合经常做字幕、不想被剪映会员绑住的创作者。
不想折腾本地模型、又想低成本批量处理字幕,可以试一试。

(本帖文案由AI生成)


添加新评论