识别准、输出规范,人工校正更少
清晰音频下,即使是术语密集的科技数码视频,平均每分钟仅需约 1 次人工校正。人工工作量显著少于现有商业字幕识别软件。1
由视频创作者亲自开发的纯本地 AI 字幕工具,把日常做字幕的麻烦,变成更顺手的每一步。
少一点反复校对和手动整理,把时间留给创作。
清晰音频下,即使是术语密集的科技数码视频,平均每分钟仅需约 1 次人工校正。人工工作量显著少于现有商业字幕识别软件。1
改对一个词,灵幕自动帮你找出其他相同错误,由你决定是否修改。
像改字幕一样修正声音,参考原声音色生成补录语音,省去重新架设麦克风、反复找录音状态的麻烦。
识别、翻译与补录无需上传云端,完全使用本机算力,识别不按次数或分钟额外收费。
以中文识别能力出色的 Qwen3-ASR 1.7B 为基础,我们用上万条真实、高质量字幕进行专项后训练,让模型进一步学会字幕的写法:哪里断句、怎样分行,英文如何大小写,数字与单位格式、中英文间距如何规范。
让口语变得利落,也把原意留下。模型学习减少“嗯、呃”等无意义的填充词,保留“那个接口”这类有明确指代的表达,让第一次识别出的字幕,就少一些需要手动整理的地方。
等到同一个词改了好几遍,才想起打开查找替换,时间已经花出去了。
在灵幕里,改对第一处就够了。它会从这次修改中理解你的意图,结合上下文找出其他相似错误,主动给出建议。你只需确认,继续往下校对。
需要你判断的地方,留给你仔细听。等待、定位和来回切换,让灵幕帮你少做一些。
说错的词,像改字幕一样改过来。灵幕参考你的原声音色,在本机生成补录语音,省去重新架麦、找状态和来回剪接的麻烦。
改好文字,点 5 下鼠标,就能完成补录。对照上下句试听,选好版本直接插入时间线。
先按完整语义翻译,再把译文精确回拆、回对齐原字幕。上下文保持连贯,每条字幕也保留原有的时间关系。
基于 Hy-MT2-7B 多语言翻译模型,在你的电脑上离线运行。未公开的影片、内部培训、保密访谈,字幕不必上传,也能完成翻译。
相比普通机器翻译,更注重上下文连贯与自然表达;遇到复杂语境和细腻文风,仍不及优秀的在线大模型。适合更看重内容保密、希望离线完成翻译的项目。
识别、翻译与声音补录都在本机运行,利用电脑的 GPU 算力处理。所有内置功能均不按次数或时长额外收费,长视频也可以放心处理。高配置电脑有机会获得比在线服务更快的处理速度。
灵幕郑重承诺:绝对不上传你的视频、音频、字幕及项目内容。软件不包含任何项目或媒体内容上传功能,私密素材留在本机,欢迎第三方独立审计。
功能迭代不需要收集用户的项目资料,也不会将你的内容用于模型训练。如果你希望按自己的用途定制模型,可以联系我们,另行约定素材提供方式与使用范围。
本地处理无需联网;激活、下载模型及授权验证需要联网。正式授权最长每 30 天需联网验证一次,试用期间每次启动需联网验证。大客户可联系定制纯离线授权版本。导入已有字幕继续编辑,再按交付需要导出。
SRT · VTT · ASS · TXT · MD
衔接 Premiere Pro、DaVinci Resolve、剪映 / CapCut
保留字体、字号、位置与阴影,便于播放与烧录
以可编辑标题导入 Final Cut Pro,保留预览样式
支持毫秒与帧时间码、DF 丢帧 / NDF 非丢帧,以及 29.97、59.94 等小数帧率,兼顾素材起始时间码。
商业字幕软件的识别率很高,收费也不低。但对你来说,更重要的是:识别结束以后,还要花多少时间,才能得到一份真正能用的字幕?
一个完整的意思被切开,大小写和格式要重新整理,同一个错词改了一遍又一遍——这些麻烦不会体现在识别率里,却决定了字幕看起来是否舒服,也决定了你还要忙多久。
灵幕用高质量的开源模型和真实字幕训练样本,让第一次输出就更接近成品。需要人工校对时,从相似错误的主动提示,到拆分、合并和调整时间轴,也尽量让每一步更顺手。
这些细节,来自一个亲自做视频、也亲自把字幕从头审到尾的创作者。字幕是作品的一部分,最后的把关不能省,但那些反复修改、来回折腾的时间,可以少花一些。
灵幕提供可复核的替换建议。你可以逐条接受、拒绝,也可以批量处理候选项,确认后才应用对应修改。
先将相邻字幕按完整语义组织后翻译,再把完整译文精确回拆到原字幕对应的位置。页面演示使用预设样例,实际结果取决于素材与模型。
识别、翻译和声音补录在本机完成,素材无需上传。模型下载、授权验证和检查更新需要联网。试用每次启动须联网验证;正式授权在有效离线票期限内可离线使用,最多 30 天。单月使用权的离线票不超过购买期限。