01

准备本地模型

SunGet 的本地语音识别使用 SenseVoiceSmall。按需下载版第一次使用时需要联网下载模型,完成后可在本机处理语音。

  1. 1

    打开个人中心或偏好设置中的本地语音识别区域。

  2. 2

    检查模型状态;如果显示未下载,开始下载并等待完整性检查通过。

  3. 3

    确认 FFmpeg 工具诊断正常,以便从视频提取音频。

02

生成文稿和字幕

  1. 1

    在资料库中选中一个视频,并选择本地语音识别。

  2. 2

    等待识别完成。SunGet 会生成同名文本并同步生成标准 UTF-8 SRT。

  3. 3

    打开独立播放器并启用字幕,检查时间轴是否与语音对应。

03

校正识别结果

暂停到需要修改的位置,双击当前字幕进行修正。保存后修改会写回 SRT 文件,后续播放继续使用校正结果。