视频处理分类 · 使用教程 · 预计阅读 2 分钟

功能简介

「音频转文字(语音识别)」是批处理大师 Pro「视频处理」分类下的功能。上传音频,直接将语音内容转写为文字:逐句带时间轴显示,同时输出 TXT 全文与 SRT 字幕。首次使用自动下载本地识别模型(约57MB,离线识别,文件不离开电脑)。支持 MP3/WAV/M4A/AAC/FLAC/OGG/OPUS,单文件≤500MB。处理过程完全在本地完成,文件内容不会被上传到任何服务器。

适用场景

操作步骤

  1. 打开批处理大师 Pro 桌面客户端,进入左侧「视频处理」分类
  2. 在分类页中找到并点击「音频转文字(语音识别)」功能
  3. 点击「添加文件」按钮,将需要处理的音频加入列表(支持批量拖拽)
  4. 首次使用会自动下载本地识别模型(约57MB),之后无需联网
  5. 在参数面板中按你的实际需求配置下方「参数说明」中的各项
  6. 点击「开始处理」,识别在本地完成,结果输出 TXT 与 SRT

参数说明

常见问题

处理会修改我的原文件吗?

不会。该功能仅读取音频中的语音并生成文字结果,不改动原音频文件。

文件会被上传到服务器吗?

不会。识别使用本地模型离线完成,文件不离开你的电脑,不经任何服务器中转。

某个文件处理失败了怎么办?

结果列表会标注失败项与原因,你可以单独重试该文件;请确认文件为受支持的格式且单文件不超过 500MB。

处理速度如何?

取决于音频时长、电脑性能与所选模型;标准模型速度较快,精准模型更慢但更准确。

音频转文字(语音识别) 怎么用?

打开批处理大师 Pro 桌面客户端,进入对应功能分类后点击「音频转文字(语音识别)」,添加文件即可一键批量处理;界面提供详细操作步骤与参数说明,新手也能快速上手。

音频转文字(语音识别) 支持处理哪些文件、能做什么?

「音频转文字(语音识别)」上传音频,直接将语音内容转写为文字:逐句带时间轴显示,同时输出 TXT 全文与 SRT 字幕。首次使用自动下载本地识别模型(约57MB,离线识别,文件不离开电脑)。支持 MP3/WAV/M4A/AAC/FLAC/OGG/OPUS,单文件≤500MB。处理全程在你的电脑本地完成,文件不上传服务器,隐私更安全。

音频转文字(语音识别) 处理文件安全吗?文件会上传吗?

安全。批处理大师 Pro 所有文件处理均在你的电脑本地完成,文件不上传、不经任何服务器中转,你的数据始终留在自己手中。

相关功能

还有其他问题?返回帮助中心联系客服