视频文案怎么提取?本地AI批量提取直播话术与TXT/SRT字幕教程

视频文案怎么提取?本地AI批量提取直播话术与TXT/SRT字幕教程
很多人有提取直播间或者视频话术的需求,其实快抖下载器很早就有了视频文案提取的功能,结合快抖直播录制助手,可以轻松提取直播录屏的文案,而且每天有免费次数可使用,对于普通用户来说也是够用的,今天就来详细说一下怎么来提取直播间话术。

视频文案提取是什么

视频文案提取就是将视频或者音频里的语言转为文本内容,文本内容可以是纯文本TXT,或者字幕格式STR,常见的影视作品里的字幕就是STR格式的文本,软件就是通过本地电脑运行的模型文件,将视频中的语言转为文本内容,全程可离线处理。

一场直播间的视频时长可能有一两个小时,要快速的了解直播间内容,或者学习直播话术,直接查看视频太慢了,快进的话又会听不清楚。提取出口播文案后,可以快速的掌握直播主要内容,判断出直播的质量,同时也可以快速复制直播话术,比直接看视频要快的多。

视频文案提取详细教程

本教程使用快抖直播录制助手软件作为提取工具,需要的可以提前在官网下载好软件。

1、下载安装软件工具

首先在软件官网下载安装快抖直播录制助手软件,软件目前只有Window版本,需要提前使用Window电脑安装,支持win7及以上的系统。

2、下载大模型文件到电脑文件夹

由于大模型文件有200M左右,因此模型文件没有跟软件安装包一起打包,需要单独再下载大模型文件,大模型文件放在网盘里面,可以从以下两个网盘链接进行下载:
百度云盘: https://aitoolwang.com/pan.html
夸克网盘:https://pan.quark.cn/s/522362081aca
模型文件是.onnx文件,下载好后记住保存的位置,后面要用到。

视频文案提取使用的大模型文件
视频文案提取使用的大模型文件

3、配置模型位置

下载好大模型文件后,第一步就是配置大模型的位置,我们点选择按钮,选择我们下载的大模型,这样就配置好了大模型的位置

快抖直播录助手文案提取配置模型位置界面
快抖直播录助手文案提取配置模型位置界面

4、选择要提取文案的视频

这里可以选择单个视频文件,也可以选择视频文件夹,选择视频文件夹软件会依次提取文件夹里的视频文案。

快抖直播录助手文案提取界面
快抖直播录助手文案提取界面

5、选择文案保存位置

选择一个提取文案后的保存的位置,这里是选择一个文件夹,提取后的文案文件的名称和视频文件的名称是一样的,只是后缀不同。

6、开始提取视频文案

点击开始处理,下方会展示文案提取的进度,提取完之后会显示处理完成。

快抖直播录助手文案提取成功界面
快抖直播录助手文案提取成功界面

直播录屏话术怎么批量提取

批量提取只需在输入的时候选择文件夹就可以,软件会自动依次检测文件夹里的视频、音频内容,依次进行文案提取操作,将需要批量提取文案的文件放到一个文件夹里,然后选择这个文件夹进行处理就可以了。

软件只会处理一级目录,如果文件夹里还有子文件夹的话,软件不会处理子文件夹的内容。

TXT和SRT有什么区别

二者的详细区别如下表所示:

特性TXT 格式SRT 格式
全称与用途纯文本文件 (Plain Text File),用于存储无格式的文字信息。SubRip 字幕文件 (SubRip Subtitle),是通用字幕格式。
核心内容仅包含纯文本内容。包含序号时间码字幕文本三部分。
时间信息。不包含任何时间同步信息。。每条字幕都包含精确的开始和结束时间码(格式:00:00:10,500 --> 00:00:13,000)。
结构无特定结构,是连续或分段的纯文字。结构固定,由多个字幕块组成,每个块包含序号、时间码和文本,块之间用空行分隔。
主要用途文字记录、笔记、内容草稿、供翻译或内容分析的原始文本。为视频提供外挂字幕,确保文字与画面和音频同步显示。
兼容性兼容性极高,任何操作系统和文本编辑器都能打开。几乎所有主流媒体播放器和视频编辑软件都支持。
示例这是一段纯文字记录。1 00:00:10,500 --> 00:00:13,000 Hello, how are you today? 2 00:00:15,000 --> 00:00:18,500 I'm doing great!

支持的视频和音频格式

软件支持主流通用的音视频格式,具体支持范围如下表所示:

支持的格式格式列表
视频格式mp4、flv、ts、avi、mov、wmv
音频格式wav、mp3、m4a

本地AI提取的优缺点

使用本地大模型提取视频的文案,优势十分明显,有以下几点:

1、视频不用上传

全部本地处理,保证了数据安全,同时也节省了视频上传时间。

2、可批量提取

软件提取视频支持批量处理,可批量提取文件夹中的所有视频的文案,速度更快也更简单。

3、不限时长和次数

本地大模型提取,依托客户自己计算机的算力,提取成本更低,因此可以做到不限时长与次数,想提取多少就提取多少。

4、不用等待和排队

自己电脑上运行,想什么时候提取就什么时候提取,不用等待服务器算力和限制,更加及时快捷
当然,使用本地模型提取也有一些局限性,如果自己的电脑配置较低的话可能运行不起来本地模型,而且本地模型也有一些或多或少的兼容性要求,部分电脑或CPU型号可能会有闪退,大家在使用前可以先试用下,免得期待落空。

视频文案提取中的常见问题

1、模型加载失败怎么办?

模型存放的文件夹路径上不要有空格和特殊字符,同时文件路径也不要太深了,直接在D盘建一个文件夹,命名为kd,然后把模型放在这个文件夹里,在重新配置一下文件路径。

2、支持哪些音视频格式?

软件支持视频(.mp4、.flv、.ts、.avi、.mov、.wmv)、音频(.wav、mp3、.m4a)这些格式,基本主流的音视频格式都支持。

3、TXT 和 SRT 有什么区别?

txt就是纯文本内容,SRT是字幕文件,格式上带有视频的时间轴信息,使用Potplay播放器打开视频的时候,会自动加载SRT字幕,展示在视频播放界面

4、视频文案提取需要联网吗?

不需要联网处理,视频音频的处理都是在本地电脑进行,提取文案的大模型也是运行在电脑本地的,所有功能都不需要联网。

5、识别结果不准确怎么办?

软件使用的是本地AI大模型识别,对于吐字清晰、普通话标准、背景噪声较少的情况下,可以获得较好的识别效果;方言、数字、多人同时说话可能影响准确率。目前大模型对于数字内容识别也不太好,这也是本地模型的局限性,毕竟模型大小只有200多兆。

6、对电脑有什么要求?

由于文案提取工作都是在本地电脑上处理,因此对电脑有一定的要求,建议使用Window11操作系统,i5以上处理器,8GB的内存。

使用快抖直播录制助手,可以先自动录制直播,再批量提取视频中的话术文案,快速完成直播复盘和素材整理。