视频OCR模板支持在视频中框选含文字的区域,并自动识别框内文字。
数据格式示例
CSV及XLSX格式中每一列数据;Manifest格式中data字段的下一级字段均对应一个数据集字段,字段名可自定义,配置数据集字段名时选择同名字段名。
CSV及XLSX格式
video_url |
oss://****.oss-cn-hangzhou.aliyuncs.com/iTAG/mov/1.mp4 |
oss://****.oss-cn-hangzhou.aliyuncs.com/iTAG/mov/2.mp4 |
文件Demo参考:视频数据demo.csv
Manifest格式(JSONL格式)
{"data":{"video_url":"oss://****.oss-cn-hangzhou.aliyuncs.com/iTAG/mov/1.mp4"}}
{"data":{"video_url":"oss://****.oss-cn-hangzhou.aliyuncs.com/iTAG/mov/10.mp4"}}文件Demo参考:视频数据demo.manifest
使用限制
模板支持的视频格式:MP4、WebM、OGG。
视频长度:建议不超过5分钟。
配置说明
标注区(必选)
待标注视频用于配置视频字段。
单击选中待标注视频,并选择数据集后,在右侧配置区域配置具体参数。参数说明如下:
参数 | 说明 |
标题 | 默认标题区域无需修改。 |
数据集字段 | 在数据集字段中选择视频URL字段,字段名称可自定义。 |
提示 | 默认提示区域无需修改。 |
卡片样式配置 | 无需配置,不生效。 |
全局配置
全局配置用于配置模板中使用的UDF(User Defined Function)。您可在此配置获取视频fps的UDF。
在预标注配置中选择视频fps获取(官方),并添加参数映射 input_data → MarkResult。
单击
,在右侧可配置问答机器人。参数说明如下:
参数 | 说明 |
标题 | 默认标题区域无需修改。 |
组件版本 | 无需配置,不生效。 |
预标注 | 配置获取视频fps的UDF,请严格按照图示配置。 |
数据校验 | 无需配置,不生效。 |
其他
单击返回,返回模板选择页面。
单击智能化配置,可配置预标注、UDF等服务。
单击废弃配置,可设置是否允许废弃样本。
单击导入数据集,更改导入的数据集。
单击导出模板,导出模板并复制JSON格式内容。
单击保存模板,保存当前模板。
单击创建任务,保存当前模板并创建任务。
操作演示
在视频中框选含文字的部分后,双击框打开弹窗。弹窗内显示OCR自动识别的文字内容。新建ID并保存后,数据同步展示在视频、右侧答题区及底部时间轴区域。
弹窗中除内容和 ID 外,还包含全文本文本域、属性单选按钮(可选前景文字或背景文字)以及结束帧复选框,底部提供删除和确定按钮。
找到该ID内容出现的几个关键帧,框选并选择相同ID保存后,三个区域的数据同步更新。
三个区域分别为:视频帧中的蓝色标注框、右侧标注中的文字列表面板、底部时间轴的标注轨道。
双击视频中的框,可编辑或删除该ID的内容。在右侧答题区数据操作列悬停
,可查看该ID的几个关键帧,单击跳转到该关键帧。单击数据操作列的
,可删除该ID的数据。悬停时间轴的数据条,查看该数据的全文本内容。双击数据条,跳转到该数据起始帧。