视频OCR

更新时间:
复制 MD 格式

视频OCR模板支持在视频中框选含文字的区域,并自动识别框内文字。

数据格式示例

说明

CSVXLSX格式中每一列数据;Manifest格式中data字段的下一级字段均对应一个数据集字段,字段名可自定义,配置数据集字段名时选择同名字段名。

CSVXLSX格式

video_url

oss://****.oss-cn-hangzhou.aliyuncs.com/iTAG/mov/1.mp4

oss://****.oss-cn-hangzhou.aliyuncs.com/iTAG/mov/2.mp4

文件Demo参考:视频数据demo.csv

Manifest格式(JSONL格式)

{"data":{"video_url":"oss://****.oss-cn-hangzhou.aliyuncs.com/iTAG/mov/1.mp4"}}
{"data":{"video_url":"oss://****.oss-cn-hangzhou.aliyuncs.com/iTAG/mov/10.mp4"}}

文件Demo参考:视频数据demo.manifest

使用限制

  • 模板支持的视频格式:MP4、WebM、OGG。

  • 视频长度:建议不超过5分钟。

配置说明

标注区(必选)

待标注视频用于配置视频字段。

单击选中待标注视频,并选择数据集后,在右侧配置区域配置具体参数。参数说明如下:

参数

说明

标题

默认标题区域无需修改。

数据集字段

在数据集字段中选择视频URL字段,字段名称可自定义。

提示

默认提示区域无需修改。

卡片样式配置

无需配置,不生效。

全局配置

全局配置用于配置模板中使用的UDF(User Defined Function)。您可在此配置获取视频fpsUDF。

预标注配置中选择视频fps获取(官方),并添加参数映射 input_dataMarkResult

单击image,在右侧可配置问答机器人。参数说明如下:

参数

说明

标题

默认标题区域无需修改。

组件版本

无需配置,不生效。

预标注

配置获取视频fpsUDF,请严格按照图示配置。

数据校验

无需配置,不生效。

其他

  • 单击返回,返回模板选择页面。

  • 单击智能化配置,可配置预标注、UDF等服务。

  • 单击废弃配置,可设置是否允许废弃样本。

  • 单击导入数据集,更改导入的数据集。

  • 单击导出模板,导出模板并复制JSON格式内容。

  • 单击保存模板,保存当前模板。

  • 单击创建任务,保存当前模板并创建任务。

操作演示

  1. 在视频中框选含文字的部分后,双击框打开弹窗。弹窗内显示OCR自动识别的文字内容。新建ID并保存后,数据同步展示在视频、右侧答题区及底部时间轴区域。

    弹窗中除内容和 ID 外,还包含全文本文本域、属性单选按钮(可选前景文字或背景文字)以及结束帧复选框,底部提供删除确定按钮。

  2. 找到该ID内容出现的几个关键帧,框选并选择相同ID保存后,三个区域的数据同步更新。

    三个区域分别为:视频帧中的蓝色标注框、右侧标注中的文字列表面板、底部时间轴的标注轨道。

  3. 双击视频中的框,可编辑或删除该ID的内容。在右侧答题区数据操作列悬停image,可查看该ID的几个关键帧,单击跳转到该关键帧。单击数据操作列的image,可删除该ID的数据。

  4. 悬停时间轴的数据条,查看该数据的全文本内容。双击数据条,跳转到该数据起始帧。