数据集
3 个数据集
热门分类:
PaddleOCR-VL_demo 是 OCR 与视觉语言模型演示资源,包含图像文件及配套说明,用于展示文档文字识别和视觉理解流程。
这是一个包含训练图像的数据集,主要提供常见图片格式(如jpg、png、jpeg、webp)的文件,并附带一些元数据文件(如json、md),适用于图像处理或机器学习相关任务。
该数据集主要用于LaTeX OCR(光学字符识别)测试,包含图片(PNG格式)以及对应的标注文件(JSON、JSONL等),可用于训练或评估将LaTeX公式图像转换为可编辑文本的模型。