摘要:该数据集面向移动端自然场景文字识别及OCR性能评估任务,共包含10,400条样本记录和19个字段。

数据集概述

该数据集面向移动端自然场景文字识别及OCR性能评估任务,共包含10,400条样本记录和19个字段。样本覆盖自然场景、文档、标牌、商品标签及数字显示屏等文字载体,并记录图像采集条件、文字外观、设备属性和字符组成信息。目标字段用于判断识别结果是否与预期文本一致,分为识别错误和识别正确两个类别。

数据结构与关键特征

数据集包含图像资源及结构化的Mobile_Text_Recognition_D数据文件,每条记录通过Image_ID标识对应的文本识别样本。主要字段包括光照条件、文字方向、背景复杂度、字体大小与样式、图像质量、模糊程度、遮挡程度、设备类型、图像分辨率和文本长度,同时统计大写字母、小写字母、数字、符号及字符总数。Target_Class为二分类标签,其中0表示识别错误,1表示识别正确。

应用价值与研究方向

该数据集可用于移动OCR性能评估、识别失败预测、复杂场景文本分析、图像质量控制及移动端文字识别系统优化。研究方向包括二分类机器学习、场景属性与识别准确率关联分析、模糊和遮挡鲁棒性研究、特征重要性与可解释性建模、自适应图像预处理、跨设备泛化以及轻量化模型部署,还可用于识别质量评分和困难样本挖掘。

数据集来源

由张家梁(Bob)整理并于2026年在7zcode平台公开发布。

数据集信息

免责声明与引用

数据仅用于科研与教学用途。若用于商业场景,请自行核验数据许可。如需引用,请在论文或报告中注明数据集名称与版本号。

作者信息

作者:Bob (张家梁)
项目编号:Datasets-599
文件大小:110M
原创声明:本数据集为整理作品

联系方式

开源协议

本项目采用AGPL-3.0开源协议,允许个人和组织自由使用、修改和分发代码,但基于本项目的衍生作品必须同样开源,且用于提供网络服务时需向用户提供完整源代码。本项目仅供学习研究使用,作者不对使用本项目产生的任何后果承担责任,使用者应遵守当地法律法规,合理合法使用本项目。如本项目对您的研究或工作有所帮助,欢迎引用并注明出处。

声明:本站所有项目资源都可以正常运行,亲测无错!而且我们录制了演示视频,在我们注明的环境版本下,项目运行效果完全和演示视频一致。客服QQ:下载须知