SWHL/text_det_test_dataset
文本检测测试集 数据集简介 该测试集包括卡证类、文档类和自然场景三大类。其中卡证类有82张,文档类有75张,自然场景类有55张。 该数据集可以结合文本检测指标评测库-TextDetMetric使用,快速评测各种文本检测算法。 关于该数据集,欢迎小伙伴贡献更多数据呦!有任何想法,可以前往issue讨论。 数据集支持的任务 可用于自定义数据集下的模型验证和性能评估等。 数据集加载方式 from datasets import load_dataset dataset = load_dataset("SWHL/text_det_test_dataset") test_data = dataset['test'] print(test_data) 数据集生成的相关信息 原始数据 数据来源于网络,如侵删。 数据集标注… See the full description on the dataset page: https://huggingface.co/datasets/SWHL/text_det_test_dataset.
2234
文本检测测试集
数据集简介
- 该测试集包括卡证类、文档类和自然场景三大类。其中卡证类有82张,文档类有75张,自然场景类有55张。
- 该数据集可以结合文本检测指标评测库-TextDetMetric使用,快速评测各种文本检测算法。
- 关于该数据集,欢迎小伙伴贡献更多数据呦!有任何想法,可以前往[issue](https://github.com/SWHL/TextDetMetric/issues)讨论。
数据集支持的任务
可用于自定义数据集下的模型验证和性能评估等。
数据集加载方式
from datasets import load_dataset
dataset = load_dataset("SWHL/text_det_test_dataset")
test_data = dataset['test']
print(test_data)数据集生成的相关信息
原始数据
数据来源于网络,如侵删。
数据集标注
- 数据集使用**labelme**标注,json格式差别在于
imagePath字段改写为了file_name字段。其余相同。 - 数据集标注为
json格式,示例如下:
{
"version": "4.5.6",
"flags": {},
"shapes": [
{
"label": "",
"points": [
[
486.0,
751.0
],
[
588.0,
751.0
],
[
588.0,
779.0
],
[
486.0,
779.0
]
],
"group_id": null,
"shape_type": "polygon",
"flags": {}
},
{
"label": "",
"points": [
[
385.1382113821138,
686.6178861788618
],
[
592.4552845528456,
688.2439024390244
],
[
589.2032520325204,
739.4634146341464
],
[
386.7642276422764,
737.0243902439024
]
],
"group_id": null,
"shape_type": "polygon",
"flags": {}
}
],
"file_name": "19.png",
"imageData": "xxxxxx",
"imageHeight": 784,
"imageWidth": 613
}