Box坐标转换

文章目录[隐藏]

[x, y, width, height]--在我们的训练数据集中就是这种情况(也叫COCO格式)。
[x1, y1, x2, y2] - 我们在BBox增强阶段创建的格式化版本,也叫[xmin, ymin, xmax, ymax]。这个格式在SSD/RCNN/Fast RCNN/Faster RCNN模型中使用。
[x_center, y_center, width, height] - 这是YOLO格式,或者说是使用YOLO模型训练时使用的格式。x_center, y_center是边界框中心的标准化坐标,width, height是图像的标准化宽度和高度。

Example1:

annotations 数据格式:[{'x': 641, 'y': 634, 'width': 74, 'height': 71}]

变成coco_bbox [[641, 634, 74, 71]]

数据处理:

train_df["coco_bbox"] = train_df["annotations"].apply(lambda annot: [list(item.values()) for item in eval(annot)])

版权声明:本文为CSDN博主「苏坡爱豆的笑容都没你的甜」的原创文章,遵循CC 4.0 BY-SA版权协议,转载请附上原文出处链接及本声明。
原文链接:https://blog.csdn.net/weixin_44656422/article/details/122961815

我还没有学会写个人说明!

暂无评论

发表评论

相关推荐

YOLOV1论文详解

YOLOV1 1. Introduction YOLO非常简单:对于一张完整的图像,通过一个单一的卷积网络可以同时预测多个bounding boxes的回归参数和这些boxes的类别概率,并直接优化检

【darknet】1、yolov4模型训练之数据处理

本文主要写了使用yolov4进行模型训练前的数据准备。darknet框架使用的数据格式是yolo格式,但我们常见的目标检测数据格式是COCO和VOC.所以本文将以车辆检测为例,将coco2017和voc2007及vo