System.ArgumentOutOfRangeException: 索引和长度必须引用该字符串内的位置。 参数名: length 在 System.String.Substring(Int32 startIndex, Int32 length) 在 zhuanliShow.Bind() 标注框获取方法、装置、电子设备及计算机可读存储介质制造方法及图纸_技高网

标注框获取方法、装置、电子设备及计算机可读存储介质制造方法及图纸

技术编号:41011103 阅读:7 留言:0更新日期:2024-04-18 21:47
本申请适用于目标检测技术领域,提供了标注框获取方法、装置、电子设备及计算机可读存储介质,包括:从待处理图像确定标注框,得到第一标注框,所述第一标注框为矩形;确定所述第一标注框的最大内接图形;确定旋转后图形对应的最小外接矩形框,其中,所述旋转后图形为所述最大内接图形随所述待处理图像旋转后对应的图形;根据所述最小外接矩形框确定旋转后的所述待处理图像对应的标注框,得到第二标注框。通过上述方法,能够获取到高质量的标注框。

【技术实现步骤摘要】

本申请属于目标检测,尤其涉及标注框获取方法、装置、电子设备及计算机可读存储介质


技术介绍

1、目标检测(object detection)的任务是找出图像中所有感兴趣的目标(物体),并确定它们的类别和位置。由于各类物体有不同的外观、形状和姿态,加上成像时光照、遮挡等因素的干扰,目标检测一直是计算机视觉领域最具有挑战性的问题。

2、为了能够提高目标检测模型输出的检测框的准确度,即提高目标检测模型检测出的物体的位置的准确度,需要提前准备大量训练用的图片数据集并针对数据集中的每张图片进行标注。一般情况下,若该数据集中只包含正面朝上的物体图片,在不使用数据增强的情况下,使用该数据集训练的目标检测模型也只能较好地检测出正面朝上的物体,当出现倒置或者旋转的物体时,目标检测模型的检测效果会有一定下降。

3、为了提升目标检测模型检测各个姿态、各个角度的物体的泛化性,我们训练目标检测模型时一般需要避免训练数据中只包含单一朝向的待检测物体,尽量包含各种不同朝向的数据。但是在实际应用中,获取单一朝向的数据集的工作量更小、难度更低(例如人体检测数据集,已有大量的公开可用的数据集,但是里面大部分人体都是头朝上的站立姿态),而获取其他朝向的数据集难度较大。针对这种情况,常见的方法有:

4、1.对图片旋转的同时,对原始标注框也进行旋转,获取旋转后的原始标注框的最小外接定向矩形框,使其宽边和高边分别与图像的宽边和高边平行,将这个最小外接定向矩形框作为旋转后的图片的标注框进行训练。该方法最直接的问题是,当旋转角度过大时,获得的最小外接定向矩形框比物体大很多,使得使用该方法进行数据增强时,只能实现角度<3°的旋转增强下获得较好的效果。

5、2.在完成对图片的旋转后,通过人工重新调整标注框。通过人工调整后的标注框虽然效果最好,但是也耗费了大量人力。

6、故,需要提供一种新的方法来获取目标检测任务中的标注框。


技术实现思路

1、本申请实施例提供了标注框获取方法、装置、电子设备及计算机可读存储介质,可以解决难以获取旋转后的图像的高质量的检测框的问题。

2、第一方面,本申请实施例提供了一种标注框获取方法,包括:

3、从待处理图像确定标注框,得到第一标注框,所述第一标注框为矩形;

4、确定所述第一标注框的最大内接图形;

5、确定旋转后图形对应的最小外接矩形框,其中,所述旋转后图形为所述最大内接图形随所述待处理图像旋转后对应的图形;

6、根据所述最小外接矩形框确定旋转后的所述待处理图像对应的标注框,得到第二标注框。

7、第二方面,本申请实施例提供了一种标注框获取装置,包括:

8、第一标注框确定模块,用于从待处理图像确定标注框,得到第一标注框,所述第一标注框为矩形;

9、最大内接图形确定模块,用于确定所述第一标注框的最大内接图形;

10、最小外接矩形框确定模块,用于确定旋转后图形对应的最小外接矩形框,其中,所述旋转后图形为所述最大内接图形随所述待处理图像旋转后对应的图形;

11、第二标注框确定模块,用于根据所述最小外接矩形框确定旋转后的所述待处理图像对应的标注框,得到第二标注框。

12、第三方面,本申请实施例提供了一种电子设备,包括存储器、处理器以及存储在所述存储器中并可在所述处理器上运行的计算机程序,所述处理器执行所述计算机程序时实现如第一方面所述的方法。

13、第四方面,本申请实施例提供了一种计算机可读存储介质,所述计算机可读存储介质存储有计算机程序,所述计算机程序被处理器执行时实现如第一方面所述的方法。

14、第五方面,本申请实施例提供了一种计算机程序产品,当计算机程序产品在电子设备上运行时,使得电子设备执行上述第一方面所述的方法。

15、本申请实施例与现有技术相比存在的有益效果是:

16、由于最大内接图形是内接在第一标注框的最大内接图形,因此,该最大内接图形能够尽量框选出该第一标注框所包含的物体。而该第一标注框为从旋转前的待处理图像得到标注框,因此,该最大内接图形相当于能够尽量框选出待处理图像在旋转前的物体的图形。又由于旋转后图形为该最大内接图形在待处理图像旋转后对应的图形,因此,该旋转后图形同样框选出了待处理图像在旋转后的物体。此外,由于第一标注框为矩形,因此,与在随着待处理图像旋转的第一标注框确定出最小外接矩形框相比,在旋转后图形确定的最小外接矩形框(即第二标注框)将能实现对物体更贴合地包裹,即,采用本申请实施例提供的标注框获取方法,能够获得与理想标注框偏差更小的标注框,也即能够获取到高质量的标注框。

本文档来自技高网...

【技术保护点】

1.一种标注框获取方法,其特征在于,包括:

2.如权利要求1所述的标注框获取方法,其特征在于,所述确定所述第一标注框的最大内接图形,包括:

3.如权利要求2所述的标注框获取方法,其特征在于,所述根据所述第一标注框中的物体的形状,确定所述最大内接图形所对应的形状,包括:

4.如权利要求1所述的标注框获取方法,其特征在于,所述根据所述最小外接矩形框确定旋转后的所述待处理图像对应的标注框,包括:

5.如权利要求1至4任一项所述的标注框获取方法,其特征在于,在所述确定旋转后图形对应的最小外接矩形框之前,还包括:

6.如权利要求5所述的标注框获取方法,其特征在于,所述根据检测任务确定角度范围,包括:

7.如权利要求1至4任一项所述的标注框获取方法,其特征在于,在所述得到第二标注框之后,还包括:

8.一种标注框获取装置,其特征在于,包括:

9.一种电子设备,包括存储器、处理器以及存储在所述存储器中并可在所述处理器上运行的计算机程序,其特征在于,所述处理器执行所述计算机程序时实现如权利要求1至7任一项所述的方法。

10.一种计算机可读存储介质,所述计算机可读存储介质存储有计算机程序,其特征在于,所述计算机程序被处理器执行时实现如权利要求1至7任一项所述的方法。

...

【技术特征摘要】

1.一种标注框获取方法,其特征在于,包括:

2.如权利要求1所述的标注框获取方法,其特征在于,所述确定所述第一标注框的最大内接图形,包括:

3.如权利要求2所述的标注框获取方法,其特征在于,所述根据所述第一标注框中的物体的形状,确定所述最大内接图形所对应的形状,包括:

4.如权利要求1所述的标注框获取方法,其特征在于,所述根据所述最小外接矩形框确定旋转后的所述待处理图像对应的标注框,包括:

5.如权利要求1至4任一项所述的标注框获取方法,其特征在于,在所述确定旋转后图形对应的最小外接矩形框之前,还包括:

6.如权利要求5...

【专利技术属性】
技术研发人员:胡淑萍王侃董培庞建新谭欢
申请(专利权)人:深圳市优必选科技股份有限公司
类型:发明
国别省市:

网友询问留言 已有0条评论
  • 还没有人留言评论。发表了对其他浏览者有用的留言会获得科技券。

1