百度360必应搜狗淘宝本站头条
当前位置:网站首页 > IT技术 > 正文

CV学习笔记(二十四):数据集标注与制作

wptr33 2025-06-09 00:43 6 浏览

最近在做一些数据标注的工作,虽然标注数据比较枯燥,但这也是每个做算法的工程师升级打怪的必由之路。使用一些合适的工具往往可以事半功倍,效率UP。

一:数据标注流程

二:数据处理的一些小代码

1:重命名

当得到这样格式命名不一致的数据的时候,重命名是最好的方法。

代码:

#coding=UTF-8
'''
重命名工具
'''
import os
import sys
def rename():
    path=input(r"请输入路径(例如D:\picture):")
    name=input("请输入开头名:")
    startNumber=input("请输入开始数:")
    fileType=input("请输入后缀名(如 .jpg、.txt等等):")
    print("正在生成以"+name+startNumber+fileType+"迭代的文件名")
    count=0
    filelist=os.listdir(path)
    for files in filelist:
        Olddir=os.path.join(path,files)
        if os.path.isdir(Olddir):
            continue
        Newdir=os.path.join(path,name+str(count+int(startNumber))+fileType)
        os.rename(Olddir,Newdir)
        count+=1
    print("一共修改了"+str(count)+"个文件")

if __name__ == '__main__':
    rename()

重命名后的文件会覆盖之前的文件,记得操作之前备份原始数据(如有需要的话)


2:数据标注工具:

对于VOC数据集,使用labelimgs很方便,安装过程也很简单:开源地址如下:
https://github.com/tzutalin/labelImg

如上图所示,框选完口罩后,点击OK会生成一个跟你文件名一致的XML文件,XML中包括有文件路径,文件名称,以及你给的标签等等信息,如下图:

3:划分数据集

因为要符合VOC数据集格式,这里简单说一下VOC数据集格式类型。做深度学习目标检测方面的同学怎么都会接触到PASCAL VOC这个数据集。也许很少用到整个数据集,但是一般都会按照它的格式准备自己的数据集。所以这里就来记录一下PASCAL VOC的格式,包括目录构成以及各个文件夹的内容格式,方便以后自己按照VOC的标准格式制作自己的数据集。

但是我们一般情况下,自己制作数据集不需要Segment开头的,着重关注这三个文件夹:

Annotation文件夹存放的是xml文件,该文件是对图片的解释,每张图片都对于一个同名的xml文件。
ImageSets文件夹存放的是txt文件,这些txt将数据集的图片分成了各种集合。
JPEGImages文件夹存放的是数据集的原图片

转换代码:

import os
import random

xmlfilepath = r'D:/object_find/voc_title/VOCdevkit/VOC2007/Annotations'
saveBasePath = r"D:/object_find/voc_title/VOCdevkit/VOC2007/ImageSets/Main/"

#训练集和验证集所占的比例
trainval_percent = 0.8
train_percent = 0.8

temp_xml = os.listdir(xmlfilepath)
total_xml = []
for xml in temp_xml:
    if xml.endswith(".xml"):
        total_xml.append(xml)

num = len(total_xml)
list = range(num)
tv = int(num * trainval_percent)
tr = int(tv * train_percent)
trainval = random.sample(list, tv)
train = random.sample(trainval, tr)

print("train and val size", tv)
print("traub suze", tr)
#trainval,训练集测试集文件名,train,训练集,test,测试集,val验证集的文件名
ftrainval = open(os.path.join(saveBasePath, 'trainval.txt'), 'w')
ftest = open(os.path.join(saveBasePath, 'test.txt'), 'w')
ftrain = open(os.path.join(saveBasePath, 'train.txt'), 'w')
fval = open(os.path.join(saveBasePath, 'val.txt'), 'w')

for i in list:
    name = total_xml[i][:-4] + '\n'
    if i in trainval:
        ftrainval.write(name)
        if i in train:
            ftrain.write(name)
        else:
            fval.write(name)
    else:
        ftest.write(name)

ftrainval.close()
ftrain.close()
fval.close()
ftest.close()

运行结果:

4:XML转TXT

这里要用到XML工具包来匹配一下:

代码:

import xml.etree.ElementTree as ET
from os import getcwd

sets=[('2007', 'train'), ('2007', 'val'), ('2007', 'test')]

classes = ["nomask","rightmask","wrongmask"]
def convert_annotation(year, image_id, list_file):
    in_file = open('D:/object_find/voc_title/VOCdevkit/VOC%s/Annotations/%s.xml'%(year, image_id))
    tree=ET.parse(in_file)
    root = tree.getroot()

    for obj in root.iter('object'):
        difficult = obj.find('difficult').text
        cls = obj.find('name').text
        if cls not in classes or int(difficult)==1:
            continue
        cls_id = classes.index(cls)
        xmlbox = obj.find('bndbox')
        b = (int(xmlbox.find('xmin').text), int(xmlbox.find('ymin').text), int(xmlbox.find('xmax').text), int(xmlbox.find('ymax').text))
        list_file.write(" " + ",".join([str(a) for a in b]) + ',' + str(cls_id))

wd = getcwd()

for year, image_set in sets:
    image_ids = open('VOCdevkit/VOC%s/ImageSets/Main/%s.txt'%(year, image_set)).read().strip().split()
    list_file = open('%s_%s.txt'%(year, image_set), 'w')
    for image_id in image_ids:
        list_file.write('%s/VOCdevkit/VOC%s/JPEGImages/%s.jpg'%(wd, year, image_id))
        convert_annotation(year, image_id, list_file)
        list_file.write('\n')
    list_file.close()

生成结果:

生成txt文件,包括:图片位置信息,目标位置,类别

相关推荐

flarum安装使用教程(flm安装教程安卓)

Flarum是一款现代化的、简洁美观的论坛软件,以下是关于它的环境安装:安装搭建基础环境:...

从abc起步学做网站(4)(从abc开始学英语用什么软件)

上一次我们做了一个大多数网站使用的模板,带有顶部、左侧导航、右侧主内容、底部等板块。现在我们把它逐步扩展成一个论坛。一个论坛的基本功能有注册,登陆,发帖,回帖,看帖,删帖等,我们一步步来做。首先大多数...

了解webshell变形的一些思路(webxshell)

请遵守法律法规,文章旨在提高安全软件的应变策略,严禁非法使用,后果自负。前言在攻防场景下,黑客常常在找到某个上传接口,第一步肯定是先测试后缀是否有限制,第二步则是测试上传的文件是否能解析,最后便确认即...

MySQL8安装 八: 使用phpMyadmin客户端

MySQL8安装一:源码安装...

PHP基本的语法、注释:让你的代码充满神秘色彩

PHP魔法咒语:让你的代码充满神秘色彩(带你进入PHP的魔法世界)一、笔记:基本的PHP语法PHP是一种超级强大的脚本语言,专为Web开发而设计。要想成为真正的PHP魔法师,首先需要掌握一些基本的语法...

PHP——bc函数及其应用详解(php bcmul)

bcadd——两个任意精度数字的加法计算(PHP4,PHP5,PHP7,PHP8)...

从零学习php之php语法——课程1(php零基础自学)

以后将会每天更新一篇电脑编程教程有需要的朋友记得订阅转发哟怎么学习php?对于想学php还没入门的朋友很多都在纠结怎么开始第一步。我很了解php初学者的心理,因为我也是从那个阶段过来的,也是自学。那...

全新版Jetpack进阶提升,系统性落地短视频App|超清完结无秘

全新版Jetpack进阶提升,系统性落地短视频App|超清完结无秘来百度APP畅享高清图片...

Reactive系统的反压(什么是反压)

原文BackpressureinReactiveSystemshttps://foojay.io/today/backpressure-in-reactive-systems/?spm=ata...

Kotlin设计模式:Flyweight(享元)模式

享元模式的目的...

如何使用 Kotlin 在 Android 应用程序中使用 DataStore 首选项

在本教程中,我将向您展示如何使用数据存储首选项在Android应用程序中本地保存数据,而不是使用共享首选项的旧方法。我看到很多人不知道如何使用DataStore,他们认为这太难了,所以在这篇文章...

Spring Native 中文文档(springdatajpa中文文档)

https://docs.spring.io/spring-native/docs/current/reference/htmlsingle/#getting-started-buildpacks...

详解Android官推Kotlin-First的图片加载库

前言Coil是一个非常年轻的图片加载库,在2020年10月22日才发布了1.0.0版本,但却受到了Android官方的推广,在AndroidDevelopersBackst...

Spring Boot通过@EnableCaching注解开启全局服务缓存功能!

Caching缓存缓存在现代应用中无处不在,它为服务的高可用提供了很大的帮助。Spring框架提供了对缓存的支持。SpringBoot通过@EnableCaching注解开启全局服务缓存功能。对于某...

Spring好番特辑:麦咭开启宠娃模式!把娃春日宠上天!

...