Q&A
yolov3のアノテーションデータ作成を行う際、正解ラベルとして画像パスとその正解ラベル(座標)が記載されたtxtデータを作成したいです
今回作成したいtxtデータの中身は(例です)
your_path//keras-yolo-train/VOCDevkit/VOC2007/JPEGImages/000003.jpg 19,61,402,353,0
ディレクトリの構造は
-Keras-yolo-train
---voc_annotation.py
*下記に記載するVOCDevkitは同一ディレクトリです。
---VOCDevkit→VOC2007→Annotations→xmlファイル
---VOCDevkit→VOC2007→JPEGImages→jpgファイル
---VOCDevkit→VOC2007→ImageSets→main→txtデータ(0000099.jpg 1)※1とは検出するクラ数です
---logs
---yolo.py
---pycache
---make_train_files.py
---yolo3
---model_data
---yolo_video.py
---yolov3.cfg
---darknet53.cfg
---resize_images.py
---yolov3.weights
試してみたこと(コード)
import xml.etree.ElementTree as ET from os import getcwd import sys,os sets=[('2007', 'train'), ('2007', 'val'), ('2007', 'test')] classes = ["people"] if len(sys.argv) > 1: classes = sys.argv[1:] with open('model_data/voc_classes.txt','w') as f: f.write('\n'.join(classes)) def convert_annotation(year, image_id, list_file): in_file = open('VOCDevkit/VOC%s/Annotations/%s.xml'%(year, image_id.replace(".jpg",""))) tree=ET.parse(in_file) root = tree.getroot() for obj in root.iter('object'): difficult = obj.find('difficult').text cls = obj.find('name').text if cls not in classes or int(difficult)==1: continue cls_id = classes.index(cls) xmlbox = obj.find('bndbox') b = (int(float(xmlbox.find('xmin').text)), int(float(xmlbox.find('ymin').text)), int(float(xmlbox.find('xmax').text)), int(float(xmlbox.find('ymax').text))) list_file.write(" " + ",".join([str(a) for a in b]) + ',' + str(cls_id)) wd = getcwd() for year, image_set in sets: image_ids = open('VOCDevkit/VOC%s/ImageSets/Main/%s.txt'%(year, image_set)).read().strip().split() list_file = open('model_data/%s_%s.txt'%(year, image_set), 'w') for image_id in image_ids: if image_id == '1': continue if image_id == '-1': continue image_file_path = '%s/VOCDevkit/VOC%s/JPEGImages/%s'%(wd, year, image_id) list_file.write(image_file_path) convert_annotation(year, image_id, list_file) list_file.write('\n') list_file.close()
出力されたtxtデータ
/Users/koheinagamatsu/keras-yolo3/VOCDevkit/VOC2007/JPEGImages/0000053.jpg
xmlデータに格納されている座標データが取れていません。
your_path//keras-yolo-train/VOCDevkit/VOC2007/JPEGImages/000003.jpg** 19,61,402,353,0**
本来ならば、上のようになって欲しいです。
あなたの回答
tips
プレビュー