質問をすることでしか得られない、回答やアドバイスがある。

15分調べてもわからないことは、質問しよう!

新規登録して質問してみよう
ただいま回答率
85.48%
YOLO

YOLOとは、画像検出および認識用ニューラルネットワークです。CベースのDarknetというフレームワークを用いて、画像や動画からオブジェクトを検出。リアルタイムでそれが何になるのかを認識し、分類することができます。

Python

Pythonは、コードの読みやすさが特徴的なプログラミング言語の1つです。 強い型付け、動的型付けに対応しており、後方互換性がないバージョン2系とバージョン3系が使用されています。 商用製品の開発にも無料で使用でき、OSだけでなく仮想環境にも対応。Unicodeによる文字列操作をサポートしているため、日本語処理も標準で可能です。

Q&A

0回答

1996閲覧

xmlデータの追加方法について

rgb_nk

総合スコア26

YOLO

YOLOとは、画像検出および認識用ニューラルネットワークです。CベースのDarknetというフレームワークを用いて、画像や動画からオブジェクトを検出。リアルタイムでそれが何になるのかを認識し、分類することができます。

Python

Pythonは、コードの読みやすさが特徴的なプログラミング言語の1つです。 強い型付け、動的型付けに対応しており、後方互換性がないバージョン2系とバージョン3系が使用されています。 商用製品の開発にも無料で使用でき、OSだけでなく仮想環境にも対応。Unicodeによる文字列操作をサポートしているため、日本語処理も標準で可能です。

0グッド

0クリップ

投稿2019/07/05 02:52

yolov3のアノテーションデータ作成を行う際、正解ラベルとして画像パスとその正解ラベル(座標)が記載されたtxtデータを作成したいです

今回作成したいtxtデータの中身は(例です)
your_path//keras-yolo-train/VOCDevkit/VOC2007/JPEGImages/000003.jpg 19,61,402,353,0


ディレクトリの構造は
-Keras-yolo-train
---voc_annotation.py

下記に記載するVOCDevkitは同一ディレクトリです。
---VOCDevkit→VOC2007→Annotations→xmlファイル
---VOCDevkit→VOC2007→JPEGImages→jpgファイル
---VOCDevkit→VOC2007→ImageSets→main→txtデータ(0000099.jpg 1)※1とは検出するクラ数です

---logs
---yolo.py
---pycache
---make_train_files.py
---yolo3
---model_data
---yolo_video.py
---yolov3.cfg
---darknet53.cfg
---resize_images.py
---yolov3.weights


試してみたこと(コード)

import xml.etree.ElementTree as ET from os import getcwd import sys,os sets=[('2007', 'train'), ('2007', 'val'), ('2007', 'test')] classes = ["people"] if len(sys.argv) > 1: classes = sys.argv[1:] with open('model_data/voc_classes.txt','w') as f: f.write('\n'.join(classes)) def convert_annotation(year, image_id, list_file): in_file = open('VOCDevkit/VOC%s/Annotations/%s.xml'%(year, image_id.replace(".jpg",""))) tree=ET.parse(in_file) root = tree.getroot() for obj in root.iter('object'): difficult = obj.find('difficult').text cls = obj.find('name').text if cls not in classes or int(difficult)==1: continue cls_id = classes.index(cls) xmlbox = obj.find('bndbox') b = (int(float(xmlbox.find('xmin').text)), int(float(xmlbox.find('ymin').text)), int(float(xmlbox.find('xmax').text)), int(float(xmlbox.find('ymax').text))) list_file.write(" " + ",".join([str(a) for a in b]) + ',' + str(cls_id)) wd = getcwd() for year, image_set in sets: image_ids = open('VOCDevkit/VOC%s/ImageSets/Main/%s.txt'%(year, image_set)).read().strip().split() list_file = open('model_data/%s_%s.txt'%(year, image_set), 'w') for image_id in image_ids: if image_id == '1': continue if image_id == '-1': continue image_file_path = '%s/VOCDevkit/VOC%s/JPEGImages/%s'%(wd, year, image_id) list_file.write(image_file_path) convert_annotation(year, image_id, list_file) list_file.write('\n') list_file.close()

出力されたtxtデータ

/Users/koheinagamatsu/keras-yolo3/VOCDevkit/VOC2007/JPEGImages/0000053.jpg

xmlデータに格納されている座標データが取れていません。
your_path//keras-yolo-train/VOCDevkit/VOC2007/JPEGImages/000003.jpg** 19,61,402,353,0**
本来ならば、上のようになって欲しいです。

気になる質問をクリップする

クリップした質問は、後からいつでもMYページで確認できます。

またクリップした質問に回答があった際、通知やメールを受け取ることができます。

バッドをするには、ログインかつ

こちらの条件を満たす必要があります。

guest

あなたの回答

tips

太字

斜体

打ち消し線

見出し

引用テキストの挿入

コードの挿入

リンクの挿入

リストの挿入

番号リストの挿入

表の挿入

水平線の挿入

プレビュー

まだ回答がついていません

会員登録して回答してみよう

アカウントをお持ちの方は

15分調べてもわからないことは
teratailで質問しよう!

ただいまの回答率
85.48%

質問をまとめることで
思考を整理して素早く解決

テンプレート機能で
簡単に質問をまとめる

質問する

関連した質問