最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Python實(shí)現(xiàn)常見(jiàn)數(shù)據(jù)格式轉(zhuǎn)換的方法詳解

 更新時(shí)間:2022年09月28日 16:18:20   作者:knighthood2001  
這篇文章主要為大家詳細(xì)介紹了Python實(shí)現(xiàn)常見(jiàn)數(shù)據(jù)格式轉(zhuǎn)換的方法,主要是xml_to_csv和csv_to_tfrecord,感興趣的小伙伴可以了解一下

xml_to_csv

代碼如下:

import os
import glob
import pandas as pd
import xml.etree.ElementTree as ET

def xml_to_csv(path):
    xml_list = []
    for xml_file in glob.glob(path + '/*.xml'):
        tree = ET.parse(xml_file)
        root = tree.getroot()
        for member in root.findall('object'):
            value = (root.find('filename').text,
                     int(root.find('size')[0].text),
                     int(root.find('size')[1].text),
                     member[0].text,
                     int(member[4][0].text),
                     int(member[4][1].text),
                     int(member[4][2].text),
                     int(member[4][3].text)
                     )
            xml_list.append(value)
    column_name = ['filename', 'width', 'height', 'class', 'xmin', 'ymin', 'xmax', 'ymax']
    xml_df = pd.DataFrame(xml_list, columns=column_name)
    return xml_df

def main():
    print(os.getcwd())
    # 結(jié)果為E:\python_code\crack\models_trainning
    # ToDo 根據(jù)自己實(shí)際目錄修改
    # image_path = os.path.join(os.getcwd(), 'dataset/crack/test')  # 根據(jù)自己實(shí)際目錄修改,或者使用下面的路徑
    image_path = 'E:/python_code/crack/models_trainning/dataset/crack/test'
    print(image_path)
    xml_df = xml_to_csv(image_path)
    xml_df.to_csv('./dataset/crack/train/crack_test.csv', index=None)  # 根據(jù)自己實(shí)際目錄修改
    print('Successfully converted xml to csv.')

main()

這里需要注意的是,這里的話我們只需要修改路徑,就不需要在終端運(yùn)行(每次需要先去該目錄下)了,對(duì)于不玩linux的同學(xué)比較友好。

print(os.getcwd())

結(jié)果為E:\python_code\crack\models_trainning

image_path = os.path.join(os.getcwd(), 'dataset/crack/test')
image_path = 'E:/python_code/crack/models_trainning/dataset/crack/test'

以上兩種圖片路徑方法都可以,一個(gè)采用的是os.path.join()進(jìn)行路徑拼接。

xml_df.to_csv('./dataset/crack/train/crack_test.csv', index=None) 

保存為csv的路徑可以隨意寫

結(jié)果如下

csv_to_tfrecord

# -*- coding: utf-8-*-
from __future__ import division
from __future__ import print_function
from __future__ import absolute_import

import os
import io
import pandas as pd
import tensorflow as tf
import tensorflow.compat.v1 as tf
from PIL import Image
from research.object_detection.utils import dataset_util
from collections import namedtuple, OrderedDict

flags = tf.app.flags
flags.DEFINE_string('csv_input', '', 'Path to the CSV input')
flags.DEFINE_string('output_path', '', 'Path to output TFRecord')
FLAGS = flags.FLAGS


# 將分類名稱轉(zhuǎn)成ID號(hào)
def class_text_to_int(row_label):
    if row_label == 'crack':
        return 1
    # elif row_label == 'car':
    #     return 2
    # elif row_label == 'person':
    #     return 3
    # elif row_label == 'kite':
    #     return 4
    else:
        print('NONE: ' + row_label)
        # None


def split(df, group):
    data = namedtuple('data', ['filename', 'object'])
    gb = df.groupby(group)
    return [data(filename, gb.get_group(x)) for filename, x in zip(gb.groups.keys(), gb.groups)]


def create_tf_example(group, path):
    print(os.path.join(path, '{}'.format(group.filename)))
    with tf.gfile.GFile(os.path.join(path, '{}'.format(group.filename)), 'rb') as fid:
        encoded_jpg = fid.read()
    encoded_jpg_io = io.BytesIO(encoded_jpg)
    image = Image.open(encoded_jpg_io)
    width, height = image.size

    filename = (group.filename + '.jpg').encode('utf8')
    image_format = b'jpg'
    xmins = []
    xmaxs = []
    ymins = []
    ymaxs = []
    classes_text = []
    classes = []

    for index, row in group.object.iterrows():
        xmins.append(row['xmin'] / width)
        xmaxs.append(row['xmax'] / width)
        ymins.append(row['ymin'] / height)
        ymaxs.append(row['ymax'] / height)
        classes_text.append(row['class'].encode('utf8'))
        classes.append(class_text_to_int(row['class']))

    tf_example = tf.train.Example(features=tf.train.Features(feature={
        'image/height': dataset_util.int64_feature(height),
        'image/width': dataset_util.int64_feature(width),
        'image/filename': dataset_util.bytes_feature(filename),
        'image/source_id': dataset_util.bytes_feature(filename),
        'image/encoded': dataset_util.bytes_feature(encoded_jpg),
        'image/format': dataset_util.bytes_feature(image_format),
        'image/object/bbox/xmin': dataset_util.float_list_feature(xmins),
        'image/object/bbox/xmax': dataset_util.float_list_feature(xmaxs),
        'image/object/bbox/ymin': dataset_util.float_list_feature(ymins),
        'image/object/bbox/ymax': dataset_util.float_list_feature(ymaxs),
        'image/object/class/text': dataset_util.bytes_list_feature(classes_text),
        'image/object/class/label': dataset_util.int64_list_feature(classes),
    }))
    return tf_example


def main(csv_input, output_path, imgPath):
    writer = tf.python_io.TFRecordWriter(output_path)
    path = imgPath
    examples = pd.read_csv(csv_input)
    grouped = split(examples, 'filename')
    for group in grouped:
        tf_example = create_tf_example(group, path)
        writer.write(tf_example.SerializeToString())

    writer.close()
    print('Successfully created the TFRecords: {}'.format(output_path))


if __name__ == '__main__':
    # ToDo 修改相應(yīng)目錄
    imgPath = r'E:\python_code\crack\models_trainning\dataset\crack\test'
    output_path = 'dataset/crack/test/crack_test.record'
    csv_input = 'dataset/crack/test/crack_test.csv'
    main(csv_input, output_path, imgPath)

如xml_to_csv類似,只要把路徑改好即可

imgPath是圖片所在文件夾路徑

output_path是tfrecord生成的路徑

csv_iinput是使用的csv的路徑

當(dāng)然,你可能會(huì)出現(xiàn)下面報(bào)錯(cuò),起初筆者還以為是編碼問(wèn)題,可是始終未能解決。后來(lái)仔細(xì)檢查發(fā)現(xiàn),是自己路徑搞錯(cuò)了,因此大家出現(xiàn)這個(gè)錯(cuò)誤的時(shí)候,檢查一下路徑先。

到此這篇關(guān)于Python實(shí)現(xiàn)常見(jiàn)數(shù)據(jù)格式轉(zhuǎn)換的方法詳解的文章就介紹到這了,更多相關(guān)Python數(shù)據(jù)格式轉(zhuǎn)換內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

相關(guān)文章

  • Python多版本安裝與Jupyter Lab使用方式

    Python多版本安裝與Jupyter Lab使用方式

    這篇文章主要介紹了Python多版本安裝與Jupyter Lab使用方式,具有很好的參考價(jià)值,希望對(duì)大家有所幫助,如有錯(cuò)誤或未考慮完全的地方,望不吝賜教
    2024-01-01
  • python二叉樹(shù)類以及其4種遍歷方法實(shí)例

    python二叉樹(shù)類以及其4種遍歷方法實(shí)例

    二叉樹(shù)是一種特殊的樹(shù),最直觀地體現(xiàn)于它的每個(gè)節(jié)點(diǎn)至多有兩個(gè)子節(jié)點(diǎn),二叉樹(shù)是非常實(shí)用的一種數(shù)據(jù)結(jié)構(gòu),常常用于實(shí)現(xiàn)二叉查找樹(shù)及二叉堆等,下面這篇文章主要給大家介紹了關(guān)于python二叉樹(shù)類以及其4種遍歷方法的相關(guān)資料,需要的朋友可以參考下
    2022-05-05
  • ?Python?中?logging?模塊使用詳情

    ?Python?中?logging?模塊使用詳情

    這篇文章主要介紹了?Python?中?logging?模塊使用,在我們寫程序時(shí),可以借助?logging?模塊的輸出信息來(lái)調(diào)試代碼,下文章關(guān)于?logging?模塊的使用相關(guān)內(nèi)容,需要的小伙伴可以參考一下
    2022-03-03
  • Python 通過(guò)正則表達(dá)式快速獲取電影的下載地址

    Python 通過(guò)正則表達(dá)式快速獲取電影的下載地址

    這篇文章主要介紹了Python 通過(guò)正則表達(dá)式快速獲取電影的下載地址,文中通過(guò)示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友們下面隨著小編來(lái)一起學(xué)習(xí)學(xué)習(xí)吧
    2020-08-08
  • Python整數(shù)對(duì)象實(shí)現(xiàn)原理詳解

    Python整數(shù)對(duì)象實(shí)現(xiàn)原理詳解

    這篇文章主要介紹了Python整數(shù)對(duì)象實(shí)現(xiàn)原理詳解,文中通過(guò)示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友可以參考下
    2019-07-07
  • Pandas 數(shù)據(jù)框增、刪、改、查、去重、抽樣基本操作方法

    Pandas 數(shù)據(jù)框增、刪、改、查、去重、抽樣基本操作方法

    下面小編就為大家分享一篇Pandas 數(shù)據(jù)框增、刪、改、查、去重、抽樣基本操作方法,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過(guò)來(lái)看看吧
    2018-04-04
  • 使用Python去除字符串中某個(gè)字符的多種實(shí)現(xiàn)方式比較

    使用Python去除字符串中某個(gè)字符的多種實(shí)現(xiàn)方式比較

    python中字符串是不可變的,所以無(wú)法直接刪除字符串之間的特定字符,下面這篇文章主要給大家介紹了關(guān)于使用Python去除字符串中某個(gè)字符的多種實(shí)現(xiàn)方式比較的相關(guān)資料,需要的朋友可以參考下
    2022-06-06
  • Django+python服務(wù)器部署與環(huán)境部署教程詳解

    Django+python服務(wù)器部署與環(huán)境部署教程詳解

    這篇文章主要介紹了Django+python服務(wù)器部署與環(huán)境部署教程,本文通過(guò)圖文并茂的形式給大家介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或工作具有一定的參考借鑒價(jià)值,需要的朋友可以參考下
    2020-03-03
  • python3處理word文檔實(shí)例分析

    python3處理word文檔實(shí)例分析

    在本篇文章里小編給大家分享了一篇關(guān)于python3處理word文檔實(shí)例分析內(nèi)容,有興趣的朋友們可以參考下。
    2020-12-12
  • Python爬蟲分析微博熱搜關(guān)鍵詞的實(shí)現(xiàn)代碼

    Python爬蟲分析微博熱搜關(guān)鍵詞的實(shí)現(xiàn)代碼

    這篇文章主要介紹了Python爬蟲分析微博熱搜關(guān)鍵詞的實(shí)現(xiàn)代碼,本文給大家介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或工作具有一定的參考借鑒價(jià)值,需要的朋友可以參考下
    2021-02-02

最新評(píng)論

龙陵县| 文登市| 烟台市| 柳河县| 长岛县| 凤山县| 贵南县| 佳木斯市| 韶关市| 宜宾县| 塔城市| 内丘县| 杨浦区| 应用必备| 建昌县| 涞源县| 舞钢市| 六盘水市| 郁南县| 沈丘县| 勃利县| 定远县| 西城区| 陆河县| 宁化县| 辽阳市| 临西县| 正安县| 昌邑市| 买车| 临澧县| 武清区| 永城市| 新竹市| 晋江市| 香格里拉县| 江源县| 江川县| 大连市| 昌都县| 车险|