App下載

Python如何讀取文本文件?

猿友 2021-08-04 10:27:35 瀏覽數(shù) (3990)
反饋

在學習機器學習等比較深層面的知識之前我們需要先學習python讀取文件,其中python讀取md文件又是比較重要的(很多程序員喜歡使用Markdown來做記錄)。今天我們就來介紹一下python怎么讀取md文件吧。

看代碼吧~

# example.md
1 2 3
4 5 6
7 8 9
 
>>> with open('example.md') as f:
        lines = f.readlines()
>>> lines
['1 2 3
', '4 5 6
', '7 8 9
']
# 我們發(fā)現(xiàn)每一行后面都會有一個回車符,我們使用strip()函數(shù)消除它
>>> lines = [i.strip() for i in lines]
['1 2 3', '4 5 6', '7 8 9']
# 每個元素是一個string,但是我們需要讀取的是文本數(shù)據(jù),所以需要將string轉(zhuǎn)化為int(or float)
>>> data = []
>>> for line in lines:
        data.append([int(i) for i in line.split(' ')])
[[1, 2, 3], [4, 5, 6], [7, 8, 9]]
# 最后可以把list轉(zhuǎn)化為ndarray形式
>>> data = np.array(data)
>>> data
array([[1, 2, 3],
       [4, 5, 6],
       [7, 8, 9]])
# 把上述步驟寫到一個函數(shù)里
>>> def read_file(file):
        """
        read .md or .txt format file
        :param file: .md or .txt format file
        :return: data
        """
        with open('example.md') as f:
            lines = f.readlines()
        data = []
        for line in lines:
            data.append([int(i) for i in line.strip().split(' ')])
        return np.array(data)
>>> data = read_file('example.md')
>>> data
array([[1, 2, 3],
       [4, 5, 6],
       [7, 8, 9]])

補充:python 各種獲取md5的方式

看代碼吧~

#使用python 庫  求MD5
import hashlib
#求字符串MD5
md5 = hashlib.md5('字符串').hexdigest()
#求文件md5
file = open('文件','rb')
md5 = hashlib.md5(file.read())hexdigest()
file.close()

#python 利用mac/linex 終端命令求md5

def get_MD5(file_path):
    '''計算MD5'''
    files_md5 = os.popen('md5 %s' % file_path).read().strip()
    file_md5 = files_md5.replace('MD5 (%s) = ' % file_path, '')
    return file_md5

#如果是windows 系統(tǒng) 大概可以利用類似的方法 獲取把  沒做過測試

#當進行獲取大量文件的md5的時候,建議使用 命令的方式獲取,這樣 運行速度會快很多


補充:Python中讀取txt文件的三種可行辦法

DataTest.txt中的文件內(nèi)容,文件最后盡量不要留空行,否則有的時候會出現(xiàn)error

1,2,3
4,5,6
7,8,9

第一種方式:使用 csv.reader()讀取txt文件

import csv
data = []
with open('E:/DataTest.txt', 'rt') as csvfile:
    reader = csv.reader(csvfile, delimiter=',')
    for row in reader:
        data.append(row)
    #輸出結(jié)果是列表
    print(data)

輸出結(jié)果:

[['1', '2', '3'], ['4', '5', '6'], ['7', '8', '9']]

第二種方式:使用numpy.loadtxt()讀取txt文件

import numpy as np 
data= np.loadtxt('E:/DataTest.txt',delimiter=',') 
#輸出結(jié)果是numpy中數(shù)組格式
print(data)

輸出結(jié)果:

[[1. 2. 3.]
[4. 5. 6.]
[7. 8. 9.]]

不過在后面添加如下語句都可以轉(zhuǎn)換成DataFrame格式:

df = pd.DataFrame(data)  
df.to_csv()
print(df)

輸出結(jié)果:

0 1 2
0 1.0 2.0 3.0
1 4.0 5.0 6.0
2 7.0 8.0 9.0

第三種方式:使用pandas.red_csv()讀取txt文件

import pandas as pd  
data= pd.read_csv('E:/DataTest.txt',names=['0', '1', '2'])
#輸出結(jié)果是numpy中數(shù)組格式
print(data)

輸出結(jié)果:

0 1 2
0 1 2 3
1 4 5 6
2 7 8 9

以上就是python讀取md文件的全部內(nèi)容,希望能給大家一個參考,也希望大家多多支持W3Cschool


0 人點贊