Python读取多种格式的文本文件代码是什么
Admin 2022-07-22 群英技术资讯 446 次浏览
# example.md 1 2 3 4 5 6 7 8 9 >>> with open('example.md') as f: lines = f.readlines() >>> lines ['1 2 3\n', '4 5 6\n', '7 8 9\n'] # 我们发现每一行后面都会有一个回车符,我们使用strip()函数消除它 >>> lines = [i.strip() for i in lines] ['1 2 3', '4 5 6', '7 8 9'] # 每个元素是一个string,但是我们需要读取的是文本数据,所以需要将string转化为int(or float) >>> data = [] >>> for line in lines: data.append([int(i) for i in line.split(' ')]) [[1, 2, 3], [4, 5, 6], [7, 8, 9]] # 最后可以把list转化为ndarray形式 >>> data = np.array(data) >>> data array([[1, 2, 3], [4, 5, 6], [7, 8, 9]]) # 把上述步骤写到一个函数里 >>> def read_file(file): """ read .md or .txt format file :param file: .md or .txt format file :return: data """ with open('example.md') as f: lines = f.readlines() data = [] for line in lines: data.append([int(i) for i in line.strip().split(' ')]) return np.array(data) >>> data = read_file('example.md') >>> data array([[1, 2, 3], [4, 5, 6], [7, 8, 9]])
补充:python 各种获取md5的方式
#使用python 库 求MD5 import hashlib #求字符串MD5 md5 = hashlib.md5('字符串').hexdigest() #求文件md5 file = open('文件','rb') md5 = hashlib.md5(file.read())hexdigest() file.close() #python 利用mac/linex 终端命令求md5 def get_MD5(file_path): '''计算MD5''' files_md5 = os.popen('md5 %s' % file_path).read().strip() file_md5 = files_md5.replace('MD5 (%s) = ' % file_path, '') return file_md5 #如果是windows 系统 大概可以利用类似的方法 获取把 没做过测试 #当进行获取大量文件的md5的时候,建议使用 命令的方式获取,这样 运行速度会快很多
补充:Python中读取txt文件的三种可行办法
DataTest.txt中的文件内容,文件最后尽量不要留空行,否则有的时候会出现error
1,2,3
4,5,6
7,8,9
import csv data = [] with open('E:/DataTest.txt', 'rt') as csvfile: reader = csv.reader(csvfile, delimiter=',') for row in reader: data.append(row) #输出结果是列表 print(data)
输出结果:
[['1', '2', '3'], ['4', '5', '6'], ['7', '8', '9']]
import numpy as np data= np.loadtxt('E:/DataTest.txt',delimiter=',') #输出结果是numpy中数组格式 print(data)
输出结果:
[[1. 2. 3.]
[4. 5. 6.]
[7. 8. 9.]]
不过在后面添加如下语句都可以转换成DataFrame格式:
df = pd.DataFrame(data) df.to_csv() print(df)
输出结果:
0 1 2
0 1.0 2.0 3.0
1 4.0 5.0 6.0
2 7.0 8.0 9.0
import pandas as pd data= pd.read_csv('E:/DataTest.txt',names=['0', '1', '2']) #输出结果是numpy中数组格式 print(data)
输出结果:
0 1 2
0 1 2 3
1 4 5 6
2 7 8 9
免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:mmqy2019@163.com进行举报,并提供相关证据,查实之后,将立刻删除涉嫌侵权内容。
猜你喜欢
这篇文章主要介绍了Python如何对文件进行重命名,具有很好的参考价值,希望对大家有所帮助。如有错误或未考虑完全的地方,望不吝赐教
这篇文章主要介绍了用python来制作的一个守护类小游戏兔子猎人守护城堡,文中的示例代码介绍得很详细,感兴趣的小伙伴快来跟随小编一起学习学习吧
本章内容概要1.多层装饰器2.有参装饰器3.递归函数4.算法(二分法)本章内容详解1.多层装饰器1.1什么是多层装饰器多层装饰器是从下往上依次执行,需要注意的是,被装饰的函数名所指代的函数是一直被装饰器中的内层函数所取代。1.2语法糖的功能会自动将下面紧挨着的函数名...
这篇文章主要介绍了如何利用Python发送 10 万个 http 请求,下面我们讲利用Python写代码实现10 万个 url,对每个 url 发送 http 请求,并打印请求结果的状态码,需要的朋友可以参考一下
位运算就是直接对整数在内存中对应的二进制位进行操作,一般是将数字化为二进制数后进行操作。本文将利用Python语言实现位运算,感兴趣的可以了解一下
成为群英会员,开启智能安全云计算之旅
立即注册Copyright © QY Network Company Ltd. All Rights Reserved. 2003-2020 群英 版权所有
增值电信经营许可证 : B1.B2-20140078 粤ICP备09006778号 域名注册商资质 粤 D3.1-20240008