Python基于read(size)方法读取超大文件
pyhon读取文件很方便,但是,如果文件很大,而且还是一行文件,那就蛋疼了. 不过还好有read(size)方法,这个方法就是每次读取size大小的数据到内存中
下面来个示例
def readlines(f, separator): ’’’ 读取大文件方法 :param f: 文件句柄 :param separator: 每一行的分隔符 :return: ’’’ buf = ’’ while True: while separator in buf: position = buf.index(separator) # 分隔符的位置 yield buf[:position] # 切片, 从开始位置到分隔符位置 buf = buf[position + len(separator):] # 再切片,将yield的数据切掉,保留剩下的数据 chunk = f.read(4096) # 一次读取4096的数据到buf中 if not chunk: # 如果没有读到数据 yield buf # 返回buf中的数据 break # 结束 buf += chunk # 如果read有数据 ,将read到的数据加入到buf中with open(’text.txt’,encoding=’utf-8’) as f: for line in readlines(f,’|||’): # 为什么readlines函数能够使用for循环遍历呢, 因为这个函数里面有yield关键字呀, 有它就是一个生成器函数 ...... print(line)
测试文件text.txt
fgshfsljflsjfls|||fyhdiyfdfhn|||fudofdb钦铁杆jdlfdl|||tedsthfdskfdk
打印结果
fgshfsljflsjflsfyhdiyfdfhnfudofdb钦铁杆jdlfdltedsthfdskfdk
以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持好吧啦网。
相关文章:
1. Intellij IDEA 2019 最新乱码问题及解决必杀技(必看篇)2. 关于HTML5的img标签3. java实现图形化界面计算器4. 《javascript设计模式》学习笔记三:Javascript面向对象程序设计单例模式原理与实现方法分析5. IntelliJ IDEA设置条件断点的方法步骤6. ASP.NET MVC获取多级类别组合下的产品7. ASP.NET MVC解决上传图片脏数据的方法8. 5个HTML5的常用本地存储方式详解与介绍9. ASP基础入门第七篇(ASP内建对象Response)10. 原生js XMLhttprequest请求onreadystatechange执行两次的解决
