用Python读取几十万行文本数据

yipeiwu_com6年前 (2020-03-06)Python基础

我在使用python读取几十万行的文件中的数据，并构造字典，列表等数据结构时，再访问字典，列表时，一般都会出现内存不够的问题，然后只能循环读取几百行或者一定数量的行数来循环操作。

keyword_list=[line.strip() for line in open("keywords.txt",'r')]
#f1=open("part_wiki_vec.txt",'r')
f1=open("wiki_vectors.txt")
f2=open("result.txt",'w')
i=0
content=f1.readlines()
while i<1150:
 for line in content[300*i:300*(i+1)]:
  line=line.strip().split(' ')
  if line[0] in keyword_list:
   wordvec=' '.join(line)
   print wordvec
   f2.write(wordvec)
  #print line
 i+=1

我是这样读取的

应该还有很多好的方法，比如多线程等等。

做此记录只为了学习

总结

以上就是这篇文章的全部内容了，希望本文的内容对大家的学习或者工作具有一定的参考学习价值，谢谢大家对【听图阁-专注于Python设计】的支持。如果你想了解更多相关内容请查看下面相关链接

返回列表

上一篇：Python字符转换

下一篇：PHP生成静态页面详解

Python实现的密码强度检测器示例

本文实例讲述了Python实现的密码强度检测器。分享给大家供大家参考，具体如下：密码强度密码强度如何量化呢？一个密码可以有以下几种类型：长度、大写字母、小写字母、数字以及特殊符号。...

Python Django的安装配置教程图文详解

Django 教程 Python下有许多款不同的 Web 框架。Django是重量级选手中最有代表性的一位。许多成功的网站和APP都基于Django。 Django是一个开放源代码的We...

python判断、获取一张图片主色调的2个实例

python判断图片主色调，单个颜色：复制代码代码如下:#!/usr/bin/env python# -*- coding: utf-8 -*- import colorsysfrom...

python筛选出两个文件中重复行的方法

本文实例为大家分享了python脚本筛选出两个文件中重复的行数，供大家参考，具体内容如下 ''' 查找A文件中，与B文件中内容不重复的内容 ''' #!usr/bin/python...

Python读取指定日期邮件的实例

背景：9月份有部分数据缺失，这部分数据在邮箱里，需要重新拉取，但是每天几百封邮件，总共有6、7万封邮件，使用stat()和retr(which)结合遍历很耗时基于如上背景，初始大致思...

宜配屋

用Python读取几十万行文本数据

相关文章

Python实现的密码强度检测器示例

Python Django的安装配置教程图文详解

python判断、获取一张图片主色调的2个实例

python筛选出两个文件中重复行的方法

Python读取指定日期邮件的实例

© YiPeiWu.com 【宜配屋】粤ICP备17031333号

Powered By Z-BlogPHP. Theme by TOYEAN.

宜配屋

用Python读取几十万行文本数据

相关文章

Python实现的密码强度检测器示例

Python Django的安装配置教程图文详解

python判断、获取一张图片主色调的2个实例

python筛选出两个文件中重复行的方法

Python读取指定日期邮件的实例

© YiPeiWu.com 【宜配屋】 粤ICP备17031333号 var _hmt = _hmt || [];(function() { var hm = document.createElement("script"); hm.src = "https://hm.baidu.com/hm.js?8aa60ae04b767b2af31903508928acc0"; var s = document.getElementsByTagName("script")[0]; s.parentNode.insertBefore(hm, s);})();

Powered By Z-BlogPHP. Theme by TOYEAN.

© YiPeiWu.com 【宜配屋】粤ICP备17031333号