用 python 处理一个文本时,想要删除其中中某一行,常规的思路是先把文件读入内存,在内存中修改后再写入源文件。
但如果要处理一个很大的文本,比如GB级别的文本时,这种方法不仅需要占用很大内存,而且一次性读入内存时耗费时间,还有可能导致内存溢出。
所以,需要用另外一个思路去处理。
我们可以使用 open()
方法把需要修改的文件打开为两个文件,然后逐行读入内存,找到需要删除的行时,用后面的行逐一覆盖。实现方式见以下代码。
with open('file.txt', 'r')
as old_file:
as old_file:
with open('file.txt', 'r ') as
new_file:
new_file:
current_line
= 0
= 0
#
定位到需要删除的行
定位到需要删除的行
while
current_line < (del_line - 1):
current_line < (del_line - 1):
old_file.readline()
current_line
= 1
= 1
#
当前光标在被删除行的行首,记录该位置
当前光标在被删除行的行首,记录该位置
seek_point
= old_file.tell()
= old_file.tell()
#
设置光标位置
设置光标位置
new_file.seek(seek_point,
0)
0)
#
读需要删除的行,光标移到下一行行首
读需要删除的行,光标移到下一行行首
old_file.readline()
#
被删除行的下一行读给 next_line
被删除行的下一行读给 next_line
next_line
= old_file.readline()
= old_file.readline()
#
连续覆盖剩余行,后面所有行上移一行
连续覆盖剩余行,后面所有行上移一行
while
next_line:
next_line:
new_file.write(next_line)
next_line
= old_file.readline()
= old_file.readline()
#
写完最后一行后截断文件,因为删除操作,文件整体少了一行,原文件最后一行需要去掉
写完最后一行后截断文件,因为删除操作,文件整体少了一行,原文件最后一行需要去掉
new_file.truncate()
以上这篇python 删除大文件里的某一行(最有效率的方法)就是小编分享给大家的全部内容了,希望能给大家一个参考