发布于2026-05-21 阅读(0)
扫一扫,手机访问
文本文件,也就是我们常说的.txt文件,可以说是数据世界里的“万金油”。从记录程序运行日志、存储配置文件,到在不同系统间交换原始数据,它无处不在。对于Python开发者来说,处理txt文件是一项基础且高频的操作。好消息是,Python内置的功能已经足够强大和易用,无需借助任何第三方库,就能轻松玩转文件的读写。今天,我们就来系统性地梳理一下这些方法,从最基础的打开关闭,到应对大文件、处理编码难题等高级技巧,一网打尽。

一切从open()函数开始。这是最直接、最经典的写入方式:
# 打开文件进行写入(如果文件不存在会自动创建)
with open('example.txt', 'w', encoding='utf-8') as file:
file.write("这是第一行文本\n")
file.write("这是第二行文本\n")
file.write("这是第三行文本\n")
这里有几个关键点值得注意:
'w':代表写入模式。注意,这个模式是“覆盖写”,如果目标文件已存在,其原有内容会被清空。encoding='utf-8':强烈建议始终明确指定编码。UTF-8能很好地支持多语言字符,避免乱码问题。with语句:这是最佳实践。它能确保文件在使用完毕后被正确关闭,即便程序中间发生了异常,也能自动处理,避免资源泄露。如果你已经有一个字符串列表,想一次性全部写入,writelines()方法会更高效。不过要记住,它不会自动帮你添加换行符,需要你自己在每行字符串末尾加上\n。
lines = ["第一行\n", "第二行\n", "第三行\n"]
with open('multiline.txt', 'w', encoding='utf-8') as file:
file.writelines(lines)
不想覆盖旧文件,只想在末尾添加新内容?把模式从'w'换成'a'(append)就行了。
with open('example.txt', 'a', encoding='utf-8') as file:
file.write("这是追加的内容\n")
写入的内容常常是动态的。这时,结合Python强大的字符串格式化功能,就能轻松生成内容丰富的文本。
name = "张三"
age = 25
with open('formatted.txt', 'w', encoding='utf-8') as file:
file.write(f"姓名: {name}, 年龄: {age}\n")
# 或者使用format方法
file.write("职业: {}\n".format("工程师"))
对于小文件,最简单粗暴的方式就是一次性全部读入内存。read()方法会返回整个文件内容作为一个字符串。
with open('example.txt', 'r', encoding='utf-8') as file:
content = file.read()
print(content)
文件对象本身是可迭代的,这意味着你可以直接用一个for循环来逐行处理。这种方式内存友好,是处理文本文件的推荐做法之一。
with open('example.txt', 'r', encoding='utf-8') as file:
for line in file: # 迭代器方式逐行读取
print(line.strip()) # strip()去除行尾换行符
如果你需要随机访问文件的任意一行,或者需要对所有行进行多次处理,readlines()方法可以一次性将文件所有行读入一个列表。
with open('example.txt', 'r', encoding='utf-8') as file:
lines = file.readlines() # 返回包含所有行的列表
for i, line in enumerate(lines, 1):
print(f"第{i}行: {line.strip()}")
当面对动辄几个G的日志文件时,一次性读取整个文件显然不现实。这时,内存友好的读取策略就至关重要。
# 方法1:逐行读取(最常用,内存友好)
with open('large_file.txt', 'r', encoding='utf-8') as file:
for line in file:
process_line(line) # 处理每一行的函数
# 方法2:分块读取(适用于非行结构或超大行)
chunk_size = 1024 * 1024 # 每次读取1MB
with open('large_file.txt', 'r', encoding='utf-8') as file:
while True:
chunk = file.read(chunk_size)
if not chunk: # 读取到文件末尾
break
process_chunk(chunk) # 处理每个数据块的函数
路径问题常常是跨平台开发的第一个绊脚石。Python提供了os.path模块来优雅地处理。
# 相对路径(相对于当前Python脚本运行的工作目录)
with open('./data/example.txt', 'r') as file:
...
# 绝对路径(推荐使用os.path处理,保证跨平台兼容性)
import os
file_path = os.path.join('C:', 'Users', 'username', 'Documents', 'example.txt')
with open(file_path, 'r') as file:
...
如果你用的是Python 3.4或更高版本,那么pathlib模块提供了更面向对象、更直观的路径操作方式,可以说是现代Python文件路径处理的“标准答案”。
from pathlib import Path
# 创建Path对象
file_path = Path('data/example.txt')
# 检查文件是否存在
if file_path.exists():
# 读取文件内容
content = file_path.read_text(encoding='utf-8')
print(content)
# 写入文件
file_path.write_text("新内容\n", encoding='utf-8')
读写文本文件时,最令人头疼的莫过于编码错误。常见的报错包括:
UnicodeDecodeError:尝试用错误的编码(如用UTF-8去读一个GBK文件)解码文件时抛出。UnicodeEncodeError:尝试将无法用指定编码表示的字符写入文件时抛出。对于来源不明的文件,一种稳妥的策略是尝试多种常见编码。
# 准备一个常见编码的列表进行尝试
encodings = ['utf-8', 'gbk', 'gb2312', 'big5', 'latin1']
def read_with_fallback(filename):
for encoding in encodings:
try:
with open(filename, 'r', encoding=encoding) as file:
return file.read()
except UnicodeDecodeError:
continue # 尝试下一种编码
raise UnicodeDecodeError(f"无法解码文件 {filename},尝试了所有常见编码")
# 写入时,如果实在无法处理特殊字符,可以忽略(慎用)
with open('output.txt', 'w', encoding='utf-8', errors='ignore') as file:
file.write("包含特殊字符的文本")
使用'r+'模式可以打开一个文件同时进行读写。但要注意文件指针的位置,通常需要配合seek()方法来移动指针。
with open('example.txt', 'r+', encoding='utf-8') as file:
content = file.read() # 读取后,指针在文件末尾
file.seek(0) # 将指针移回文件开头
file.write("新内容\n" + content) # 在开头插入新内容
很多以.txt结尾的文件,实际上存储的是逗号分隔值(CSV)格式。虽然可以用字符串分割手动处理,但使用csv模块更专业、更安全。
import csv
# 写入CSV格式文本
with open('data.txt', 'w', newline='', encoding='utf-8') as file:
writer = csv.writer(file)
writer.writerow(['姓名', '年龄', '城市'])
writer.writerow(['张三', 25, '北京'])
writer.writerow(['李四', 30, '上海'])
# 读取CSV格式文本
with open('data.txt', 'r', encoding='utf-8') as file:
reader = csv.reader(file)
for row in reader:
print(row)
对于结构化的配置或数据,JSON格式非常流行,有时也会用.txt扩展名保存。Python的json模块让读写变得异常简单。
import json
data = {
"name": "张三",
"age": 25,
"skills": ["Python", "数据分析"]
}
# 写入JSON到文本文件
with open('data.txt', 'w', encoding='utf-8') as file:
json.dump(data, file, ensure_ascii=False, indent=4) # ensure_ascii=False确保中文正常显示
# 从文本文件读取JSON
with open('data.txt', 'r', encoding='utf-8') as file:
loaded_data = json.load(file)
print(loaded_data)
掌握了各种方法后,遵循一些最佳实践能让你的代码更健壮、更专业:
with语句:这是保证文件资源被正确管理的铁律。encoding='utf-8'应成为你的默认选择。try...except块来捕获文件不存在、无权限读写等异常,增强程序鲁棒性。os.path.join()或pathlib.Path来构建路径,保证代码在不同操作系统上的可移植性。\或/了,让os.path或pathlib来操心。最后,我们用一个综合性的例子,把前面提到的路径创建、文件读写、异常预防等知识点串联起来:
from pathlib import Path
def process_file_operations():
# 创建目录(如果不存在)
data_dir = Path('data')
data_dir.mkdir(exist_ok=True)
# 写入文件
file_path = data_dir / 'example.txt'
file_path.write_text(
"第一行文本\n"
"第二行文本\n"
"第三行文本\n",
encoding='utf-8'
)
# 读取并处理文件
if file_path.exists():
content = file_path.read_text(encoding='utf-8')
print("文件内容:")
print(content)
# 追加内容
file_path.write_text(
content + "\n这是追加的内容\n",
encoding='utf-8'
)
else:
print("文件不存在")
if __name__ == "__main__":
process_file_operations()
总的来说,Python为处理纯文本文件提供了一套既简单又强大的工具集。从最基础的open()、read()、write(),到应对复杂场景的路径管理、编码处理和大型文件读写,这些核心技能覆盖了日常开发中的绝大多数需求。对于简单的任务,内置函数足以胜任;而当项目变得复杂,需要更好的跨平台性和现代API时,pathlib模块的优势就显现出来了。记住,良好的习惯——比如总是明确编码、使用上下文管理器、考虑异常情况——是写出稳健、可维护代码的关键。把这些技巧融入你的工具箱,下次再面对文本数据时,你就能更加游刃有余了。
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
7
8