展开菜单
首页 精品内容 本月促销 装机必备 Windows macOS软件 IOS软件 Android AI PDF教程 专题
全部分类

当前位置:

首页 > 编程开发 > Python读写txt文件的多种方法

Python读写txt文件的多种方法

Python内置功能可高效处理txt文件。写入时使用write等方法并注意编码与模式;读取时根据文件大小选择一次性、逐行或分块读取。推荐用with语句管理资源并明确指定编码。路径处理可借助os.path等模块,大文件或结构化数据需采用相应策略。

文本文件,也就是我们常说的.txt文件,可以说是数据世界里的“万金油”。从记录程序运行日志、存储配置文件,到在不同系统间交换原始数据,它无处不在。对于Python开发者来说,处理txt文件是一项基础且高频的操作。好消息是,Python内置的功能已经足够强大和易用,无需借助任何第三方库,就能轻松玩转文件的读写。今天,我们就来系统性地梳理一下这些方法,从最基础的打开关闭,到应对大文件、处理编码难题等高级技巧,一网打尽。

Python读写txt文件的多种方法

1. 写入txt文件

1.1 使用open()和write()方法

一切从open()函数开始。这是最直接、最经典的写入方式:

# 打开文件进行写入(如果文件不存在会自动创建)
with open('example.txt', 'w', encoding='utf-8') as file:
    file.write("这是第一行文本\n")
    file.write("这是第二行文本\n")
    file.write("这是第三行文本\n")

这里有几个关键点值得注意:

  • 'w':代表写入模式。注意,这个模式是“覆盖写”,如果目标文件已存在,其原有内容会被清空。
  • encoding='utf-8':强烈建议始终明确指定编码。UTF-8能很好地支持多语言字符,避免乱码问题。
  • with语句:这是最佳实践。它能确保文件在使用完毕后被正确关闭,即便程序中间发生了异常,也能自动处理,避免资源泄露。

1.2 写入多行内容

如果你已经有一个字符串列表,想一次性全部写入,writelines()方法会更高效。不过要记住,它不会自动帮你添加换行符,需要你自己在每行字符串末尾加上\n

lines = ["第一行\n", "第二行\n", "第三行\n"]

with open('multiline.txt', 'w', encoding='utf-8') as file:
    file.writelines(lines)

1.3 追加内容到文件

不想覆盖旧文件,只想在末尾添加新内容?把模式从'w'换成'a'(append)就行了。

with open('example.txt', 'a', encoding='utf-8') as file:
    file.write("这是追加的内容\n")

1.4 格式化写入

写入的内容常常是动态的。这时,结合Python强大的字符串格式化功能,就能轻松生成内容丰富的文本。

name = "张三"
age = 25

with open('formatted.txt', 'w', encoding='utf-8') as file:
    file.write(f"姓名: {name}, 年龄: {age}\n")
    # 或者使用format方法
    file.write("职业: {}\n".format("工程师"))

2. 读取txt文件

2.1 读取整个文件

对于小文件,最简单粗暴的方式就是一次性全部读入内存。read()方法会返回整个文件内容作为一个字符串。

with open('example.txt', 'r', encoding='utf-8') as file:
    content = file.read()
    print(content)

2.2 逐行读取

文件对象本身是可迭代的,这意味着你可以直接用一个for循环来逐行处理。这种方式内存友好,是处理文本文件的推荐做法之一。

with open('example.txt', 'r', encoding='utf-8') as file:
    for line in file:  # 迭代器方式逐行读取
        print(line.strip())  # strip()去除行尾换行符

2.3 读取所有行到列表

如果你需要随机访问文件的任意一行,或者需要对所有行进行多次处理,readlines()方法可以一次性将文件所有行读入一个列表。

with open('example.txt', 'r', encoding='utf-8') as file:
    lines = file.readlines()  # 返回包含所有行的列表
    for i, line in enumerate(lines, 1):
        print(f"第{i}行: {line.strip()}")

2.4 处理大文件

当面对动辄几个G的日志文件时,一次性读取整个文件显然不现实。这时,内存友好的读取策略就至关重要。

# 方法1:逐行读取(最常用,内存友好)
with open('large_file.txt', 'r', encoding='utf-8') as file:
    for line in file:
        process_line(line)  # 处理每一行的函数

# 方法2:分块读取(适用于非行结构或超大行)
chunk_size = 1024 * 1024  # 每次读取1MB
with open('large_file.txt', 'r', encoding='utf-8') as file:
    while True:
        chunk = file.read(chunk_size)
        if not chunk:  # 读取到文件末尾
            break
        process_chunk(chunk)  # 处理每个数据块的函数

3. 文件路径处理

3.1 相对路径与绝对路径

路径问题常常是跨平台开发的第一个绊脚石。Python提供了os.path模块来优雅地处理。

# 相对路径(相对于当前Python脚本运行的工作目录)
with open('./data/example.txt', 'r') as file:
    ...

# 绝对路径(推荐使用os.path处理,保证跨平台兼容性)
import os
file_path = os.path.join('C:', 'Users', 'username', 'Documents', 'example.txt')
with open(file_path, 'r') as file:
    ...

3.2 使用pathlib(Python 3.4+推荐)

如果你用的是Python 3.4或更高版本,那么pathlib模块提供了更面向对象、更直观的路径操作方式,可以说是现代Python文件路径处理的“标准答案”。

from pathlib import Path

# 创建Path对象
file_path = Path('data/example.txt')

# 检查文件是否存在
if file_path.exists():
    # 读取文件内容
    content = file_path.read_text(encoding='utf-8')
    print(content)
    
    # 写入文件
    file_path.write_text("新内容\n", encoding='utf-8')

4. 编码问题处理

4.1 常见编码问题

读写文本文件时,最令人头疼的莫过于编码错误。常见的报错包括:

  • UnicodeDecodeError:尝试用错误的编码(如用UTF-8去读一个GBK文件)解码文件时抛出。
  • UnicodeEncodeError:尝试将无法用指定编码表示的字符写入文件时抛出。

4.2 解决方案

对于来源不明的文件,一种稳妥的策略是尝试多种常见编码。

# 准备一个常见编码的列表进行尝试
encodings = ['utf-8', 'gbk', 'gb2312', 'big5', 'latin1']

def read_with_fallback(filename):
    for encoding in encodings:
        try:
            with open(filename, 'r', encoding=encoding) as file:
                return file.read()
        except UnicodeDecodeError:
            continue  # 尝试下一种编码
    raise UnicodeDecodeError(f"无法解码文件 {filename},尝试了所有常见编码")

# 写入时,如果实在无法处理特殊字符,可以忽略(慎用)
with open('output.txt', 'w', encoding='utf-8', errors='ignore') as file:
    file.write("包含特殊字符的文本")

5. 高级技巧

5.1 同时读写文件

使用'r+'模式可以打开一个文件同时进行读写。但要注意文件指针的位置,通常需要配合seek()方法来移动指针。

with open('example.txt', 'r+', encoding='utf-8') as file:
    content = file.read()  # 读取后,指针在文件末尾
    file.seek(0)  # 将指针移回文件开头
    file.write("新内容\n" + content)  # 在开头插入新内容

5.2 CSV格式文本处理

很多以.txt结尾的文件,实际上存储的是逗号分隔值(CSV)格式。虽然可以用字符串分割手动处理,但使用csv模块更专业、更安全。

import csv

# 写入CSV格式文本
with open('data.txt', 'w', newline='', encoding='utf-8') as file:
    writer = csv.writer(file)
    writer.writerow(['姓名', '年龄', '城市'])
    writer.writerow(['张三', 25, '北京'])
    writer.writerow(['李四', 30, '上海'])

# 读取CSV格式文本
with open('data.txt', 'r', encoding='utf-8') as file:
    reader = csv.reader(file)
    for row in reader:
        print(row)

5.3 JSON格式文本处理

对于结构化的配置或数据,JSON格式非常流行,有时也会用.txt扩展名保存。Python的json模块让读写变得异常简单。

import json

data = {
    "name": "张三",
    "age": 25,
    "skills": ["Python", "数据分析"]
}

# 写入JSON到文本文件
with open('data.txt', 'w', encoding='utf-8') as file:
    json.dump(data, file, ensure_ascii=False, indent=4)  # ensure_ascii=False确保中文正常显示

# 从文本文件读取JSON
with open('data.txt', 'r', encoding='utf-8') as file:
    loaded_data = json.load(file)
    print(loaded_data)

6. 最佳实践

掌握了各种方法后,遵循一些最佳实践能让你的代码更健壮、更专业:

  1. 始终使用with语句:这是保证文件资源被正确管理的铁律。
  2. 明确指定编码:尤其是涉及中文或其他非ASCII字符时,encoding='utf-8'应成为你的默认选择。
  3. 处理异常:使用try...except块来捕获文件不存在、无权限读写等异常,增强程序鲁棒性。
  4. 避免硬编码路径:使用os.path.join()pathlib.Path来构建路径,保证代码在不同操作系统上的可移植性。
  5. 大文件处理:养成习惯,对于可能的大文件,优先考虑逐行读取或分块读取的方案。
  6. 路径分隔符:不要再手动写\/了,让os.pathpathlib来操心。

完整示例

最后,我们用一个综合性的例子,把前面提到的路径创建、文件读写、异常预防等知识点串联起来:

from pathlib import Path

def process_file_operations():
    # 创建目录(如果不存在)
    data_dir = Path('data')
    data_dir.mkdir(exist_ok=True)
    
    # 写入文件
    file_path = data_dir / 'example.txt'
    file_path.write_text(
        "第一行文本\n"
        "第二行文本\n"
        "第三行文本\n",
        encoding='utf-8'
    )
    
    # 读取并处理文件
    if file_path.exists():
        content = file_path.read_text(encoding='utf-8')
        print("文件内容:")
        print(content)
        
        # 追加内容
        file_path.write_text(
            content + "\n这是追加的内容\n",
            encoding='utf-8'
        )
    else:
        print("文件不存在")

if __name__ == "__main__":
    process_file_operations()

结论

总的来说,Python为处理纯文本文件提供了一套既简单又强大的工具集。从最基础的open()read()write(),到应对复杂场景的路径管理、编码处理和大型文件读写,这些核心技能覆盖了日常开发中的绝大多数需求。对于简单的任务,内置函数足以胜任;而当项目变得复杂,需要更好的跨平台性和现代API时,pathlib模块的优势就显现出来了。记住,良好的习惯——比如总是明确编码、使用上下文管理器、考虑异常情况——是写出稳健、可维护代码的关键。把这些技巧融入你的工具箱,下次再面对文本数据时,你就能更加游刃有余了。

本文内容来源于互联网,如有侵权请联系删除。
作者最新文章
编程开发 Python
相关文章 更多
精品专题 更多
本月促销

正软商城本月促销专区,汇集办公、设计、安全、影音、系统工具及AI软件等正版软件优惠活动,提供限时折扣、特价授权和优惠购买信息,活动库存及价格以页面实时展示为准。

装机必备

正软商城装机必备专区,精选办公、浏览器、安全防护、影音播放、压缩解压、设计创作和系统工具等电脑常用正版软件,帮助用户快速完成新电脑软件配置。

Windows

正软商城Windows软件专区,汇集适用于Windows电脑的办公、设计、安全防护、影音播放、开发工具和系统优化软件,提供软件介绍、系统要求、正版授权及购买下载服务。

macOS软件

正软商城macOS软件专区,精选适用于Mac电脑的办公、设计、影音、效率、开发和系统工具,提供软件功能介绍、macOS兼容版本、正版授权及购买下载服务。

IOS软件

正软商城iOS软件专区,精选适用于iPhone和iPad的办公、学习、影音、设计、效率及AI应用,提供功能介绍、适用设备、系统要求和正版获取方式等信息。

AI

正软商城AI软件专区,汇集AI写作、AI绘画、AI视频、AI办公、AI编程、AI翻译、智能客服和数据分析等人工智能工具,提供功能介绍、适用平台、收费方式及正版购买信息。

PDF教程

正软商城PDF教程频道提供PDF编辑、转换、合并、拆分、压缩及格式处理方法,同时介绍常用PDF软件和工具的使用技巧。

Mac软件 更多
灵活计算器
灵活计算器

灵活计算器是一款笔记式算数应用,支持实时计算、动态关联和云端同步功能。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

赤友清理大师
赤友清理大师

赤友清理大师是一款为 Mac 设计的智能清理优化工具,可精准扫描垃圾、大文件、重复文件等,释放磁盘空间。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

极度公式
极度公式

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

图几
图几

图几是一款适用于 macOS 的截图、标注与美化工具,支持离线操作保障隐私。界面整理和高频系统操作被放到一起考虑,桌面或窗口内容一多时,管理起来会更省心。

密码键盘
密码键盘

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。

思源笔记
思源笔记

思源笔记是一款本地笔记软件,提供所见即所得的编辑方式,为长文写作带来顺滑的体验。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

Office 365 简体中文
Office 365 简体中文

一款文字处理软件,一种订阅式的跨平台办公软件,基于云平台提供多种服务,通过将 Excel 和 Outlook 等应用与 OneDrive 和 Microsoft Teams 等强大的云服务相结合,Office 365 可让任何人使用任何设备随时随地创建和共享内容。

WALTR PRO
WALTR PRO

WALTR是一款电脑至iOS文件传输转换工具,操作简单,快速实现文件识别与传送。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

CodeExpander
CodeExpander

CodeExpander 是一款快捷短语输入增强工具,通过键入缩写自动展开为自定义文段,提升工作效率。任务管理和过程控制会更完整,持续下载、批量同步或需要稳定传输流程的场景会更适合它。

Mountain Duck
Mountain Duck

Mountain Duck 是一款能将多个网盘挂载到本地的工具,像本地磁盘一样使用网盘。清理链路的完整性会更好一些,做应用卸载、残留处理和空间整理时,通常能少走很多手动排查步骤。

Menuist
Menuist

Menuist 是一款面向 macOS 的 Finder 右键菜单增强工具,主要用来补充新建文件、快捷导航等常用操作,让日常文件管理和访问路径时更高效、更顺手。

Mole
Mole

Mole 是一款专为 Mac 设计的深度清理优化工具,涵盖缓存清理、应用管理及实时状态监控等功能。清理链路的完整性会更好一些,做应用卸载、残留处理和空间整理时,通常能少走很多手动排查步骤。

WINDOWS 更多
Windows 10
Windows 10

Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

极度公式
极度公式

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

密码键盘
密码键盘

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。

思源笔记
思源笔记

思源笔记是一款本地笔记软件,提供所见即所得的编辑方式,为长文写作带来顺滑的体验。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

傲梅轻松备份
傲梅轻松备份

傲梅轻松备份是一款专业易用的数据备份软件,为重要数据提供安全保障。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。

Office 365 简体中文
Office 365 简体中文

一款文字处理软件,一种订阅式的跨平台办公软件,基于云平台提供多种服务,通过将 Excel 和 Outlook 等应用与 OneDrive 和 Microsoft Teams 等强大的云服务相结合,Office 365 可让任何人使用任何设备随时随地创建和共享内容。

Wise Folder Hider Pro
Wise Folder Hider Pro

Wise Folder Hider Pro 是一款专业级文件和文件夹隐藏加密软件,为私密数据添加多重保护。高频操作更强调就近处理,浏览、整理和跨目录移动文件时,来回切换和重复点击都会少很多。

WALTR PRO
WALTR PRO

WALTR是一款电脑至iOS文件传输转换工具,操作简单,快速实现文件识别与传送。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

CodeExpander
CodeExpander

CodeExpander 是一款快捷短语输入增强工具,通过键入缩写自动展开为自定义文段,提升工作效率。任务管理和过程控制会更完整,持续下载、批量同步或需要稳定传输流程的场景会更适合它。

PinStack
PinStack

PinStack是一款轻量级的Windows平台剪贴板管理工具,优化您的剪贴板使用体验。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

Mountain Duck
Mountain Duck

Mountain Duck 是一款能将多个网盘挂载到本地的工具,像本地磁盘一样使用网盘。清理链路的完整性会更好一些,做应用卸载、残留处理和空间整理时,通常能少走很多手动排查步骤。

Seer
Seer

Seer是一款在Win平台下的空格键功能增强效率工具,只需轻敲空格键,就能预览几乎任何格式的文件。它更适合把零散的小功能集中起来使用,处理高频琐碎任务时会更省事。