Python常见文件操作

核心文件操作概览

1. 基础文件打开与关闭

复制代码
# 基本语法
file = open('filename.txt', 'r', encoding='utf-8')
# ... 执行操作 ...
file.close()

推荐做法:使用 with 语句(上下文管理器)

复制代码
# 自动处理文件关闭,即使发生异常也能保证资源释放
with open('filename.txt', 'r', encoding='utf-8') as file:
    content = file.read()

常见打开模式:

模式 描述
'r' 只读(默认)
'w' 只写(会覆盖已有文件,文件不存在则创建)
'a' 追加(在文件末尾写入,文件不存在则创建)
'r+' 读写(文件必须存在)
'w+' 读写(会覆盖已有文件)
'a+' 读写追加
'b' 二进制模式(如 'rb', 'wb')

2. 读取文件内容

复制代码
with open('file.txt', 'r', encoding='utf-8') as f:
    # 读取全部内容
    content = f.read()
    
    # 读取一行
    line = f.readline()
    
    # 读取所有行,返回列表
    lines = f.readlines()
    
    # 逐行遍历(推荐,内存友好)
    for line in f:
        print(line.strip())  # strip() 去除换行符

3. 写入文件内容

复制代码
# 覆盖写入
with open('file.txt', 'w', encoding='utf-8') as f:
    f.write('Hello, World!\n')
    f.write('第二行内容')

# 追加写入
with open('file.txt', 'a', encoding='utf-8') as f:
    f.write('\n这是追加的内容')

# 写入多行(列表)
lines = ['第一行\n', '第二行\n', '第三行\n']
with open('file.txt', 'w', encoding='utf-8') as f:
    f.writelines(lines)

4. 文件指针操作

复制代码
with open('file.txt', 'r', encoding='utf-8') as f:
    # 获取当前位置
    print(f.tell())  # 输出:0
    
    # 移动指针
    f.seek(10)       # 移动到第 10 个字节
    content = f.read(5)  # 读取 5 个字符

5. 文件与目录操作(os 和 pathlib 模块)

传统 os 模块:

复制代码
import os

# 检查文件是否存在
if os.path.exists('file.txt'):
    print('文件存在')

# 获取文件大小
size = os.path.getsize('file.txt')

# 创建目录
os.makedirs('new_folder', exist_ok=True)

# 删除文件
os.remove('file.txt')

# 重命名文件
os.rename('old.txt', 'new.txt')

# 遍历目录
for filename in os.listdir('.'):
    print(filename)

现代 pathlib 模块(推荐):

复制代码
from pathlib import Path

# 创建 Path 对象
file_path = Path('file.txt')

# 检查文件是否存在
if file_path.exists():
    print('文件存在')

# 读取文件
content = file_path.read_text(encoding='utf-8')

# 写入文件
file_path.write_text('新内容', encoding='utf-8')

# 创建目录
Path('new_folder').mkdir(parents=True, exist_ok=True)

# 获取文件信息
print(file_path.stat().st_size)  # 文件大小

6. 常见实战场景

CSV 文件处理:

复制代码
import csv

# 读取 CSV
with open('data.csv', 'r', encoding='utf-8') as f:
    reader = csv.reader(f)
    for row in reader:
        print(row)

# 写入 CSV
with open('data.csv', 'w', encoding='utf-8', newline='') as f:
    writer = csv.writer(f)
    writer.writerow(['姓名', '年龄', '城市'])
    writer.writerow(['张三', 25, '北京'])

JSON 文件处理:

复制代码
import json

# 读取 JSON
with open('data.json', 'r', encoding='utf-8') as f:
    data = json.load(f)

# 写入 JSON
with open('data.json', 'w', encoding='utf-8') as f:
    json.dump(data, f, ensure_ascii=False, indent=2)

异常处理最佳实践:

复制代码
try:
    with open('file.txt', 'r', encoding='utf-8') as f:
        content = f.read()
except FileNotFoundError:
    print('文件不存在')
except PermissionError:
    print('没有权限访问文件')
except UnicodeDecodeError:
    print('文件编码格式错误')

关键要点总结

  1. 始终使用 with 语句:避免忘记关闭文件导致资源泄漏
  2. 明确指定编码 :建议统一使用 encoding='utf-8'
  3. 大文件用逐行读取:避免内存溢出
  4. 优先使用 pathlib:面向对象的路径操作更直观
  5. 做好异常处理:文件操作容易出现各种异常
相关推荐
星恒随风7 分钟前
Linux基础IO万字详解:从文件描述符fd到重定向、FILE缓冲机制及MiniShell升级
linux·运维·笔记·学习·状态模式
l1t9 分钟前
DeepSeek总结的PostgreSQL因选择而宽松,因偶然而永久
数据库·postgresql
东来也_八门13 分钟前
我用麦当劳开放的 MCP,把那个最冷门的营养接口做成了真实配餐求解器
python
Nturmoils15 分钟前
数据同步中断后,KFS 怎么把链路接回来
数据库
AI日报派送佬20 分钟前
Ultralytics YOLO 模型训练技巧与最佳实践
人工智能·python·深度学习·yolo·机器学习·计算机视觉
yunwei3722 分钟前
eBPF 入门开发实践教程一:Hello World,基本框架和开发流程
linux·后端·性能优化
小雪崩25 分钟前
嵌入式学习 day65:Linux驱动进阶——pinctrl 子系统和 platform 驱动框架
linux·学习·驱动
zhaowangji28 分钟前
mujoco仿真(机械臂推动正方体到指定位置)
人工智能·python
数据管道工31 分钟前
解析一个老网站:GBK 编码、页面结构漂移与限流退避
python
只睡四小时34 分钟前
AI 生成 PPTX:11 页课件编译出 429 个形状
javascript·python·pptx·ai生成ppt·ooxml