当前位置:首页 > 文章列表 > 文章 > python教程 > Python文件指针seek与tell使用技巧

Python文件指针seek与tell使用技巧

2026-01-28 22:36:56 0浏览 收藏

“纵有疾风来,人生不言弃”,这句话送给正在学习文章的朋友们,也希望在阅读本文《Python 文件指针 seek 与 tell 边界详解》后,能够真的帮助到大家。我也会在后续的文章中,陆续更新文章相关的技术文章,有好的建议欢迎大家在评论留言,非常感谢!

Python文本模式下seek()仅允许seek(0)或seek(f.tell()),因需处理换行符转换、Unicode多字节编码等;二进制模式才支持任意字节偏移定位,tell()返回真实字节位置。

Python 文件指针 seek / tell 的边界问题

Python 中 seek() 和 tell() 在文本模式下行为受限,尤其在换行符、Unicode 编码和跨平台场景中容易出错;真正可自由定位的只有二进制模式。

文本模式下 seek() 只允许回到 tell() 返回的位置或文件开头

在以 'r'、'w+' 等文本模式打开文件时,seek() 的偏移量必须是之前 tell() 返回的值,或 0(即 seek(0))。其他任意整数(比如 seek(5))会触发 io.UnsupportedOperation: can't do nonzero end-relative seeks 或类似错误。

这是因为文本模式要处理换行符标准化(\r\n → \n)、字符编码(如 UTF-8 多字节字符)、以及缓冲区对齐等问题,Python 无法保证中间某个字节偏移对应合法的字符边界。

  • ✅ 允许:f.seek(0)、f.seek(f.tell())
  • ❌ 禁止:f.seek(10)、f.seek(-5, 2)(除非刚调用过 tell())

二进制模式才是 seek/tell 的“完全体”

用 'rb'、'wb+' 打开文件后,seek() 支持任意合法偏移(包括负值、相对末尾等),tell() 返回的是真实的字节位置,无编码干扰。

例如读取 UTF-8 文件某一段:先用二进制模式定位,再按需解码局部字节:

with open('data.txt', 'rb') as f:
    f.seek(100)           # 跳到第 100 字节
    chunk = f.read(50)    # 读 50 字节
    text = chunk.decode('utf-8', errors='ignore')  # 容错解码

注意:直接对非字符边界截断可能导致解码失败(如截断一个多字节 UTF-8 字符),需配合 errors= 参数或手动校准。

tell() 的返回值在不同模式下含义不同

tell() 总是返回一个整数,但语义取决于打开模式:

  • 文本模式:tell() 返回的是“不透明标记”,仅可用于后续 seek() 回退,不可解释为字节数或字符数;
  • 二进制模式:tell() 返回当前文件指针的字节偏移量,可参与计算、保存、比较;
  • 追加模式('a' 或 'ab')下,即使调用 seek(),写操作仍强制发生在文件末尾(POSIX 行为),tell() 可能显示中间位置,但 write() 不会覆盖。

跨平台换行符会让文本模式 seek 更难预测

Windows 默认用 \r\n,Unix 用 \n。文本模式下,Python 会把所有 \r\n 当作单个 \n 处理,但底层存储仍是两个字节。这就导致:

  • tell() 返回的“位置”不等于实际字节数;
  • 同一段文本,在 Windows 和 Linux 上用文本模式 tell() 可能得到不同数值;
  • 想精确定位某行某列?必须用二进制模式 + 自行解析换行符和编码。

例如统计第 3 行起始字节位置:逐行读二进制流并累加 len(line)(含原始换行符),比依赖文本模式 seek() 可靠得多。

终于介绍完啦!小伙伴们,这篇关于《Python文件指针seek与tell使用技巧》的介绍应该让你收获多多了吧!欢迎大家收藏或分享给更多需要学习的朋友吧~golang学习网公众号也会发布文章相关知识,快来关注吧!

HTML标题结构与优化技巧HTML标题结构与优化技巧
上一篇
HTML标题结构与优化技巧
JavaScript可迭代协议详解及对象实现方法
下一篇
JavaScript可迭代协议详解及对象实现方法
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    357次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    416次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    424次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    380次使用
  • MMBench详解:多模态大模型基准测试、功能特点与使用指南
    MMBench
    MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
    205次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议 和 隐私政策
返回登录
  • 重置密码