Python sqlite3.Blob 怎么改大字段:blobopen、固定长度与事务边界
把用户头像、压缩附件或者小型模型片段存在 SQLite 里的时候,要是直接把整段 bytes 全读出来再覆盖写回去,代码看起来虽然短,实际跑起来内存峰值和事务边界特别容易出问题。Python 的 sqlite3.Connection.blobopen() 提供了按表、列和 rowid 直接打开 BLOB 的入口,但它不会自动扩容,后续写入的总长度必须提前由 zeroblob() 或者单元格里已有的值确定。
要更新 SQLite 的大字段,先用
zeroblob(N)预留固定长度,再通过blobopen(table, column, rowid, readonly=False)分块写入;写完关闭 Blob,最后由连接提交事务。长度不匹配、rowid 不存在和提前提交,都是最常见的失败点。
blobopen()面向已有 BLOB 单元格,不负责改变字段长度。zeroblob(N)适合先预留 N 字节,再按偏移调用Blob.write()。- Blob 关闭不等于事务提交,异常路径要同时处理 Blob 和 Connection。
一次失败的头像替换,暴露了三个边界
一个本地资料服务把头像存进 user_assets.avatar。最初写的替换函数是 UPDATE user_assets SET avatar=?,测试用的小图片只有几十 KB 时完全没问题;换成 8 MB 的原图之后,进程内存短时翻倍,上传中断还留下了半截无效的业务记录。
排查之后发现根本原因不是“SQLite 不能存大字段”。真正要拆分清楚的是三个动作:字段是否已经预留了足够空间、写入游标是否落在正确位置、事务有没有在资源关闭前提前提交。Blob 对象只解决第二个动作。
blobopen() 打开的到底是什么
官方接口的核心参数是表名、列名和整数 rowid。下面先建一张最小测试表,并用 zeroblob() 预留 12 字节。这里的长度只是示例用的,生产代码要根据实际文件大小或者协议上限计算。
import sqlite3
con = sqlite3.connect("assets.db")
con.execute("DROP TABLE IF EXISTS user_assets")
con.execute("CREATE TABLE user_assets (id INTEGER PRIMARY KEY, avatar BLOB NOT NULL)")
con.execute("INSERT INTO user_assets (avatar) VALUES (zeroblob(?))", (12,))
rowid = con.execute("SELECT last_insert_rowid()").fetchone()[0]
con.commit()
blob = con.blobopen("user_assets", "avatar", rowid, readonly=False)
try:
blob.write(b"hello-python")
finally:
blob.close()
con.commit()
blobopen() 返回的是支持读写的类文件对象。它有 read()、write()、seek() 和 tell() 等操作,但不像普通本地文件那样可以把 12 字节的内容直接写成 13 字节。Blob 可写入的总长度从打开的那一刻起,就由对应的 SQLite 单元格的长度决定了。

固定长度写入:先算大小,再分块落盘
如果数据来自上传流,别先把整个文件全读到内存里拼成一个 bytes。可以先拿到数据总大小,插入 zeroblob(size),然后每次读取 64 KiB 往 Blob 里写。下面示例用内存流模拟上传场景,换成真实磁盘文件的时候替换掉 source.read 就行。
import io
import sqlite3
def write_blob(con: sqlite3.Connection, source: io.BufferedReader, size: int) -> int:
cur = con.execute(
"INSERT INTO user_assets (avatar) VALUES (zeroblob(?)) RETURNING id",
(size,),
)
rowid = cur.fetchone()[0]
written = 0
blob = con.blobopen("user_assets", "avatar", rowid, readonly=False)
try:
while chunk := source.read(64 * 1024):
if written + len(chunk) > size:
raise ValueError("source is larger than reserved BLOB")
blob.write(chunk)
written += len(chunk)
if written != size:
raise ValueError(f"source size mismatch: {written} != {size}")
except Exception:
con.rollback()
raise
finally:
blob.close()
con.commit()
return rowid
payload = b"python-blob-demo"
with sqlite3.connect(":memory:") as con:
con.execute("CREATE TABLE user_assets (id INTEGER PRIMARY KEY, avatar BLOB NOT NULL)")
rowid = write_blob(con, io.BytesIO(payload), len(payload))
print(rowid, con.execute("SELECT length(avatar) FROM user_assets").fetchone()[0])
这个函数对“预留长度”和“实际写入长度”都做了校验。如果源数据提前结束,回滚动作会直接撤销刚插入的行;如果源数据超出预留长度,异常会在下一次写入前触发,不会出现数据被静默截断的情况。
事务和资源关闭顺序,决定失败后留下什么
Blob 是数据库连接上的依附资源,连接关闭之前最好显式把 Blob 关掉。更新完成后先关闭 Blob,再提交连接,后续代码逻辑排查起来也更清晰。针对已有记录的更新操作,建议把 blobopen() 放在一个小事务里执行,避免长时间持有数据库写锁。
| 现象 | 常见原因 | 核对动作 |
|---|---|---|
ValueError 或写入失败 | 写入内容超出了预先预留的长度 | 比较 tell()、文件大小和 length(avatar) |
| 找不到目标 | rowid 不存在或者对应列不是 BLOB 类型 | 先用 SELECT 语句核对 id、列名和字段的 NULL 状态 |
| 数据已写但业务未完成 | 只关闭了 Blob,没有执行 commit 提交事务 | 重新建立连接后查询数据,检查事务异常场景的处理逻辑 |
还有一个很容易被忽略的点:如果打开 Blob 之后,对同一连接执行了影响它所在行的结构修改操作,资源状态就会变得很难预判。别把 DDL、长查询和网络等待逻辑放到 Blob 写入的事务里;写入、关闭、提交这几个动作尽量连续完成。

已有 BLOB 的局部修改怎么做
固定长度特性也适合做局部更新。比如头像文件头部有一段可以修正的元数据,可以先以只读方式确认总长度,再以读写方式定位到指定偏移位置修改。seek() 的偏移是字节位置,不是字符位置。
with sqlite3.connect("assets.db") as con:
rowid = 7
size = con.execute(
"SELECT length(avatar) FROM user_assets WHERE id=?", (rowid,)
).fetchone()[0]
if size is None or size
这里的 with sqlite3.connect(...) 会在代码块正常结束时提交事务,异常时自动回滚;它不会替代 Blob 的关闭动作,所以代码里依然保留了 try/finally。
常见误区与回归清单
- 把
blobopen()当成支持自动扩容的普通文件:需要改变总长度的时候,重新写入新的 BLOB 内容或者先重新预留对应空间。 - 只检查 Python 侧变量的长度:还要在新的数据库连接里查询
length(column),确认提交动作真的生效了。 - 在 Blob 打开期间等待网络上传:应该先把输入数据准备好再操作,或者用短事务处理,避免长时间占用写锁。
- 用文本字符数计算二进制长度:BLOB 的长度是按字节计算的。
相关问题
blobopen() 能打开 NULL 值吗?
不能把 NULL 当成可写的固定长度 BLOB 使用。先用 zeroblob(N) 或者写入实际的 BLOB 占位内容,再打开目标行操作。
写入失败后是否必须手动 rollback?
如果事务是由连接上下文或者显式事务管理的,异常路径要执行回滚;关闭 Blob 只释放资源,不会自动撤销已经执行的 SQL 操作。
什么时候不适合用 Blob?
文件体积很大、需要对象存储能力或者多个进程频繁并发读写的时候,可以评估把文件直接放在文件夹或对象存储里,SQLite 只保存存储路径、摘要和元数据。
结语:把 BLOB 当成固定长度事务资源
sqlite3.Blob 适合在 SQLite 内对已定位的二进制单元做分块读写。稳定的实现逻辑一般遵循四步:先用 zeroblob 预留对应长度,按字节流写入内容,finally 关闭 Blob,最后提交事务并重新查询长度做校验。把这四步补充到测试用例里,剩下的就可以根据文件规模和并发模型,判断当前场景下 SQLite 是否依然是合适的选择。
TypeScript 路径映射 paths
- 上一篇
- TypeScript 路径映射 paths
- 下一篇
- TypeScript 协变与逆变
-
- 文章 · python教程 | 2小时前 |
- Python TaskGroup 怎么主动终止整组任务
- 242浏览 收藏
-
- 文章 · python教程 | 8小时前 | SQLite · 数据一致性 · Python教程 · Python SQLite 数据库备份 sqlite3.Connection.backup
- Python sqlite3.Connection.backup 怎么在线复制数据库
- 264浏览 收藏
-
- 文章 · python教程 | 11小时前 | python · Python zip zipfile zipfile.Path
- Python zipfile.Path 怎么像目录一样遍历压缩包
- 370浏览 收藏
-
- 文章 · python教程 | 13小时前 | 内存优化 · Python教程 · Python 大数组 PickleBuffer pickle协议5
- Python PickleBuffer 怎么减少大数组复制
- 207浏览 收藏
-
- 文章 · python教程 | 15小时前 | 标准库 · Python教程 · Python Traversable importlib.resources zipimport
- Python importlib.resources.files 怎么访问压缩包内资源
- 143浏览 收藏
-
- 文章 · python教程 | 18小时前 | 标准库 · python · 进程管理 · Python subprocess.Popen pipesize
- Python subprocess.Popen pipesize 什么时候有效
- 187浏览 收藏
-
- 文章 · python教程 | 22小时前 | python · 异步编程 · Python 资源清理 异步生成器 contextlib aclosing
- Python contextlib.aclosing 怎么确保异步生成器退出
- 369浏览 收藏
-
- 文章 · python教程 | 1天前 | python · Python decimal tomllib parse_float
- Python tomllib.loads 怎么自定义浮点数类型
- 158浏览 收藏
-
- 文章 · python教程 | 1天前 |
- Python runtime_checkable Protocol 为什么只检查属性存在
- 410浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- PubMedQA
- 深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
- 342次使用
-
- H2O EvalGPT
- H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
- 398次使用
-
- LMArena
- LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
- 392次使用
-
- HELM
- 深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
- 355次使用
-
- MMBench
- MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
- 181次使用
-
- Python sqlite3 Connection serialize 怎么导出数据库快照:备份窗口、内存占用与恢复校验
- 2026-08-26 501浏览
-
- Python监控网页状态:requests异常处理实战
- 2026-05-29 501浏览
-
- TensorFlow模型部署为API的TF Serving方法
- 2026-05-26 501浏览
-
- Python字符串编码转换:encode与decode详解
- 2026-05-16 501浏览
-
- TensorFlow裁剪无用算子方法详解
- 2026-05-15 501浏览

