cache 与 lru_cache怎么配置或排查
Python 里看到 @cache 和 @lru_cache,先记住一个实用判断:cache 等价于 lru_cache(maxsize=None),不会主动淘汰旧值;lru_cache 默认最多保留 128 个最近调用结果,更适合长期运行的服务。配置前先估算键的数量,再用 cache_info() 看命中是否真的改善。
- 键空间有限、结果稳定时才考虑
@cache;无法确认上限时使用有限的@lru_cache(maxsize=...)。 - 参数必须可哈希;关键字参数顺序不同,可能形成不同缓存项。
- 排查先看
hits、misses、currsize,数据变化时显式调用cache_clear()。
先选对 cache:无限缓存还是有限 LRU
@cache 适合递归计算、有限枚举或进程生命周期内不会持续扩张的纯函数。它省去了淘汰判断,但每个参数组合都会留下引用。Web 服务、任务进程或多租户程序通常应该优先使用有限的 LRU,避免输入键不断增长。
from functools import cache, lru_cache
@cache
def country_code(name: str) -> str:
# 键集合来自固定配置,结果稳定,适合轻量的无限缓存
return {"中国": "CN", "日本": "JP"}.get(name, "UNKNOWN")
@lru_cache(maxsize=256, typed=True)
def feature_flag(tenant_id: int, flag_name: str) -> bool:
# 生产服务给容量上限;typed=True 让不同类型的立即参数分别计数
return (tenant_id, flag_name) in {(7, "new-home"), (9, "export")}
这里的 maxsize=256 不是性能定律,而是一个可观察的初始容量。typed=True 只区分函数的直接参数类型,不会递归比较容器内部的每一层类型。两种装饰器都要求位置参数和关键字参数可哈希,因此 list、dict 不能直接作为缓存键。

参数写法不统一,为什么会让命中率变低
缓存键由调用参数组成。对于同一个函数,feature_flag(7, "new-home") 与 feature_flag(tenant_id=7, flag_name="new-home") 不应在业务层随意混用;关键字参数顺序不同也可能被视为不同调用。建议在服务边界统一一种调用风格,并在进入缓存函数前把可变输入规整成字符串、整数或元组。
还要检查函数本身是否值得缓存:带副作用、依赖 time()、random() 或外部实时状态的函数不适合直接装饰。返回的列表或字典也会被重复交给调用方;调用方修改它,下一次命中可能拿到被改过的对象。
cache_info() 怎么判断缓存到底有没有生效
装饰后的函数自带三个很有用的运维接口。cache_info() 返回 hits、misses、maxsize 和 currsize;cache_parameters() 核对当前的 maxsize 与 typed;cache_clear() 清除已有记录。它们比凭感觉调大容量更可靠。
def inspect_cache() -> None:
# 只读取指标,不改变缓存;可接入启动检查或低频诊断日志
info = feature_flag.cache_info()
params = feature_flag.cache_parameters()
print({
"hits": info.hits,
"misses": info.misses,
"currsize": info.currsize,
"maxsize": params["maxsize"],
"typed": params["typed"],
})
# 配置或租户数据发生变化时,再由明确的管理动作清空缓存
# feature_flag.cache_clear()
如果 misses 持续增加而 currsize 很快达到 maxsize,先检查键是否包含时间、随机值或过细的请求字段;不要只把容量从 256 改成更大的数字。若怀疑装饰器改变了函数行为,可以用 feature_flag.__wrapped__(7, "new-home") 绕过缓存,对比函数本体的返回。

上线前的缓存检查清单
| 检查项 | 看到什么 | 应该怎么处理 |
|---|---|---|
| 容量 | currsize 长期贴近 maxsize | 确认键是否过细,再决定调大或换策略 |
| 参数 | 出现 unhashable type | 把 list/dict 规整为 tuple 或稳定字符串 |
| 数据新鲜度 | 后端已更新但命中仍返回旧值 | 在明确的更新动作中调用 cache_clear() |
| 方法缓存 | 实例数增长导致缓存不降 | 记住 self 也属于缓存键,评估对象生命周期 |
最后不要把进程内的 cache 或 lru_cache 当成带 TTL 的共享缓存:它们不自动跨进程同步,也不会按时间过期。并发下底层缓存结构保持一致,但相同键的计算函数仍可能在首次填充期间被调用多次。发布前把这些边界写进清理策略和监控说明,排障会比盲目改 maxsize 快得多。
相关问题
cache 可以设置最大容量吗?
不能直接给 @cache 传容量参数;需要容量上限时改用 @lru_cache(maxsize=...)。
lru_cache 能按时间自动过期吗?
标准装饰器没有 TTL 参数。需要时间失效时,应在业务层设计清理或选择专门的缓存组件。
为什么 lru_cache 装饰异步函数容易出问题?
它缓存的是协程对象,而不是自动缓存异步结果;异步函数应单独设计并发、失效和共享缓存策略。
Go transport 怎么处理连接复用
- 上一篇
- Go transport 怎么处理连接复用
- 下一篇
- Go strings.CutPrefix 出错时怎么排查匹配失败
-
- 文章 · python教程 | 2小时前 |
- enum.StrEnum 值怎么配置或排查
- 298浏览 收藏
-
- 文章 · python教程 | 3小时前 |
- dataclasses.replace怎么配置或排查
- 282浏览 收藏
-
- 文章 · python教程 | 5小时前 |
- ExitStack 资源怎么配置或排查
- 411浏览 收藏
-
- 文章 · python教程 | 11小时前 | 标准库 · python · 资源文件 · Python 模板读取 importlib.resources 包资源
- Python importlib.resources 如何读取包内模板
- 244浏览 收藏
-
- 文章 · python教程 | 12小时前 | Python教程 · 进程管理 · 标准输出 · subprocess · Popen · Python subprocess.Popen Python实时读取标准输出 Python子进程管道堵塞 Python进程管理
- Python subprocess.Popen 怎样实时读取标准输出而不堵塞
- 492浏览 收藏
-
- 文章 · python教程 | 13小时前 |
- Python logging QueueHandler 如何避免业务线程被日志阻塞
- 165浏览 收藏
-
- 文章 · python教程 | 14小时前 |
- Python csv.DictReader 缺失列时如何给出明确错误
- 286浏览 收藏
-
- 文章 · python教程 | 17小时前 |
- Python typing.TypeIs 如何帮助类型检查器收窄类型
- 396浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- H2O EvalGPT
- H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
- 111次使用
-
- LMArena
- LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
- 31次使用
-
- OpenCompass
- OpenCompass是上海AI实验室推出的开源大模型评测平台,提供CompassKit、CompassHub和CompassRank三大核心组件,支持LLM及多模态模型的一站式标准化评估与排行榜查询。
- 48次使用
-
- AGI-Eval
- AGI-Eval是由上海交大等高校联合发布的大模型评测社区,提供公正透明的LLM能力榜单、多领域评测集及Data Studio数据服务,助力AI模型性能评估与NLP科研开发。
- 30次使用
-
- SuperCLUE
- SuperCLUE是权威的中文大语言模型综合评测基准,涵盖语言理解、知识应用、AI Agent智能体及安全性等12项核心能力。通过多轮对话与客观测试,定期发布榜单与技术报告,为模型研发、优化及行业选型提供科学依据。
- 265次使用
-
- Python sqlite3 Connection serialize 怎么导出数据库快照:备份窗口、内存占用与恢复校验
- 2026-08-26 501浏览
-
- Python监控网页状态:requests异常处理实战
- 2026-05-29 501浏览
-
- TensorFlow模型部署为API的TF Serving方法
- 2026-05-26 501浏览
-
- Python字符串编码转换:encode与decode详解
- 2026-05-16 501浏览
-
- TensorFlow裁剪无用算子方法详解
- 2026-05-15 501浏览

