Python tomllib.loads 怎么自定义浮点数类型
如果配置里的浮点数需要保留十进制语义,tomllib.loads 不必先解析成默认的 float 再二次转换。直接传入 parse_float 回调即可:回调收到每个浮点字面量的字符串,返回你希望放进结果字典的标量对象。最常用的是 decimal.Decimal,也可以返回一个带精度策略的自定义类型。
官方文档:https://docs.python.org/3/library/tomllib.html
parse_float是关键字参数,参数值应是可调用对象。- 回调输入是 TOML 浮点文本,输出可以是
Decimal或自定义标量。 - 回调不能返回
dict或list;整数、布尔值和字符串不会经过它。
parse_float 接管的是哪一段转换链
TOML 文档先被解析为键和值,再根据值的词法类型映射到 Python 类型。浮点值默认走 float(num_str),而传入 parse_float 后,解析器会把每个浮点字面量的文本交给这个回调。这样做的好处是没有中间的二进制浮点阶段,金额、税率或配置阈值可以从入口就保持十进制语义。

最小用法是把 Decimal 直接作为回调。注意它必须放在关键字参数位置,不能把它当成第二个位置参数:
from decimal import Decimal
import tomllib
toml_text = "price = 19.90\nratio = 0.125\ncount = 3"
# parse_float 接收原始浮点文本,Decimal 保留十进制计算语义
config = tomllib.loads(toml_text, parse_float=Decimal)
print(type(config["price"]).__name__) # Decimal
print(config["price"] + Decimal("0.10")) # Decimal('20.00')
print(type(config["count"]).__name__) # int,不会经过 parse_float
这会只改变浮点字段的 Python 类型:count 仍然是 int,字符串、布尔值、日期和表结构也继续使用标准转换。
需要统一精度时,封装一个自定义浮点标量
如果所有配置浮点都要量化到固定小数位,直接传 Decimal 还不够,因为它不会替你决定业务精度。可以让回调先创建 Decimal,再调用 quantize,或者返回一个继承自 Decimal 的业务类型。下面的函数更直观:输入仍是字符串,输出仍是单个标量。
from decimal import Decimal, ROUND_HALF_UP
import tomllib
CENT = Decimal("0.01")
def money_float(text: str) -> Decimal:
# 统一保留两位小数,舍入规则由业务明确指定
value = Decimal(text)
return value.quantize(CENT, rounding=ROUND_HALF_UP)
toml_text = "unit_price = 2.675\ndiscount = 0.125"
config = tomllib.loads(toml_text, parse_float=money_float)
print(config["unit_price"]) # 2.68
print(config["discount"]) # 0.13
这个方案适合配置本身就代表金额、比例等有固定精度的字段。如果同一文件里既有金额又有科学计量值,不要用一个“全局两位小数”函数硬套所有字段;可以先全部解析为 Decimal,再依据键名做业务层校验和量化。

回调返回值和异常应该怎么处理
parse_float 的返回值要能作为普通配置值保存。官方文档明确禁止返回 dict 或 list,否则会抛出 ValueError。如果需要附带单位、来源或校验状态,建议返回不可变的自定义标量,或者在解析完成后对结果字典做第二阶段建模,不要把一整个对象树塞进浮点回调。
| 输入类型 | 是否经过 parse_float | 默认结果 | 自定义策略 |
|---|---|---|---|
1.25 | 是 | float | Decimal 或业务标量 |
3 | 否 | int | 解析后单独转换 |
[0.1, 0.2] | 数组中的浮点会调用 | list[float] | list[Decimal] |
{a = 1.2} | 值会调用 | dict | 保留表结构 |
对于格式错误,tomllib.loads 会抛出 tomllib.TOMLDecodeError;对于自定义转换失败,可以让 Decimal 或量化逻辑的异常继续暴露,调用方再统一记录配置文件名和键路径。不要在回调里静默返回 None,否则错误会变成更晚、更难定位的业务类型错误。
常见问题
parse_float 能把整数也变成 Decimal 吗?
不能直接做到。它只处理 TOML 浮点字面量,整数仍会映射为 int。如果两类数字都要统一模型,应在解析后遍历指定字段,或调整 TOML 配置的字段约定。
能不能返回一个字典保存数值和单位?
不建议也不允许。回调返回 dict 或 list 会触发 ValueError;应返回标量,再在业务层把标量包装成带单位的对象。
为什么金额配置不推荐直接用 float?
二进制浮点不能精确表达许多十进制小数。用 Decimal 作为解析回调,可以把精度和舍入规则放在配置入口处,后续计算也更容易审计。
Go binary.Varint 返回负数读取长度是什么意思
- 上一篇
- Go binary.Varint 返回负数读取长度是什么意思
- 下一篇
- 90fps画质用户评价可信吗?实时模拟、兼容提示与效果判断说明
-
- 文章 · python教程 | 7小时前 |
- Python runtime_checkable Protocol 为什么只检查属性存在
- 410浏览 收藏
-
- 文章 · python教程 | 9小时前 | 协程 · 超时控制 · python · asyncio · Python 异步超时 asyncio.timeout reschedule
- Python asyncio.timeout 怎么动态调整截止时间
- 403浏览 收藏
-
- 文章 · python教程 | 12小时前 | python · Python setup.py pyproject.toml packaging
- Python packaging 从 setup.py 迁移 pyproject.toml 的清单
- 236浏览 收藏
-
- 文章 · python教程 | 14小时前 | python ·
- Python multiprocessing shared_memory 管理共享缓冲区
- 218浏览 收藏
-
- 文章 · python教程 | 1天前 | python · 进程管理 · Python subprocess Popen 进程树 TimeoutExpired 超时清理
- Python subprocess 超时后清理子进程树
- 108浏览 收藏
-
- 文章 · python教程 | 2天前 | 日志 · logging · Python教程 · Python contextvars request_id LogRecord logging.Filter
- Python logging.Filter 注入请求上下文的做法
- 410浏览 收藏
-
- 文章 · python教程 | 5天前 | Python教程 · Python 鸭子类型 typing.Protocol 结构子类型
- Python typing.Protocol 约束鸭子类型接口
- 246浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- PubMedQA
- 深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
- 325次使用
-
- H2O EvalGPT
- H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
- 382次使用
-
- LMArena
- LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
- 376次使用
-
- HELM
- 深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
- 342次使用
-
- MMBench
- MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
- 167次使用
-
- go格式“占位符”输入输出 类似python的input
- 2023-01-19 346浏览
-
- Golang如何调用Python代码详解
- 2023-01-07 235浏览
-
- HTTP 的 response 中的响应体和头部是分开发送的吗?
- 2023-01-28 387浏览
-
- B站等视频网站的弹幕用的是 websocket 还是轮询?
- 2023-02-16 447浏览
-
- Linux 下有什么命令行工具以时序显示 CPU 占用率?
- 2023-01-13 360浏览

