当前位置:首页 > 文章列表 > 文章 > python教程 > Python csv.DictWriter 缺少字段时如何设置 extrasaction

Python csv.DictWriter 缺少字段时如何设置 extrasaction

来源:17golang原创 2026-09-15 05:27:24 0浏览 收藏

csv.DictWriter 写 CSV 时,很多人会把“字典缺少字段”和“字典多出字段”混为一谈。真正的处理方式是:行字典缺少 fieldnames 中的键,由 restval 补值;行字典出现不在 fieldnames 中的键,才由 extrasaction 决定。默认值是 'raise',会抛出 ValueError;如果确认多出来的键可以丢弃,再设置 extrasaction='ignore'

官方地址:https://docs.python.org/3/library/csv.html

要点速览
  • restval 管“缺少的列”,extrasaction 管“多出的键”,两者不是同一个开关。
  • 默认 raise 更适合尽早发现数据契约漂移;ignore 只应在丢弃额外字段是明确决定时使用。
  • 验证时同时检查 CSV 表头、列顺序、缺失值和多余键,避免只看到文件生成就误以为数据正确。

先判断:到底是缺少字段还是多了字段

fieldnames 是输出列的白名单和顺序。例如它是 ['name', 'email', 'role'],每一行都会按这个顺序写出三列。字典没有 role,属于缺少字段,使用 restval;字典多了 department,属于额外字段,使用 extrasaction

数据情况控制参数默认行为
行字典缺少 fieldnames 中的键restval写入空字符串
行字典包含 fieldnames 之外的键extrasactionraise,抛出 ValueError

先保留默认 raise,确认问题能被看见

下面的例子故意让第二行多出 department。默认策略不会默默改写数据,而是在 writerow() 处失败,这通常是排查导出字段漂移的最快信号。

import csv

fieldnames = ["name", "email", "role"]
rows = [
    {"name": "Lin", "email": "lin@example.com"},  # 缺少 role,由 restval 处理
    {"name": "Mia", "email": "mia@example.com", "role": "admin", "department": "ops"},  # 多出键
]

with open("users.csv", "w", newline="", encoding="utf-8") as csvfile:
    # 默认 extrasaction="raise",先让额外字段暴露出来
    writer = csv.DictWriter(csvfile, fieldnames=fieldnames, restval="未填写")
    writer.writeheader()  # 写入固定表头,保证列顺序稳定
    for row in rows:
        writer.writerow(row)  # 第二行会因 department 抛出 ValueError

这里第一行的 role 会写成“未填写”,但循环在第二行停止。这个行为适合接口字段刚发生变化、你还不确定是否应该丢字段的阶段。

Python csv.DictWriter 配置输入操作示意,展示 fieldnames、restval 和默认 extrasaction raise
图1:Python csv.DictWriter 的配置输入示意图,突出 fieldnames 白名单与默认 raise 策略。

确认可以丢弃额外键时设置 extrasaction='ignore'

如果上游记录经常带有导出不需要的元数据,可以在构造器中显式设置:

import csv

fieldnames = ["name", "email", "role"]
row = {"name": "Mia", "email": "mia@example.com", "role": "admin", "department": "ops"}

with open("users.csv", "w", newline="", encoding="utf-8") as csvfile:
    # ignore 只忽略不在 fieldnames 中的键,不改变列顺序
    writer = csv.DictWriter(
        csvfile,
        fieldnames=fieldnames,
        restval="未填写",
        extrasaction="ignore",
    )
    writer.writeheader()  # 表头仍只包含三个声明列
    writer.writerow(row)  # department 被忽略,写入成功

生成内容应是:

name,email,role
Mia,mia@example.com,admin

注意,ignore 不会把额外键自动变成新列,也不会解决列名拼写错误。若 emali 是误拼写,忽略它可能让邮件地址悄悄丢失。

Python csv.DictWriter 结果示意,展示额外 department 键被忽略且 CSV 只保留三列
图2:结果示意图,extrasaction='ignore' 后 CSV 只保留 fieldnames 声明的三列。

用 restval 处理真正缺少的字段

如果目标是让缺少的列拥有明确占位值,应继续使用 restval,不要误改 extrasaction

import csv

fieldnames = ["name", "email", "role"]
row = {"name": "Lin", "email": "lin@example.com"}  # 没有 role

with open("users.csv", "w", newline="", encoding="utf-8") as csvfile:
    # restval 只填充缺少的 fieldnames 键
    writer = csv.DictWriter(csvfile, fieldnames=fieldnames, restval="未填写")
    writer.writeheader()
    writer.writerow(row)

输出第三列为“未填写”。写入后可以用 csv.DictReader 复读,检查表头是否为 name,email,role,并确认缺少值和额外键的处理都符合数据契约。

生产代码该选哪一种策略

导出财务、权限或对账数据时,我更倾向保留 raise,并记录导致失败的行,让字段变更尽早进入评审。只有在额外键属于已知元数据、且不会影响业务含义时,才使用 ignore。另一种更稳妥的做法是先计算额外键集合,记录日志后再把过滤后的字典交给写入器。

无论采用哪种策略,都要把 newline="" 和明确的 encoding="utf-8" 写在打开文件的位置;这样跨平台读取时更容易复查换行和中文内容。

常见问题

extrasaction 能填补缺少的列吗?

不能。缺少列由 restval 填充;extrasaction 只决定多余键是抛错还是忽略。

为什么设置了 ignore 仍然没有新列?

因为输出列由 fieldnames 决定。想输出新列,必须把列名加入 fieldnames,而不是依赖行字典自动扩展。

默认 raise 什么时候更好?

当额外字段可能代表拼写错误、接口升级或敏感数据误导出时,默认抛错更安全,也更容易定位数据问题。

把三个参数记成一句话即可:fieldnames 定列,restval 补缺,extrasaction 管多。先判断字段差异,再决定是暴露问题还是明确忽略。

版本声明
本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
Go copy 重叠切片时为什么结果仍然可预测Go copy 重叠切片时为什么结果仍然可预测
上一篇
Go copy 重叠切片时为什么结果仍然可预测
Go cmp.Or 如何区分零值和显式默认值
下一篇
Go cmp.Or 如何区分零值和显式默认值
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    28次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    131次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    67次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    23次使用
  • CMMLU中文大模型评估基准:功能、使用教程与应用场景解析
    CMMLU
    深入了解CMMLU中文评估基准,涵盖67个学科主题,提供数据集下载、Zero-shot/Five-shot评估方法及排行榜,助力优化中文语言模型性能。
    11次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议隐私政策
返回登录
  • 重置密码