当前位置:首页 > 文章列表 > 文章 > linux > Linux下hexdump查看二进制常用方法

Linux下hexdump查看二进制常用方法

2026-05-09 08:31:45 0浏览 收藏
本文深入解析了Linux下hexdump命令查看二进制文件的常见误区与高效用法,直击默认输出难懂的核心原因——无偏移地址、大端序显示及16字节/行的隐式布局,并强力推荐以`hexdump -C`作为实用起点;同时系统梳理了按整数单位(2/4字节)解读数据的正确姿势(如`-x`小端 vs `-X`大端)、灵活定制输出格式的`-e`高级技巧,以及与xxd、od的关键差异和跨平台兼容性陷阱,帮助读者避开字节序误读、偏移错位等高频坑点,真正实现精准、可靠、可复现的二进制分析。

Linux下使用hexdump查看二进制文件 常用输出格式

hexdump 默认输出为什么看不懂?

因为 hexdump 默认用十六进制+ASCII混合格式,但每行显示 16 字节,高位字节在前(big-endian),且不带偏移地址列——导致你找不到某段数据在文件中的位置,也容易把多字节整数(比如 0x12345678)误读成四个独立字节。

真正实用的起点是加 -C 参数:它等价于 xxd -g1 风格,输出带偏移、十六进制、ASCII 三栏,字节顺序直观,适合人工查数据。

  • hexdump -C file.bin:最常用,偏移为 8 位十六进制,每行 16 字节,00000000 开头表示第 0 字节
  • 注意:默认不处理文件末尾不足一行的部分,会补 00 并显示 * 行(表示重复上一行内容),这不是真实数据
  • 如果文件含控制字符(如 \x00、\x0a),ASCII 栏对应位置显示 .,不是空格

想按 2 字节/4 字节整数查看?用 -s 和 -n 控制范围 + -x/-X

-x 把每 2 字节当一个 unsigned short(小端序),-X 是大端序;-d 对应有符号 short,-D 是大端有符号。它们会自动跳过非对齐字节(比如文件长度为奇数时,最后一字节被忽略)。

  • hexdump -x file.bin:每行 8 个 2 字节整数,输出形如 0012 3456 789a bcde ...,注意这是小端解释 —— 实际字节流 12 00 56 34 会被显示为 0012 3456
  • 若需从偏移 0x100 开始读 32 字节:hexdump -x -s 0x100 -n 32 file.bin
  • 常见坑:-x 不等于 “每两个字节转成 hex”,而是“把两个字节当一个小端整数再转成 4 位 hex”,所以 01 00 → 0001,不是 0100

需要类 od 的灵活格式?直接换 -f 指定 format string

hexdump 支持 -f 加自定义格式文件,但更常用的是内置简写:-c(字符)、-d(有符号十进制 short)、-i(有符号 int)、-e(自定义表达式)。其中 -e 最灵活,但语法略硬核。

  • hexdump -e '8/1 "%02x " "\n"' file.bin:每行 8 字节,十六进制,补零两位,空格分隔
  • hexdump -e '"offset " 4/1 "%02x" " = " 4/1 "%c" "\n"' file.bin:手动拼偏移+字节+对应 ASCII,适合调试协议头
  • 注意:-e 中的 4/1 表示“重复 4 次,每次读 1 字节”,不是“读 4 字节”;"%02x" 是 printf 风格,不支持 %04x 直接对 2 字节字段补零(得用 -x 或 -e '1/2 "%04x"')

和 xxd、od 比较时要注意什么?

hexdump 在不同系统上行为可能不一致(尤其是 BSD vs GNU),而 xxd 更稳定、默认带列对齐,od 更适合数值批量解析。但如果你只能用 hexdump(比如嵌入式 busybox 环境),记住这几个关键差异:

  • hexdump -C 输出偏移是 8 位(00000000),xxd 默认也是,但 od -Ax 默认是 7 位(0000000),少一位容易看错位置
  • hexdump -x 固定小端,od -x 默认小端,但 od -X 是大端 —— 名称逻辑和 hexdump 相反,容易混淆
  • GNU hexdump 支持 -v(禁用 * 压缩行),BSD 版本不支持,脚本中若依赖此行为需先 hexdump --version 判断

偏移地址和字节序这两点,几乎每次用错都是因为没确认清楚当前命令实际怎么解释字节 —— 尤其是分析网络包或固件镜像时,差一个字节就全盘错乱。

本篇关于《Linux下hexdump查看二进制常用方法》的介绍就到此结束啦,但是学无止境,想要了解学习更多关于文章的相关知识,请关注golang学习网公众号!

文心一言4.5参数解析:temperature与top_p设置文心一言4.5参数解析:temperature与top_p设置
上一篇
文心一言4.5参数解析:temperature与top_p设置
Logback与Log4j2日志集成教程
下一篇
Logback与Log4j2日志集成教程
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    263次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    315次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    299次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    272次使用
  • MMBench详解:多模态大模型基准测试、功能特点与使用指南
    MMBench
    MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
    92次使用