Go语言中三种不同md5计算方式的性能比较
亲爱的编程学习爱好者,如果你点开了这篇文章,说明你对《Go语言中三种不同md5计算方式的性能比较》很感兴趣。本篇文章就来给大家详细解析一下,主要介绍一下性能、gomd5,希望所有认真读完的童鞋们,都有实质性的提高。
前言
本文主要介绍的是三种不同的 md5 计算方式,其实区别是读文件的不同,也就是磁盘 I/O, 所以也可以举一反三用在网络 I/O 上。下面来一起看看吧。
ReadFile
先看第一种, 简单粗暴:
func md5sum1(file string) string { data, err := ioutil.ReadFile(file) if err != nil { return "" } return fmt.Sprintf("%x", md5.Sum(data)) }
之所以说其粗暴,是因为 ReadFile 里面其实调用了一个 readall, 分配内存是最多的。
Benchmark 来一发:
var test_path = "/path/to/file" func BenchmarkMd5Sum1(b *testing.B) { for i := 0; i <pre class="brush:plain;"> go test -test.run=none -test.bench="^BenchmarkMd5Sum1$" -benchtime=10s -benchmem BenchmarkMd5Sum1-4 300 43704982 ns/op 19408224 B/op 14 allocs/op PASS ok tmp 17.446s
先说明下,这个文件大小是 19405028 字节,和上面的 19408224 B/op 非常接近, 因为 readall 确实是分配了文件大小的内存,代码为证:
ReadFile 源码
// ReadFile reads the file named by filename and returns the contents. // A successful call returns err == nil, not err == EOF. Because ReadFile // reads the whole file, it does not treat an EOF from Read as an error // to be reported. func ReadFile(filename string) ([]byte, error) { f, err := os.Open(filename) if err != nil { return nil, err } defer f.Close() // It's a good but not certain bet that FileInfo will tell us exactly how much to // read, so let's try it but be prepared for the answer to be wrong. var n int64 if fi, err := f.Stat(); err == nil { // Don't preallocate a huge buffer, just in case. if size := fi.Size(); size <p><span style="color: #ff0000"><strong>io.Copy</strong></span></p> <p><strong>再看第二种,</strong></p> <pre class="brush:plain;"> func md5sum2(file string) string { f, err := os.Open(file) if err != nil { return "" } defer f.Close() h := md5.New() _, err = io.Copy(h, f) if err != nil { return "" } return fmt.Sprintf("%x", h.Sum(nil)) }
第二种的特点是:使用了 io.Copy
。 在一般情况下(特殊情况在下面会提到),io.Copy
每次会分配 32 *1024 字节的内存,即32 KB, 然后咱看下 Benchmark 的情况:
func BenchmarkMd5Sum2(b *testing.B) { for i := 0; i <pre class="brush:plain;"> $ go test -test.run=none -test.bench="^BenchmarkMd5Sum2$" -benchtime=10s -benchmem BenchmarkMd5Sum2-4 500 37538305 ns/op 33093 B/op 8 allocs/op PASS ok tmp 22.657s
32 * 1024 = 32768, 和 上面的 33093 B/op 很接近。
io.Copy + bufio.Reader
然后再看看第三种情况。
这次不仅用了 io.Copy
,还用了 bufio.Reader。 bufio 顾名思义, 即 buffered I/O, 性能相对要好些。bufio.Reader
默认会创建 4096 字节的 buffer。
func md5sum3(file string) string { f, err := os.Open(file) if err != nil { return "" } defer f.Close() r := bufio.NewReader(f) h := md5.New() _, err = io.Copy(h, r) if err != nil { return "" } return fmt.Sprintf("%x", h.Sum(nil)) }
看下 Benchmark 的情况:
func BenchmarkMd5Sum3(b *testing.B) { for i := 0; i <pre class="brush:plain;"> $ go test -test.run=none -test.bench="^BenchmarkMd5Sum3$" -benchtime=10s -benchmem BenchmarkMd5Sum3-4 300 42589812 ns/op 4507 B/op 9 allocs/op PASS ok tmp 16.817s
上面的 4507 B/op 是不是和 4096 很接近? 那为什么 io.Copy
+ bufio.Reader
的方式所用内存会比单纯的 io.Copy
占用内存要少一些呢? 上文也提到, 一般情况下 io.Copy 每次会分配 32 *1024 字节的内存,那特殊情况是? 答案在源码中。
一起看看 io.Copy 相关源码:
func Copy(dst Writer, src Reader) (written int64, err error) { return copyBuffer(dst, src, nil) } // copyBuffer is the actual implementation of Copy and CopyBuffer. // if buf is nil, one is allocated. func copyBuffer(dst Writer, src Reader, buf []byte) (written int64, err error) { // If the reader has a WriteTo method, use it to do the copy. // Avoids an allocation and a copy. // hash.Hash 这个 Writer 并没有实现 WriteTo 方法,所以不会走这里 if wt, ok := src.(WriterTo); ok { return wt.WriteTo(dst) } // Similarly, if the writer has a ReadFrom method, use it to do the copy. // 而 bufio.Reader 实现了 ReadFrom 方法,所以,会走这里 if rt, ok := dst.(ReaderFrom); ok { return rt.ReadFrom(src) } if buf == nil { buf = make([]byte, 32*1024) } for { nr, er := src.Read(buf) if nr > 0 { nw, ew := dst.Write(buf[0:nr]) if nw > 0 { written += int64(nw) } if ew != nil { err = ew break } if nr != nw { err = ErrShortWrite break } } if er == EOF { break } if er != nil { err = er break } } return written, err }
从上面的源码来看, 用 bufio.Reader
实现的 io.Reader
并不会走默认的 buffer创建路径,而是提前返回了,使用了 bufio.Reader
创建的 buffer, 这也是使用了 bufio.Reader
分配的内存会小一些。
当然如果你希望 io.Copy
也分配小一点的内存,也是可以做到的,不过是用 io.CopyBuffer
, buf 就创建一个 4096 的 []byte 即可, 就跟 bufio.Reader
区别不大了。
看看是不是这样:
// Md5Sum2 用 CopyBufer 重新实现,buf := make([]byte, 4096) BenchmarkMd5Sum2-4 500 38484425 ns/op 4409 B/op 8 allocs/op BenchmarkMd5Sum3-4 500 38671090 ns/op 4505 B/op 9 allocs/op
从结果来看, 分配的内存相差不大,毕竟实现不一样,不可能一致。
那下次如果你要写一个下载大文件的程序,你还会用 ioutil.ReadAll(resp.Body)
吗?
最后整体对比下 Benchmark 的情况:
$ go test -test.run=none -test.bench="." -benchtime=10s -benchmem testing: warning: no tests to run BenchmarkMd5Sum1-4 300 42551920 ns/op 19408230 B/op 14 allocs/op BenchmarkMd5Sum2-4 500 38445352 ns/op 33089 B/op 8 allocs/op BenchmarkMd5Sum3-4 500 38809429 ns/op 4505 B/op 9 allocs/op PASS ok tmp 63.821s
小结
这三种不同的 md5 计算方式在执行时间上都差不多,区别最大的是内存的分配上;
bufio 在处理 I/O 还是很有优势的,优先选择;
尽量避免 ReadAll 这种用法。
总结
以上就是本文的全部内容了,是否有顺利帮助你解决问题?若是能给你带来学习上的帮助,请大家多多支持golang学习网!更多关于Golang的相关知识,也可关注golang学习网公众号。

- 上一篇
- Go语言正则表达式用法实例小结【查找、匹配、替换等】

- 下一篇
- CentOS 32 bit安装golang 1.7的步骤详解
-
- 着急的篮球
- 太全面了,码住,感谢大佬的这篇技术贴,我会继续支持!
- 2023-01-11 16:21:05
-
- 开放的蜡烛
- 这篇博文真是及时雨啊,细节满满,真优秀,已收藏,关注作者大大了!希望作者大大能多写Golang相关的文章。
- 2023-01-08 00:46:40
-
- 现实的小笼包
- 太给力了,一直没懂这个问题,但其实工作中常常有遇到...不过今天到这,帮助很大,总算是懂了,感谢作者分享博文!
- 2023-01-02 18:41:48
-
- 拉长的棉花糖
- 这篇博文真及时,博主加油!
- 2022-12-31 04:25:34
-
- Golang · Go教程 | 2分钟前 |
- Go语言逐行读取文件的几种方法
- 113浏览 收藏
-
- Golang · Go教程 | 35分钟前 |
- Golang快速删除大文件技巧解析
- 318浏览 收藏
-
- Golang · Go教程 | 38分钟前 | Kubernetes 服务发现 Golang微服务架构 监控追踪 熔断限流
- Golang微服务架构详解与实践方案
- 107浏览 收藏
-
- Golang · Go教程 | 53分钟前 |
- Go语言接口与组合使用方法
- 370浏览 收藏
-
- Golang · Go教程 | 1小时前 |
- Golang子测试嵌套方法全解析
- 300浏览 收藏
-
- Golang · Go教程 | 1小时前 |
- Golang反射优化:代码生成替代方案
- 492浏览 收藏
-
- Golang · Go教程 | 1小时前 |
- Golang依赖回退与版本降级教程
- 304浏览 收藏
-
- Golang · Go教程 | 1小时前 |
- C转Go代码工具及实战教程
- 191浏览 收藏
-
- Golang · Go教程 | 1小时前 |
- Go接口测试:gomock生成mock代码教程
- 474浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 514次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 499次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 484次学习
-
- AI Mermaid流程图
- SEO AI Mermaid 流程图工具:基于 Mermaid 语法,AI 辅助,自然语言生成流程图,提升可视化创作效率,适用于开发者、产品经理、教育工作者。
- 633次使用
-
- 搜获客【笔记生成器】
- 搜获客笔记生成器,国内首个聚焦小红书医美垂类的AI文案工具。1500万爆款文案库,行业专属算法,助您高效创作合规、引流的医美笔记,提升运营效率,引爆小红书流量!
- 640次使用
-
- iTerms
- iTerms是一款专业的一站式法律AI工作台,提供AI合同审查、AI合同起草及AI法律问答服务。通过智能问答、深度思考与联网检索,助您高效检索法律法规与司法判例,告别传统模板,实现合同一键起草与在线编辑,大幅提升法律事务处理效率。
- 655次使用
-
- TokenPony
- TokenPony是讯盟科技旗下的AI大模型聚合API平台。通过统一接口接入DeepSeek、Kimi、Qwen等主流模型,支持1024K超长上下文,实现零配置、免部署、极速响应与高性价比的AI应用开发,助力专业用户轻松构建智能服务。
- 724次使用
-
- 迅捷AIPPT
- 迅捷AIPPT是一款高效AI智能PPT生成软件,一键智能生成精美演示文稿。内置海量专业模板、多样风格,支持自定义大纲,助您轻松制作高质量PPT,大幅节省时间。
- 619次使用
-
- golang 对象深拷贝的常见方式及性能
- 2022-12-28 262浏览
-
- Go标准库http与fasthttp服务端性能对比场景分析
- 2022-12-31 206浏览
-
- golang利用pprof与go-torch如何做性能分析
- 2023-01-01 182浏览
-
- MySQL查询性能优化索引下推
- 2023-01-01 251浏览
-
- 二十种实战调优MySQL性能优化的经验
- 2023-02-24 186浏览