Golang 获取文件md5校验的方法以及效率对比
来源:脚本之家
2023-01-07 12:03:14
0浏览
收藏
来到golang学习网的大家,相信都是编程学习爱好者,希望在这里学习Golang相关编程知识。下面本篇文章就来带大家聊聊《Golang 获取文件md5校验的方法以及效率对比》,介绍一下校验、MD5,希望对大家的知识积累有所帮助,助力实战开发!
近期有一个需求:获取多个文件 md5 校验和判断是否存在重复文件,因为文件数量较多,有的文件还比较大,需要处理的文件还没有到位,我就考虑了一下效率的问题。
目前我已知的 Golang 中获取 md5 校验和的方法有两个
这里直接给出实现源码。
package main
import (
"crypto/md5"
"flag"
"fmt"
"io"
"io/ioutil"
"os"
)
var which = flag.Bool("which", true, "")
var path = flag.String("path", "", "")
var cnt = flag.Int("cnt", 100, "")
func aaa() {
f, err := os.Open(*path)
if err != nil {
fmt.Println("Open", err)
return
}
defer f.Close()
body, err := ioutil.ReadAll(f)
if err != nil {
fmt.Println("ReadAll", err)
return
}
md5.Sum(body)
//fmt.Printf("%x\n", md5.Sum(body))
}
func bbb() {
f, err := os.Open(*path)
if err != nil {
fmt.Println("Open", err)
return
}
defer f.Close()
md5hash := md5.New()
if _, err := io.Copy(md5hash, f); err != nil {
fmt.Println("Copy", err)
return
}
md5hash.Sum(nil)
//fmt.Printf("%x\n", md5hash.Sum(nil))
}
func main() {
flag.Parse()
for i := 0; i
<h2>还有可供参考的获取 md5 校验和的 Shell 命令</h2>
<pre class="brush:plain;">
md5 -- calculate a message-digest fingerprint (checksum) for a file
md5 [-pqrtx] [-s string] [file ...]
测试文件是公司项目的日志文件
banjakukutekiiMac:shell panshiqu$ ls -an | grep by -rw-r--r-- 1 501 20 7285957 11 17 16:14 by.out banjakukutekiiMac:shell panshiqu$ cp by.out by2.out banjakukutekiiMac:shell panshiqu$ cat by.out >> by2.out banjakukutekiiMac:shell panshiqu$ ls -an | grep by -rw-r--r-- 1 501 20 7285957 11 17 16:14 by.out -rw-r--r-- 1 501 20 14571914 11 17 17:03 by2.out
下面效率展示
banjakukutekiiMac:shell panshiqu$ time ./gomd5 -cnt=1 -which=true -path="by.out" real 0m0.027s user 0m0.017s sys 0m0.012s banjakukutekiiMac:shell panshiqu$ time ./gomd5 -cnt=1 -which=true -path="by2.out" real 0m0.048s user 0m0.033s sys 0m0.018s banjakukutekiiMac:shell panshiqu$ time ./gomd5 -cnt=1 -which=false -path="by.out" real 0m0.018s user 0m0.012s sys 0m0.004s banjakukutekiiMac:shell panshiqu$ time ./gomd5 -cnt=1 -which=false -path="by2.out" real 0m0.031s user 0m0.024s sys 0m0.005s banjakukutekiiMac:shell panshiqu$ time md5 by.out MD5 (by.out) = 9d79e19a00cef1ae1bb6518ca4adf9de real 0m0.023s user 0m0.019s sys 0m0.006s banjakukutekiiMac:shell panshiqu$ time md5 by2.out MD5 (by2.out) = 0a029a460a20e8dcb00d032d6fab74c6 real 0m0.042s user 0m0.037s sys 0m0.009s
总结:
不管什么方法都会随着文件变大时间会变长,上面的例子大约都是2倍
io.Copy 方法效率最高,建议大家这样使用
补充:Go语言:md5计算方法的效率研究
研究了一下Go的md5计算方法,目前来看,效率最高运行最快的写法是调用md5.Sum()函数返回16字节checksum,然后把每个字节的高4位和低4位分别映射成16进制字符存到两个字节里,得到32字节,再转成字符串。
FastMD5较其它算法效率提高了至少46%以上。
const hextable = "0123456789abcdef"
//作者: pengpengzhou
func FastMD5(str string) string {
src := md5.Sum([]byte(str))
var dst = make([]byte, 32)
j := 0
for _, v := range src {
dst[j] = hextable[v>>4]
dst[j+1] = hextable[v&0x0f]
j += 2
}
return string(dst)
}
Go Test Benchmark测试结果:
goos: linux goarch: amd64 pkg: example BenchmarkFastMD5-4 5564898 205 ns/op BenchmarkV1-4 3461698 379 ns/op BenchmarkV2-4 2277235 516 ns/op BenchmarkV3-4 2158122 527 ns/op PASS ok example 6.440s
详细代码如下:
package main
import (
"crypto/md5"
"encoding/hex"
"fmt"
"io"
)
const hextable = "0123456789abcdef"
func FastMD5(str string) string {
src := md5.Sum([]byte(str))
var dst = make([]byte, 32)
j := 0
for _, v := range src {
dst[j] = hextable[v>>4]
dst[j+1] = hextable[v&0x0f]
j += 2
}
return string(dst)
}
func md5V1(str string) string {
h := md5.New()
h.Write([]byte(str))
return hex.EncodeToString(h.Sum(nil))
}
func md5V2(str string) string {
data := []byte(str)
has := md5.Sum(data)
md5str := fmt.Sprintf("%x", has)
return md5str
}
func md5V3(str string) string {
w := md5.New()
io.WriteString(w, str)
md5str := fmt.Sprintf("%x", w.Sum(nil))
return md5str
}
func main() {
str := "中文"
fmt.Println(FastMD5(str))
fmt.Println(md5V1(str))
fmt.Println(md5V2(str))
fmt.Println(md5V3(str))
}
package main
import (
"testing"
)
var str = "golang中文教程"
func BenchmarkFastMD5(b *testing.B) {
for i := 0; i
<p>以上为个人经验,希望能给大家一个参考,也希望大家多多支持golang学习网。如有错误或未考虑完全的地方,望不吝赐教。</p><p>本篇关于《Golang 获取文件md5校验的方法以及效率对比》的介绍就到此结束啦,但是学无止境,想要了解学习更多关于Golang的相关知识,请关注golang学习网公众号!</p> 版本声明
本文转载于:脚本之家 如有侵犯,请联系study_golang@163.com删除
Golang 实现获取当前函数名称和文件行号等操作
- 上一篇
- Golang 实现获取当前函数名称和文件行号等操作
- 下一篇
- GoLang中生成UUID唯一标识的实现
查看更多
最新文章
-
- Golang · Go教程 | 3小时前 | 格式化输出 printf fmt库 格式化动词 Stringer接口
- Golangfmt库用法与格式化技巧解析
- 140浏览 收藏
-
- Golang · Go教程 | 3小时前 |
- Golang配置Protobuf安装教程
- 147浏览 收藏
-
- Golang · Go教程 | 3小时前 |
- Golang中介者模式实现与通信解耦技巧
- 378浏览 收藏
-
- Golang · Go教程 | 3小时前 |
- Golang多协程通信技巧分享
- 255浏览 收藏
-
- Golang · Go教程 | 3小时前 |
- Golang如何判断变量类型?
- 393浏览 收藏
-
- Golang · Go教程 | 3小时前 |
- Golang云原生微服务实战教程
- 310浏览 收藏
-
- Golang · Go教程 | 4小时前 |
- Golang迭代器与懒加载结合应用
- 110浏览 收藏
-
- Golang · Go教程 | 4小时前 | 性能优化 并发安全 Golangslicemap 预设容量 指针拷贝
- Golangslicemap优化技巧分享
- 412浏览 收藏
-
- Golang · Go教程 | 4小时前 |
- Golang代理模式与访问控制实现解析
- 423浏览 收藏
-
- Golang · Go教程 | 5小时前 |
- Golang事件管理模块实现教程
- 274浏览 收藏
查看更多
课程推荐
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
查看更多
AI推荐
-
- ChatExcel酷表
- ChatExcel酷表是由北京大学团队打造的Excel聊天机器人,用自然语言操控表格,简化数据处理,告别繁琐操作,提升工作效率!适用于学生、上班族及政府人员。
- 3164次使用
-
- Any绘本
- 探索Any绘本(anypicturebook.com/zh),一款开源免费的AI绘本创作工具,基于Google Gemini与Flux AI模型,让您轻松创作个性化绘本。适用于家庭、教育、创作等多种场景,零门槛,高自由度,技术透明,本地可控。
- 3376次使用
-
- 可赞AI
- 可赞AI,AI驱动的办公可视化智能工具,助您轻松实现文本与可视化元素高效转化。无论是智能文档生成、多格式文本解析,还是一键生成专业图表、脑图、知识卡片,可赞AI都能让信息处理更清晰高效。覆盖数据汇报、会议纪要、内容营销等全场景,大幅提升办公效率,降低专业门槛,是您提升工作效率的得力助手。
- 3405次使用
-
- 星月写作
- 星月写作是国内首款聚焦中文网络小说创作的AI辅助工具,解决网文作者从构思到变现的全流程痛点。AI扫榜、专属模板、全链路适配,助力新人快速上手,资深作者效率倍增。
- 4509次使用
-
- MagicLight
- MagicLight.ai是全球首款叙事驱动型AI动画视频创作平台,专注于解决从故事想法到完整动画的全流程痛点。它通过自研AI模型,保障角色、风格、场景高度一致性,让零动画经验者也能高效产出专业级叙事内容。广泛适用于独立创作者、动画工作室、教育机构及企业营销,助您轻松实现创意落地与商业化。
- 3785次使用
查看更多
相关文章
-
- GoFrame实现顺序性校验示例详解
- 2023-02-19 225浏览
-
- go语言实现银行卡号Luhn校验
- 2023-02-16 140浏览
-
- golang中字符串MD5生成方式总结
- 2023-01-23 146浏览
-
- go语言实战之实现比特币地址校验步骤
- 2022-12-27 458浏览
-
- go语言实现简易比特币系统之交易签名及校验功能
- 2023-01-25 118浏览

