当前位置:首页 > 文章列表 > Golang > Go问答 > 任务的并发划分在 Goroutine 中进行

任务的并发划分在 Goroutine 中进行

来源:stackoverflow 2024-02-14 13:00:27 0浏览 收藏

大家好,我们又见面了啊~本文《任务的并发划分在 Goroutine 中进行》的内容中将会涉及到等等。如果你正在学习Golang相关知识,欢迎关注我,以后会给大家带来更多Golang相关文章,希望我们能一起进步!下面就开始本文的正式内容~

问题内容

这段代码的作用

代码从 postgresql 数据库获取数据。所有数据中只有两个字段(session 和 text)被添加到 task struct。

我的数据库中只有 2 个(每个)提到的数据,这意味着执行 len(task) 时将返回 2 作为输出。

现在从这里开始就是问题所在:

我创建了一个 buffered 通道 ch,其长度等于任务结构的长度(在本例中为 2)。

我指定允许的最大工作线程数,这里是 20。

下面的代码所做的是,当我将任务发送到通道时,发送 task 结构 中的所有元素(此处为 2),并且 task 结构中的示例代码将打印所有元素两次(= task 结构的长度) 。示例显示在最后。

我需要这个程序做什么

例如通道中有100条数据 len(task) = 100。我想将这100个数据分成20个goroutine,每个goroutine处理5个数据(我不知道这是否可行,如果无效,请提供其他解决方案)。

因此,这 100 个数据将提供给 20 个工作人员,他们每人将接收 5 个数据并与他们一起运行任务,最后通道将关闭,仅此而已。

当数据库变得越来越大时,这将很有帮助,而且目前也是如此。

让 20 个 worker 每个执行任务更好,还是让 worker 数量等于通道中的数据数量更好?

var wg sync.waitgroup

type task struct {
    fetchedsession string
    fetchedtext    string
}

func fetchalldata() {

    var task []task

    //fetch session from db
    var sess []database.usersession
    database.db.find(&sess)
    //fetch commenttext from db
    var cmt []database.commentreq
    database.db.find(&cmt)

    if len(sess) == len(cmt) {
        for i := range sess {
            task = append(task, task{fetchedsession: sess[i].session, fetchedtext: cmt[i].commenttext})
        }
    }

    //making the task channel
    ch := make(chan []task, len(task))

    max_workers := 20

    wg.add(max_workers)

    for i := 0; i < max_workers; i++ {
        go func() {
            for {
                t, ok := <-ch
                if !ok {
                    wg.done()
                    return
                }
                dotasks(t)
            }
        }()
    }

    for i := 0; i < len(task); i++ {
        ch <- task
    }

    close(ch)
    wg.wait()
}

//since total number of data in database is 2 (rows)
//currently this function takes all data from the channel and runs twice
func dotasks(t []task) {

    //total tasks (data) = 100
    //if max workers = 20, then this function will run 5 times
    //each goroutine will get 4 tasks from the channel
    // get the fetchedsession and fetchedtask and do tasks

    fmt.println(t) // this prints all data twice

    //finish one task and continue with the second
}

示例:

Example Data:
Task{FetchedSession: "EncodedString",  FetchedText: "Hello"}
Task{FetchedSession: "ExampleString",  FetchedText: "Hi"}
//Output
EncodedString
Hello
ExampleString
Hi
EncodedString
Hello
ExampleString
Hi

正确答案


  • 更改任务渠道类型。
ch := make(chan task, len(task))

这意味着通道上传递的每个值都代表一个单个任务。

  • 简化渠道迭代
for i := 0; i < max_workers; i++ {
        go func() {
            defer wg.done()
            for t := range ch {
                dotask(t)
            }
        }()
    }

wg.done() 现在将在工作线程退出时运行。 range ch 将在通道关闭且所有任务消耗完毕后停止。

  • 更改“do”函数以匹配
func DoTask(t Task) {

关于如何选择worker数量:

Run some benchmarks 为您的 fetchalldata 函数,并尝试更改 max_workers (或将其作为参数传递)。最佳值将取决于任务以及运行该函数时的可用资源,这意味着您今天的计算机上的最佳值可能不是其他人的计算机或您明天的计算机上的最佳值。基准应该可以帮助您找到一个合适的近似范围来放置该值。

本篇关于《任务的并发划分在 Goroutine 中进行》的介绍就到此结束啦,但是学无止境,想要了解学习更多关于Golang的相关知识,请关注golang学习网公众号!

版本声明
本文转载于:stackoverflow 如有侵犯,请联系study_golang@163.com删除
用 kubebuilder 解释 YAML 值的字节序列用 kubebuilder 解释 YAML 值的字节序列
上一篇
用 kubebuilder 解释 YAML 值的字节序列
遇到使用Go JSONPath解析JSON时的困扰问题
下一篇
遇到使用Go JSONPath解析JSON时的困扰问题
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    263次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    309次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    290次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    267次使用
  • MMBench详解:多模态大模型基准测试、功能特点与使用指南
    MMBench
    MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
    80次使用