当前位置:首页 > 文章列表 > 文章 > java教程 > Java Stream Gatherer 终止输入并输出尾部状态

Java Stream Gatherer 终止输入并输出尾部状态

来源:17golang原创 2026-09-29 00:51:21 0浏览 收藏

Gatherer 的“终止输入”不是让 integrator 返回 false,而是上游已经没有下一个元素时进入 finisher。如果目标是把计数、最后一条记录或聚合摘要作为一条结果输出,应把它们放进中间状态,在 finisher 中调用 downstream.push。这样非空流通常产生一条尾部结果,空流则可以明确地产生零条结果。

正常结束交给 finisher,提前停止才使用 integrator 的 false;需要维护顺序状态时,优先从 ofSequential 开始。

要点速览
  • integrator 只负责吸收输入并更新状态,finisher 负责输入耗尽后的最后输出。
  • Gatherer.ofSequential 适合保存最后元素、累计数量和摘要等有顺序依赖的状态。
  • 空流不会凭空产生尾部状态;需要并行时必须另外设计可结合的状态与 combiner。

先分清 finisher 和短路返回值

一个 Gatherer 可以理解为四个协作点:初始化状态、整合元素、合并分区状态、结束时把状态转成下游结果。顺序 Gatherer 没有可用的合并逻辑时,输入会按遇到顺序交给 integrator;上游耗尽后,再调用一次 finisher。

integrator 返回 false 表示“不再希望继续接收元素”,它是短路信号,不是普通的 EOF 标记。比如找到第一个满足条件的元素后可以停止;若只是想在最后补发一条摘要,应该让整合函数继续返回 true,把补发动作放到 finisher。

Java Stream Gatherer 由 initializer、integrator、finisher 维护输入状态并输出尾部结果的结构示意图

用一个状态对象保存尾部信息

示例把输入字符串拼成摘要,同时保存输入数量和最后一个元素。状态只属于当前 Gatherer 评估过程,不能被外部缓存,也不要在回调结束后继续持有它。

import java.util.List;
import java.util.stream.Gatherer;
import java.util.stream.Stream;

final class TailState {
    final StringBuilder summary = new StringBuilder();
    int count;
    String last;
}

static Gatherer tailState() {
    return Gatherer.ofSequential(
        TailState::new,
        Gatherer.Integrator.ofGreedy((state, element, downstream) -> {
            // 这里只更新状态;正常结束不在这里推送尾部结果。
            state.count++;
            state.last = element;
            if (state.summary.length() > 0) state.summary.append(" | ");
            state.summary.append(element);
            return true; // true 表示继续接收上游元素
        }),
        (state, downstream) -> {
            // 输入耗尽后只输出一次最终状态;空流没有可输出的状态。
            if (state.count > 0) {
                downstream.push("count=" + state.count
                    + ", last=" + state.last
                    + ", summary=" + state.summary);
            }
        });
}

List result = Stream.of("A", "B", "C")
    .gather(tailState())
    .toList();
// result 只有一项:count=3, last=C, summary=A | B | C

这里的 downstream 是下一阶段的出口,finisher 可以推送零条或多条结果。示例选择“非空流一条、空流零条”的语义,调用方就能用列表是否为空判断是否真的收到输入。

尾部状态的输出边界在哪里

下面这张结构图强调的是数据关系,不是编辑器或终端截图:每个输入只修改状态,只有输入耗尽后才由 finisher 把状态快照送入下游。

Java Gatherer 输入元素更新 TailState 后由 finisher 向 downstream 推送 count、last 和 summary 的关系示意图
场景整合函数finisher 结果处理建议
非空顺序流每项更新状态并返回 true通常一条尾部结果适合日志摘要、批次尾信息
空流不会被调用零条结果不要把“无输入”误当成 null 尾项
提前短路返回 false按短路语义收尾只在确实不再需要上游时使用
并行流可能有多个局部状态需要合并后再收尾无结合规则时保持顺序

什么时候改用 Gatherers.fold

如果只是顺序地把每个输入折叠成一个结果,可以直接使用 Gatherers.fold。它表达的是“没有可用 combiner,或归约天然依赖顺序”的场景,并且在没有异常时只产生一个元素。自定义 Gatherer 的价值在于尾部对象不只是一个单值:你可以同时保存计数、最后元素、校验摘要,或者在结束时按业务格式输出多条记录。

需要注意,ofSequential 明确放弃了并行合并能力。若要支持并行,必须让局部状态有可靠的结合规则,并使用 Gatherer.of 提供 combiner;不能简单地把一个有顺序依赖的 StringBuilder 状态搬进并行流。

常见问题与边界

为什么 finisher 没有被调用到?

先确认流确实执行了终端操作,并且不是在更早阶段抛出了异常。惰性 Stream 只有被消费时才会运行 Gatherer。

可以在 integrator 中直接输出最后一条吗?

如果“最后一条”只有在输入结束后才能确定,就不应该在 integrator 中输出;否则还会继续收到后续元素,容易产生重复或错误的尾项。

空流需要输出一个默认对象怎么办?

把默认对象的语义显式写进 finisher,并用独立的“是否收到输入”标志区分空流和真实的默认值,避免把缺失数据伪装成业务记录。

收尾判断

设计这类 Gatherer 时只看三点:状态是否只在当前评估中使用,正常结束是否统一走 finisher,以及空流和并行边界是否写清楚。这样“输入结束后输出尾部状态”就不会和短路、终端操作或线程安全混成一个问题。

版本声明
本文转载于:17golang原创 如有侵犯,请联系study_golang@163.com删除
青漫漫画用户评价可信吗?读者留言、功能体验与信息核对说明青漫漫画用户评价可信吗?读者留言、功能体验与信息核对说明
上一篇
青漫漫画用户评价可信吗?读者留言、功能体验与信息核对说明
Python sqlite3 事务模式与连接上下文管理
下一篇
Python sqlite3 事务模式与连接上下文管理
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • PubMedQA数据集详解:生物医学问答基准、功能与应用指南
    PubMedQA
    深入了解PubMedQA生物医学问答数据集,涵盖其核心功能、使用方法及在临床决策、药物研发等场景的应用,助力提升NLP模型性能。
    256次使用
  • H2O EvalGPT:开源LLM大模型评估与排行榜工具
    H2O EvalGPT
    H2O EvalGPT是H2O.ai推出的开源LLM评估平台,提供详细的大模型性能排行榜、行业特定基准测试及A/B测试功能,助您快速选择最适合项目的高性能大语言模型。
    301次使用
  • LMArena是什么?伯克利AI模型评估平台使用指南与功能解析
    LMArena
    LMArena是加州大学伯克利分校推出的AI模型匿名评测平台。通过盲测投票机制,用户可对比不同大模型回答并生成实时排行榜,助力开发者优化模型及用户选择最佳AI工具。
    278次使用
  • 斯坦福HELM:大语言模型Holistic Evaluation整体评估框架详解
    HELM
    深入了解斯坦福推出的HELM(Holistic Evaluation of Language Models)大模型评测体系。本文解析其核心功能、安装配置步骤及应用场景,涵盖准确性、公平性、鲁棒性等多维度指标,助力开发者全面优化语言模型性能。
    257次使用
  • MMBench详解:多模态大模型基准测试、功能特点与使用指南
    MMBench
    MMBench是由上海人工智能实验室等机构联合推出的多模态基准测试平台,提供细粒度能力评估、大规模数据集及VLMEvalKit工具。本文详细介绍其核心功能、安装使用方法及应用场景,助力开发者全面评估多模态模型性能。
    64次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议 和 隐私政策
返回登录
  • 重置密码