当前位置:

首页 > 编程开发 > Java Stream Collector 高级用法:定制化累加器与收集器实现

Java Stream Collector 高级用法:定制化累加器与收集器实现

本文深入探讨了JavaStreamAPI中Collector的高级定制化实现,重点讲解了如何灵活选择和设计累加器类型(A),以及如何使用Collector.of()方法构建自定义收集器。通过具体示例,展示了利用基本类型数组、现有可变类型、匿名内部类等作为累加器,有效避免了不必要的类创建,提升了代码的简洁性和灵活性。

Java Stream Collector 高级用法:定制化累加器与收集器实现

本文深入探讨了 Java Stream API 中 Collector 的高级定制化实现,重点讲解了如何灵活选择和设计累加器类型 (A),以及如何使用 Collector.of() 方法构建自定义收集器。通过具体示例,展示了利用基本类型数组、现有可变类型、匿名内部类等作为累加器,有效避免了不必要的类创建,提升了代码的简洁性和灵活性。

理解 Collector 接口及其泛型

java.util.stream.Collector 接口是 Java Stream API 中一个核心组件,用于将流中的元素聚合成一个结果。它定义了三种泛型类型:

  • T:流中元素的类型。
  • A:累加器(accumulator)的类型,这是一个可变的中间结果类型,用于在收集过程中存储状态。它通常是实现细节,不对外暴露。
  • R:最终结果的类型,即收集操作完成后返回的类型。

要创建一个自定义的 Collector,最常用的方法是使用 Collector.of() 工厂方法,它需要四个核心函数式接口作为参数:

  1. supplier: 一个 Supplier,用于创建新的累加器实例。
  2. accumulator: 一个 BiConsumer,用于将流中的单个元素 T 合并到累加器 A 中。
  3. combiner: 一个 BinaryOperator,用于将两个累加器 A 合并成一个(在并行流中特别有用)。
  4. finisher: 一个 Function,用于将最终的累加器 A 转换成最终结果 R。

一个常见的误解是,累加器类型 A 必须是一个独立的、专门为此目的创建的具名类,并且其方法(如 supply、accumulate、combine、finish)需要直接在 Collector 的实现中引用该类的静态方法或实例方法。实际上,Collector.of() 的函数参数提供了极大的灵活性,允许我们使用各种方式来定义这些行为,而无需强制创建额外的具名类。

灵活选择累加器类型

累加器类型 A 的选择是实现自定义 Collector 的关键。它不一定非得是一个复杂的自定义类,可以是以下几种类型:

1. 使用基本类型数组作为累加器

对于简单的数值累加,一个单元素的基本类型数组(如 int[])是一个非常高效且简洁的累加器。它提供了可变性,并且避免了装箱拆箱的开销。

示例:计算流中整数的和

import java.util.stream.Collector;
import java.util.stream.Stream;

public class CustomSumCollector {

    /**
     * 创建一个收集器,用于计算整数流的总和。
     * 累加器类型为 int[1],其中数组的第一个元素存储当前和。
     *
     * @return 收集整数到其总和的收集器。
     */
    public static Collector sum() {
        return Collector.of(
            () -> new int[1], // supplier: 创建一个长度为1的int数组作为累加器
            (a, i) -> a[0] += i, // accumulator: 将元素i加到数组的第一个元素
            (a, b) -> { a[0] += b[0]; return a; }, // combiner: 合并两个累加器
            a -> a[0], // finisher: 返回数组的第一个元素作为最终结果
            Collector.Characteristics.UNORDERED // 标识收集器不关心元素顺序
        );
    }

    public static void main(String[] args) {
        Stream numbers = Stream.of(1, 2, 3, 4, 5);
        Integer totalSum = numbers.collect(sum());
        System.out.println("Sum using custom collector: " + totalSum); // Output: Sum using custom collector: 15
    }
}

在这个例子中,int[1] 作为累加器 A,简洁地完成了累加任务。

2. 使用现有可变类型作为累加器

Java 标准库中提供了许多可变的类,它们可以直接用作累加器,特别是当需要考虑线程安全时。

示例:使用 AtomicInteger 计算流中整数的和(并发安全)

import java.util.concurrent.atomic.AtomicInteger;
import java.util.stream.Collector;
import java.util.stream.Stream;

public class ConcurrentSumCollector {

    /**
     * 创建一个并发安全的收集器,用于计算整数流的总和。
     * 累加器类型为 AtomicInteger。
     *
     * @return 并发收集整数到其总和的收集器。
     */
    public static Collector concurrentSum() {
        return Collector.of(
            AtomicInteger::new, // supplier: 创建一个新的 AtomicInteger 实例
            AtomicInteger::addAndGet, // accumulator: 将元素i原子地加到 AtomicInteger 中
            (a, b) -> { a.addAndGet(b.intValue()); return a; }, // combiner: 合并两个 AtomicInteger
            AtomicInteger::intValue, // finisher: 返回 AtomicInteger 的值作为最终结果
            Collector.Characteristics.UNORDERED,
            Collector.Characteristics.CONCURRENT // 标识收集器支持并发
        );
    }

    public static void main(String[] args) {
        Stream numbers = Stream.of(1, 2, 3, 4, 5);
        Integer totalSum = numbers.collect(concurrentSum());
        System.out.println("Concurrent sum using custom collector: " + totalSum); // Output: Concurrent sum using custom collector: 15
    }
}

AtomicInteger 天然提供了线程安全的原子操作,非常适合在并行流中使用。

3. 使用匿名内部类或 Ad-hoc 类型作为累加器

当没有合适的现有类型,并且不想创建新的具名类时,可以使用匿名内部类或 Object 的子类(通常通过 new Object() {} 语法)作为累加器。这种方式将累加器的定义局部化在 Collector 的实现内部,增加了封装性。

示例:收集 Map.Entry 流中具有最大值的键列表

假设我们有一个 Map.Entry 的流,我们希望找出所有具有最大值的键,并以 List 的形式返回。

方法一:使用 AbstractMap.SimpleEntry 作为累加器

AbstractMap.SimpleEntry 可以作为一个简单的键值对容器,这里我们用它来存储当前找到的最大值 (Integer) 和对应的键列表 (List)。

import java.util.*;
import java.util.stream.Collector;
import java.util.stream.Stream;

public class KeysToMaximumCollector {

    /**
     * 收集 Map.Entry 流中具有最大值的键列表。
     * 累加器类型为 AbstractMap.SimpleEntry, Integer>。
     *
     * @param  键的类型
     * @return 收集器,返回具有最大值的键列表。
     */
    public static  Collector, ?, List> keysToMaximum() {
        return Collector.of(
            () -> new AbstractMap.SimpleEntry<>(new ArrayList<>(), Integer.MIN_VALUE), // supplier: 初始累加器
            (current, next) -> { // accumulator: 处理每个 Map.Entry
                int max = current.getValue();
                int value = next.getValue();
                if (value >= max) {
                    if (value > max) { // 找到更大的值,清空旧列表,更新最大值
                        current.setValue(value);
                        current.getKey().clear();
                    }
                    current.getKey().add(next.getKey()); // 添加当前键
                }
            },
            (a, b) -> { // combiner: 合并两个累加器
                int maxA = a.getValue();
                int maxB = b.getValue();
                if (maxA < maxB) return b; // B 的最大值更大,返回 B
                if (maxA == maxB) a.getKey().addAll(b.getKey()); // 最大值相同,合并键列表
                return a; // 否则返回 A
            },
            Map.Entry::getKey // finisher: 返回累加器中的键列表
        );
    }

    public static void main(String[] args) {
        Map map = new HashMap<>();
        map.put("A", 10);
        map.put("B", 20);
        map.put("C", 15);
        map.put("D", 20);
        map.put("E", 5);

        List keys = map.entrySet().stream().collect(keysToMaximum());
        System.out.println("Keys with maximum value: " + keys); // Output: Keys with maximum value: [B, D] (顺序可能不同)
    }
}

方法二:使用匿名内部类作为累加器

这种方式创建了一个只在 Collector 内部可见的、具有特定字段的匿名对象作为累加器。

import java.util.*;
import java.util.stream.Collector;
import java.util.stream.Stream;

public class KeysToMaximumAdHocCollector {

    /**
     * 收集 Map.Entry 流中具有最大值的键列表。
     * 累加器类型为匿名内部类。
     *
     * @param  键的类型
     * @return 收集器,返回具有最大值的键列表。
     */
    public static  Collector, ?, List> keysToMaximum() {
        return Collector.of(
            () -> new Object() { // supplier: 创建一个匿名内部类实例作为累加器
                int max = Integer.MIN_VALUE;
                final List keys = new ArrayList<>();
            },
            (current, next) -> { // accumulator: 处理每个 Map.Entry
                int value = next.getValue();
                if (value >= current.max) {
                    if (value > current.max) {
                        current.max = value;
                        current.keys.clear();
                    }
                    current.keys.add(next.getKey());
                }
            },
            (a, b) -> { // combiner: 合并两个匿名内部类累加器
                if (a.max < b.max) return b;
                if (a.max == b.max) a.keys.addAll(b.keys);
                return a;
            },
            a -> a.keys // finisher: 返回累加器中的键列表
        );
    }

    public static void main(String[] args) {
        Map map = new HashMap<>();
        map.put("A", 10);
        map.put("B", 20);
        map.put("C", 15);
        map.put("D", 20);
        map.put("E", 5);

        List keys = map.entrySet().stream().collect(keysToMaximum());
        System.out.println("Keys with maximum value (ad-hoc): " + keys); // Output: Keys with maximum value (ad-hoc): [B, D] (顺序可能不同)
    }
}

这两种方法都避免了为累加器单独创建一个具名类,使代码更加紧凑和局部化。

注意事项与总结

  1. 累加器类型的选择

  2. 函数式接口的实现

  3. Collector.Characteristics

通过灵活运用 Collector.of() 方法,并根据实际需求选择合适的累加器类型,开发者可以创建出高效、简洁且功能强大的自定义收集器,从而更好地利用 Java Stream API 的能力。无需为每个自定义收集器都创建独立的累加器类,这大大简化了代码结构和维护成本。

本文内容来源于互联网,如有侵权请联系删除。
作者最新文章
编程开发
相关文章 更多
C++动态数组初始化怎么写?常用语句与代码示例
C++动态数组初始化怎么写?常用语句与代码示例

深入解析C++中动态数组的初始化机制,涵盖new操作符的不同用法、基本类型与类对象的初始化差异,以及为何在现代C++开发中应优先使用std::vector。

using namespace 使用中遇到的问题怎么解决
using namespace 使用中遇到的问题怎么解决

命名空间的基本概念与常见引入问题在C++等编程语言中,命名空间(namespace)是一种将代码标识符(如变量、函数、类名)封装在特定名称下的机制,其主要目的是避免命名冲突,尤其是在大型项目或使用多个第三方库时。使用“using namespace”指令可以将指定命名空间中的所有名称引入当前作用域,

c语言函数递归 实操经验总结:这些技巧很实用
c语言函数递归 实操经验总结:这些技巧很实用

理解递归的基本原理在C语言中,递归是一种函数调用自身的编程技术。要掌握它,首先需要理解其核心思想:将一个复杂的大问题,分解为一个或几个与原问题相似但规模更小的子问题,直到子问题足够简单,可以直接求解。这个过程通常包含两个关键部分:递归出口和递归体。递归出口定义了问题何时不再继续分解,即最简单、可直接

c语言函数递归 怎么选?常见方案对比分析
c语言函数递归 怎么选?常见方案对比分析

递归函数的基本概念与适用场景在C语言编程中,递归是一种函数调用自身的编程技巧。它并非适用于所有问题,但在处理某些具有自相似结构的问题时,能提供极其清晰和优雅的解决方案。递归的核心思想是将一个大规模问题分解为一个或多个同类型但规模更小的子问题,直到子问题简单到可以直接求解。典型的适用场景包括树形结构的

Objective-C 内存管理入门:从 alloc 到 dealloc 的生命周期详解
Objective-C 内存管理入门:从 alloc 到 dealloc 的生命周期详解

理解内存管理的基石在Objective-C的编程世界中,内存管理是开发者必须掌握的核心技能之一。它直接关系到应用的性能、稳定性与资源利用效率。与一些采用自动垃圾回收机制的语言不同,Objective-C在很长一段时间里,依赖一套基于引用计数的、需要开发者部分介入的管理规则。这套规则的核心思想是明确的

如何正确使用 dealloc 以避免 iOS 应用中的内存泄漏
如何正确使用 dealloc 以避免 iOS 应用中的内存泄漏

理解 dealloc 的角色与时机在 iOS 应用开发中,内存管理是保障应用性能与稳定性的基石。dealloc 方法是 Objective-C 中对象生命周期结束时的关键回调,它标志着对象即将被系统回收内存。正确理解其触发时机至关重要:当一个对象的引用计数降为零时,运行时系统会自动调用该对象的 de

深入理解 Objective-C 中的 dealloc 方法:内存管理核心机制
深入理解 Objective-C 中的 dealloc 方法:内存管理核心机制

内存管理的基石在Objective-C的世界里,内存管理是开发者必须掌握的核心技能之一。作为一门在手动引用计数(MRC)时代诞生的语言,Objective-C要求程序员对对象的生命周期有清晰的认识。dealloc方法正是这一生命周期中至关重要的终点站。它是一个实例方法,当对象的引用计数降为零时,系统

理解 native2ascii:Java 国际化开发中的字符编码工具
理解 native2ascii:Java 国际化开发中的字符编码工具

native2ascii 工具的基本定位在Ja va应用程序的国际化与本地化开发过程中,处理非拉丁字符集是一个常见且关键的环节。Ja va内部使用Unicode字符集来统一表示全球各种语言的文字,但其属性文件(.properties)在历史上要求使用ASCII编码,或者更准确地说,要求非ASCII字

如何使用 native2ascii 转换中文字符为 Unicode 转义序列
如何使用 native2ascii 转换中文字符为 Unicode 转义序列

理解 native2ascii 工具的基本用途在软件开发,特别是涉及国际化处理的场景中,开发者常常需要处理不同编码的文本资源。native2ascii 是 Ja va 开发工具包(JDK)中提供的一个命令行实用程序,其主要功能是将包含本地字符编码(非ASCII字符)的文件,转换为包含 Unicode

Java native2ascii 命令详解:解决属性文件乱码问题
Java native2ascii 命令详解:解决属性文件乱码问题

native2ascii 命令的由来与作用在Ja va开发中,处理国际化资源文件是一个常见需求。资源文件通常以.properties格式存储,用于支持多语言界面。然而,Ja va属性文件默认采用ISO-8859-1字符集编码,这导致了一个直接的问题:当文件中包含非拉丁字符(如中文、日文、韩文等)时,

查看更多
精品专题 更多
装机必备
装机必备

正软商城装机必备专区,精选办公、浏览器、安全防护、影音播放、压缩解压、设计创作和系统工具等电脑常用正版软件,帮助用户快速完成新电脑软件配置。

Windows
Windows

正软商城Windows软件专区,汇集适用于Windows电脑的办公、设计、安全防护、影音播放、开发工具和系统优化软件,提供软件介绍、系统要求、正版授权及购买下载服务。

macOS软件
macOS软件

正软商城macOS软件专区,精选适用于Mac电脑的办公、设计、影音、效率、开发和系统工具,提供软件功能介绍、macOS兼容版本、正版授权及购买下载服务。

Mac软件 更多
灵活计算器
灵活计算器
macOS/iOS/Android

灵活计算器是一款笔记式算数应用,支持实时计算、动态关联和云端同步功能。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

赤友清理大师
赤友清理大师
macOS

赤友清理大师是一款为 Mac 设计的智能清理优化工具,可精准扫描垃圾、大文件、重复文件等,释放磁盘空间。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

WINDOWS 更多
Windows 10
Windows 10
Windows

Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

密码键盘
密码键盘
Windows/macOS/iOS/Android

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。