Java之并行流(Parallel Stream)使用詳解
Java并行流(Parallel Stream)
并行流是Java 8引入的高效處理集合數(shù)據(jù)的工具,通過多線程加速計(jì)算。
以下是其核心概念、使用方法及注意事項(xiàng)的詳細(xì)指南:
1. 核心概念與原理
- 并行處理機(jī)制:將數(shù)據(jù)分割為多個(gè)塊,利用
Fork/Join框架在多個(gè)線程上并行處理,最后合并結(jié)果。 - 默認(rèn)線程池:使用
ForkJoinPool.commonPool(),線程數(shù)等于CPU核心數(shù)(可通過系統(tǒng)參數(shù)調(diào)整)。 - 適用場景:大規(guī)模數(shù)據(jù)集、計(jì)算密集型任務(wù)(如數(shù)學(xué)運(yùn)算、批量轉(zhuǎn)換)。
2. 創(chuàng)建并行流的方式
- 直接生成:通過集合的
parallelStream()方法。 - 轉(zhuǎn)換順序流:在現(xiàn)有流上調(diào)用
parallel()。
List<Integer> list = Arrays.asList(1, 2, 3, 4); // 方式1:直接生成并行流 Stream<Integer> parallelStream1 = list.parallelStream(); // 方式2:將順序流轉(zhuǎn)為并行 Stream<Integer> parallelStream2 = list.stream().parallel();
3. 適用場景與性能優(yōu)化
推薦場景:
- 數(shù)據(jù)量大:如百萬級元素的過濾、映射。
- 計(jì)算復(fù)雜:如矩陣運(yùn)算、圖像處理。
- 無狀態(tài)操作:如
map、filter、reduce(不依賴處理順序或外部變量)。
性能陷阱:
- 小數(shù)據(jù)集:并行化開銷(線程調(diào)度、數(shù)據(jù)分割)可能抵消收益。
- 低耗時(shí)操作:如簡單加減法,并行可能更慢。
4. 注意事項(xiàng)與最佳實(shí)踐
避免共享可變狀態(tài)
并行操作中修改共享變量會導(dǎo)致線程安全問題,應(yīng)使用無狀態(tài)操作或同步控制。
// 錯(cuò)誤示例:線程不安全的累加
List<Integer> nums = Arrays.asList(1, 2, 3);
int[] sum = {0};
nums.parallelStream().forEach(n -> sum += n); // 結(jié)果可能錯(cuò)誤
// 正確做法:使用歸約
int safeSum = nums.parallelStream().reduce(0, Integer::sum);謹(jǐn)慎使用有狀態(tài)操作
如sorted()、distinct()在并行流中可能更耗時(shí),需合并線程結(jié)果。
// 并行排序(可能比順序流慢) List<Integer> sortedList = nums.parallelStream().sorted().toList();
數(shù)據(jù)源的可拆分性
- 高效結(jié)構(gòu):
ArrayList、數(shù)組(支持快速隨機(jī)訪問,易于分割)。 - 低效結(jié)構(gòu):
LinkedList、TreeSet(拆分成本高)。
順序敏感操作
使用forEachOrdered保證順序,但犧牲性能。
// 按順序輸出(性能低于無序操作) list.parallelStream().forEachOrdered(System.out::println);
配置線程池
默認(rèn)線程數(shù):
Runtime.getRuntime().availableProcessors()
修改全局線程數(shù):
# JVM啟動(dòng)參數(shù) -Djava.util.concurrent.ForkJoinPool.common.parallelism=8
5. 性能對比示例
// 順序流 vs 并行流(處理1000萬數(shù)據(jù))
List<Long> numbers = LongStream.rangeClosed(1, 10_000_000)
.boxed().collect(Collectors.toList());
// 順序流耗時(shí)
long start = System.currentTimeMillis();
long seqSum = numbers.stream().mapToLong(n -> n * 2).sum();
System.out.println("順序流耗時(shí): " + (System.currentTimeMillis() - start) + "ms");
// 并行流耗時(shí)
start = System.currentTimeMillis();
long parSum = numbers.parallelStream().mapToLong(n -> n * 2).sum();
System.out.println("并行流耗時(shí): " + (System.currentTimeMillis() - start) + "ms");典型結(jié)果(8核CPU):
順序流耗時(shí): 120ms 并行流耗時(shí): 35ms
總結(jié)
優(yōu)勢:簡化多線程編程,提升大數(shù)據(jù)處理效率。
局限:不適合小數(shù)據(jù)量、順序敏感或低計(jì)算量任務(wù)。
最佳實(shí)踐:
- 優(yōu)先處理大規(guī)模數(shù)據(jù)。
- 避免操作共享變量。
- 測試驗(yàn)證性能提升。
- 使用
forEach替代forEachOrdered除非必須保證順序。
通過合理使用并行流,可在不增加復(fù)雜代碼的情況下顯著提升程序性能,但需結(jié)合場景權(quán)衡利弊。
以上為個(gè)人經(jīng)驗(yàn),希望能給大家一個(gè)參考,也希望大家多多支持腳本之家。
相關(guān)文章
使用Spring boot 的profile功能實(shí)現(xiàn)多環(huán)境配置自動(dòng)切換
這篇文章主要介紹了使用Spring boot 的profile功能實(shí)現(xiàn)多環(huán)境配置自動(dòng)切換的相關(guān)知識,非常不錯(cuò),具有一定的參考借鑒價(jià)值 ,需要的朋友可以參考下2018-11-11
Java實(shí)現(xiàn)將二叉樹展開為鏈表的兩種方法
文章介紹了兩種方法將二叉樹按前序遍歷順序展開為單鏈表,方法一為迭代法,方法二為前序遍歷+列表重建,兩者各有優(yōu)缺點(diǎn),選擇時(shí)需根據(jù)實(shí)際需求和場景考慮,下面小編給大家詳細(xì)說說2025-05-05
SpringBoot接口返回的數(shù)據(jù)時(shí)間與實(shí)際相差8小時(shí)問題排查方式
文章描述了在部署SpringBoot應(yīng)用到容器中時(shí)遇到請求接口返回時(shí)間與實(shí)際相差8小時(shí)的問題,并詳細(xì)分析了可能的原因及具體的排查步驟和解決方案,總結(jié)指出,環(huán)境初始時(shí)區(qū)未配置是根本原因,建議在應(yīng)用部署前配置好時(shí)區(qū)2025-02-02
SpringBoot中@Data注解的深度解析與實(shí)戰(zhàn)應(yīng)用
@Data是Lombok庫提供的一個(gè)核心注解,它通過簡化Java開發(fā)中常見的樣板代碼來顯著提高開發(fā)效率,下面小編就為大家詳細(xì)介紹一下@Data注解的詳細(xì)使用吧2025-10-10
JavaWeb中請求轉(zhuǎn)發(fā)和請求重定向的區(qū)別以及使用
今天帶大家學(xué)習(xí)JavaWeb的相關(guān)知識,文章圍繞著JavaWeb中請求轉(zhuǎn)發(fā)和請求重定向的區(qū)別以及使用展開,文中有非常詳細(xì)的介紹,需要的朋友可以參考下2021-06-06
Java使用分布式實(shí)現(xiàn)數(shù)據(jù)庫讀寫分離的示例代碼
在MySQL中可以通過配置主從復(fù)制來實(shí)現(xiàn)數(shù)據(jù)同步,本文主要介紹了Java使用分布式實(shí)現(xiàn)數(shù)據(jù)庫讀寫分離,具有一定的參考價(jià)值,感興趣的可以了解一下2024-07-07
SpringBoot項(xiàng)目War包部署無法注冊到Nacos中的解決
這篇文章主要介紹了SpringBoot項(xiàng)目War包部署無法注冊到Nacos中的解決方案,具有很好的參考價(jià)值,希望對大家有所幫助。如有錯(cuò)誤或未考慮完全的地方,望不吝賜教2022-01-01

