【Spark 调优】Spark 开发调优的十大原则
发布日期:2021-05-08 01:13:08 浏览次数:32 分类:精选文章

本文共 217 字,大约阅读时间需要 1 分钟。

Spark的调优是面试或者笔试考察的重点:总结下

                                 

                                                                                    1.开发调优: 

原则一:避免创建重复的RDD。

原则二:尽可能复用同一个RDD。

原则三:对多次使用的RDD进行持久化。

原则四:尽量避免使用shuffle类算子 。

原则五:使用map-side预聚合的shuffle操作。

原则六:使用高性能的算子

原则七:广播大变量。

原则八:使用Kryo优化序列化性能。

原则九:优化数据结构。

原则十:对数据进行压缩。

原则十一:合并小文件。 

上一篇:Java监听器,定时器
下一篇:web项目的项目结构解析

发表评论

最新留言

感谢大佬
[***.8.128.20]2025年04月03日 22时13分32秒