博客
关于我
强烈建议你试试无所不能的chatGPT,快点击我
MapReduce Shuffle优化方向
阅读量:7144 次
发布时间:2019-06-28

本文共 355 字,大约阅读时间需要 1 分钟。

Shuffle过程介绍可以查看该博客:http://langyu.iteye.com/blog/992916

 

优化方向:

  • 压缩:对数据进行压缩,减少写读数据量;

  • 减少不必要的排序:并不是所有类型的Reduce需要的数据都是需要排序的,排序这个nb的过程如果不需要最好还是不要的好;

  • 内存化:Shuffle的数据不放在磁盘而是尽量放在内存中,除非逼不得已往磁盘上放;当然了如果有性能和内存相当的第三方存储系统,那放在第三方存储系统上也是很好的;这个是个大招;

  • 网络框架:netty的性能据说要占优了;

  • 本节点上的数据不走网络框架:对于本节点上的Map输出,Reduce直接去读吧,不需要绕道网络框架。

 

转载于:https://www.cnblogs.com/longzhongren/p/4350673.html

你可能感兴趣的文章
搭建PXE网络实现远程装机服务
查看>>
pyinstaller打包资源文件及包含eyed3模块时提示找不到libmagic处理
查看>>
清空密码框中的内容
查看>>
Microsoft Hyper-V Server 2012快速上手之前奏
查看>>
DMAR:[fault reason 06] PTE Read access is not set
查看>>
Qt第二课 QtCreator下载安装
查看>>
句子逆序
查看>>
巴厘岛最全的美食攻略
查看>>
eclipse svn插件中英文切换
查看>>
C#学习常用命名空间【1000】---System.Reflection 之MethodInfo(方法信息类)
查看>>
Android Fragment完全解析,关于碎片你所需知道的一切
查看>>
map存储格式
查看>>
Nginx解决CORS跨域解决方案
查看>>
iPhone开发中touch的事件随笔
查看>>
115个Java面试题和答案 - 终极列表
查看>>
巧用 honeyd 实现星形结构分布式软件的压力测试框架
查看>>
数据库存储过程变量问题
查看>>
Vim的操作
查看>>
004 centos7安装jenkins
查看>>
把Nginx注册成Windows 系统服务(转载)
查看>>