内容简介

《Hadoop技术内幕》从应用角度系统讲解了YARN的基本库和组件用法、应用程序设计方法、YARN上流行的各种计算框架(MapReduce、Tez、Storm、Spark),以及多个类YARN的开源资源管理系统(Corona和Mesos);从源代码角度深入分析YARN的设计理念与基本架构、各个组件的实现原理,以及各种计算框架的实现细节。

全书共四部分13章:第一部分(第1~2章)主要介绍了如何获取、阅读和调试Hadoop的源代码,以及YARN的设计思想、基本架构和工作流程;第二部分(第3~7章)结合源代码详细剖析和讲解了YARN的第三方开源库、底层通信库、服务库、事件库的基本使用和实现细节,详细讲解了YARN的应用程序设计方法,深入讲解和分析了ResourceManager、资源调度器、NodeManager等组件的实现细节;第三篇(第8~10章)则对离线计算框架MapReduce、DAG计算框架Tez、实时计算框架Storm和内存计算框架Spark进行了详细的讲解;第四部分(第11~13章)首先对Facebook Corona和Apache Mesos进行了深入讲解,然后对YARN的发展趋势进行了展望。附录部分收录了YARN安装指南、YARN配置参数以及Hadoop Shell命令等非常有用的资料。

下载地址

豆瓣评论

  • 33迟来_小小岛
    直接是在前一本上面扩写 而且写的非常混乱 可见作者只是在混05-02
  • 阅微草堂
    透明与封装是对初学者最大的仁慈。工作中用到,查查。工作流程,组件和协议。RPC远程框架03-14
  • bryan
    前面看着还可以,后面重复比较多,特别是一堆状态机,干货就比较少了。10-21
  • tomsheep
    解答了我的很多疑问。但我不是很喜欢在书里大段贴代码的做法,好在本身组织的还不错09-24
  • [已注销]
    最早的入门图书了,思路很清晰,但是代码太少,感觉不够深入,点到为止了07-26

猜你喜欢

大家都喜欢