当前位置: 首页 > 大数据

大数据Spark企业级实战版pdf电子书

简介大数据Spark企业级实战版中文版怎么样? Spark是当今大数据领域最活跃、最热门、最高效的大数据通用计算平台,是Apache软件基金会下所有开源项目中三大顶级开源项目之一。 在...
《大数据Spark企业级实战版》pdf电子书百度网盘下载
《大数据Spark企业级实战版》pdf电子书百度网盘下载

 

大数据Spark企业级实战版中文版怎么样?最新电子版百度云下载

Spark是当今大数据领域最活跃、最热门、最高效的大数据通用计算平台,是Apache软件基金会下所有开源项目中三大顶级开源项目之一。

在“One Stack to rule them all”理念的指引下,Spark基于RDD成功地构建起了大数据处理的一体化解决方案,将MapReduce、Streaming、SQL、Machine Learning、Graph Processing等大数据计算模型统一到一个技术堆栈中,开发者使用一致的API操作Spark中的所有功能;更为重要的是Spark的Spark SQL、MLLib、GraphX、Spark Streaming等四大子框架之间可以在内存中完美的无缝集成并可以互相操作彼此的数据,这不仅打造了Spark在当今大数据计算领域其他任何计算框架都无可匹敌的优势,更使得Spark正在加速成为大数据处理中心首选的和唯一的计算平台。

《大数据Spark企业级实战》详细解析了企业级Spark开发所需的几乎所有技术内容,涵盖Spark的架构设计、Spark的集群搭建、Spark内核的解析、Spark SQL、MLLib、GraphX、Spark Streaming、Tachyon、SparkR、Spark多语言编程、Spark常见问题及调优等,并且结合Spark源码细致的解析了Spark内核和四大子框架,最后在附录中提供了的Spark的开发语言Scala快速入门实战内容,学习完此书即可胜任绝大多数的企业级Spark开发需要。

《大数据Spark企业级实战》从零起步,完全从企业处理大数据业务场景的角度出发,基于实战代码来组织内容,对于一名大数据爱好者来说,《大数据Spark企业级实战》内容可以帮助您一站式地完成从零起步到进行Spark企业级开发所需要的全部核心内容和实战需要。


作者简介:
Spark亚太研究院首席专家,中国移动互联网和云计算大数据集大成者。在Spark、Hadoop、Android等方面有丰富的源码、实务和性能优化经验。彻底研究了Spark从0.5.0到0.9.1共13个版本的Spark源码,并已完成2014年5月31日发布的Spark1.0源码研究。 Hadoop源码级专家,曾负责某知名公司的类Hadoop框架开发工作,专注于Hadoop一站式解决方案的提供,同时也是云计算分布式大数据处理的最早实践者之一。 Android架构师、高级工程师、咨询顾问、培训专家。 通晓Spark、Hadoop、Android、HTML5,迷恋英语播音和健美。

目录:
第1章 Spark编程模型 1
第2章 构建Spark分布式集群 55
第3章 Spark开发环境及其测试 129
第4章 Spark RDD与编程API实战 159
第5章 Spark运行模式深入解析 191
第6章 Spark内核解析 247
第7章 GraphX大规模图计算与图挖掘实战 287
第8章 Spark SQL原理与实战 349
第9章 Machine Learning on Spark 431
第10章 Tachyon文件系统 565
第11章 Spark Streaming原理与实战 581
第12章 Spark多语言编程 605
第13章 R语言的分布式编程之SparkR 627
第14章 Spark性能调优和最佳实践 665
第15章 Spark源码解析 679

点击下载