万本电子书0元读

万本电子书0元读

顶部广告

大数据Spark企业级实战电子书

推荐: Java虚拟机精讲 Boost程序库完全发指南——深C++“准”标准库(第3版) 让用户体验融企业基因 Spring Batch 批处理框架 Cocos2d-x 3.X游戏发门精解(含DVD光盘1张) 游戏自动化测试实践       Life is short, you need Spark!       Spark是当今大数据领域*活跃*热门的高效的大数据通用计算平台。基于RDD,Spark成功地构建起了一体化、多元化的大数据处理体系。

售       价:¥

纸质售价:¥88.90购买纸书

57人正在读 | 0人评论 6.2

作       者:Spark亚太研究院,王家林

出  版  社:电子工业出版社

出版时间:2015-01-01

字       数:28.3万

所属分类: 科技 > 计算机/网络 > 软件系统

温馨提示:数字商品不支持退换货,不提供源文件,不支持导出打印

为你推荐

  • 读书简介
  • 目录
  • 累计评论(0条)
  • 读书简介
  • 目录
  • 累计评论(0条)
Spark是当今大数据领域活跃、热门、效的大数据通用计算平台,是Apache软件基金会下所有源项目中三大*源项目之一。 在“One Stack to rule them all”理念的指引下,Spark基于RDD成功地构建起了大数据处理的一体化解决方案,将MapReduce、Streaming、SQL、Machine Learning、Graph Processing等大数据计算模型统一到一个技术堆栈中,发者使用一致的API操作Spark中的所有功能;更为重要的是Spark的Spark SQL、MLLib、GraphX、Spark Streaming等四大子框架之间可以在内存中完美的无缝集成并可以互相操作彼此的数据,这不仅造了Spark在当今大数据计算领域其他任何计算框架都无可匹敌的优势,更使得Spark正在加速成为大数据处理中心*的和的计算平台。 《大数据Spark企业级实战》详细解析了企业级Spark发所需的几乎所有技术内容,涵盖Spark的架构设计、Spark的集群搭建、Spark内核的解析、Spark SQL、MLLib、GraphX、Spark Streaming、Tachyon、SparkR、Spark多语言编程、Spark常见问题及调优等,并且结合Spark源码细致的解析了Spark内核和四大子框架,后在附录中提供了的Spark的发语言Scala快速门实战内容,学习完此书即可胜任绝大多数的企业级Spark发需要。 《大数据Spark企业级实战》从零起步,完全从企业处理大数据业务场景的角度出发,基于实战代码来组织内容,对于一名大数据爱好者来说,《大数据Spark企业级实战》内容可以帮助您一站式地完成从零起步到行Spark企业级发所需要的全部核心内容和实战需要。<br/>【推荐语】<br/>推荐: Java虚拟机精讲 Boost程序库完全发指南——深C++“准”标准库(第3版) 让用户体验融企业基因 Spring Batch 批处理框架 Cocos2d-x 3.X游戏发门精解(含DVD光盘1张) 游戏自动化测试实践       Life is short, you need Spark!       Spark是当今大数据领域*活跃*热门的高效的大数据通用计算平台。基于RDD,Spark成功地构建起了一体化、多元化的大数据处理体系。       雅虎、Conviva、*、网易、大众评、优酷土豆、腾讯、华为等公司均在生产环境中部署了大规模的Spark。       本书完全从企业处理大数据业务场景的角度出发,完全基于实战代码来组织内容,从零起步,不需任何基础,完全无痛地掌握Spark大数据处理实战技术,源码解析:       Spark集群的动手构建       Spark架构       Spark内核的深解析       Spark四大子框架的细致剖析和实战       Tachyon文件系统揭秘       Spark多语言编程       SparkP       Spark性能调优和**实践       一站式实现Spark企业级发实战!<br/>【作者】<br/>Spark亚太研究院首席专家,中国移动互联网和云计算大数据集大成者。在Spark、Hadoop、Android等方面有丰富的源码、实务和性能优化经验。彻底研究了Spark从0.5.0到0.9.1共13个版本的Spark源码,并已完成2014年5月31日发布的Spark1.0源码研究。 Hadoop源码级专家,曾负责某知名公司的类Hadoop框架发工作,专注于Hadoop一站式解决方案的提供,同时也是云计算分布式大数据处理的早实践者之一。 Android架构师、高级工程师、咨询顾问、培训专家。 通晓Spark、Hadoop、Android、HTML5,迷恋英语播音和健美。<br/>
目录展开

前言

第1章 Spark编程模型

1.1 Spark:一体化、多元化的高速大数据通用计算平台和库

1.2 Spark大数据处理框架

1.3 Spark子框架解析

第2章 构建Spark分布式集群

2.1 搭建Hadoop单机版本和伪分布式开发环境

2.2 搭建 Hadoop分布式集群

2.3 Spark集群的动手搭建

2.4 构建Hadoop单机版本和伪分布式环境

第3章 Spark开发环境及其测试

3.1 搭建和设置IDEA开发环境

3.2 测试IDEA环境

3.3 实战:在IDEA中开发代码,并运行在Spark集群中

第4章 Spark RDD与编程API实战

4.1 深度解析Spark RDD

4.2 Transformation Operations动手实战

4.3 Action Operations动手实战

4.4 Spark API综合实战

第5章 Spark运行模式深入解析

5.1 Spark运行模式概述

5.2 Standalone模式

5.3 Yarn-Cluster模式

5.4 Yarn-Client模式

第6章 Spark内核解析

6.1 Spark内核初探

6.2 Spark内核核心源码解读

6.3 以RDD的count操作为例触发Job全生命周期源码研究

6.4 Akka驱动下的Driver、Master、Worker

第7章 GraphX大规模图计算与图挖掘实战

7.1 Spark GraphX概览

7.2 Spark GraphX设计实现的核心原理

7.3 Table operator和Graph Operator

7.4 Vertices、edges、triplets

7.5 以最原始的方式构建graph

7.6 动手编写第一个Graph代码实例并进行Vertices、edges、triplets操作

7.7 在Spark集群上使用文件中的数据加载成为graph并进行操作

7.8 在Spark集群上掌握比较重要的图操作

7.9 Spark GraphX图算法

7.10 淘宝对Spark GraphX的大规模使用

第8章 Spark SQL原理与实战

8.1 为什么使用Spark SQL

8.2 Spark SQL运行架构

8.3 解析Spark SQL组件

8.4 深入了解Spark SQL运行的计划

8.5 搭建测试环境

8.6 Spark SQL之基础应用

8.7 ThriftServer和CLI

8.8 Spark SQL之综合应用

8.9 Spark SQL之调优

第9章 Machine Learning on Spark

9.1 Spark MLlib机器学习

9.2 MLlib经典算法解析和案例实战

9.3 MLLib其他常用算法解析和代码实战

第10章 Tachyon文件系统

10.1 Tachyon文件系统概述

10.2 Tachyon入门

10.3 Tachyon深度解析

10.4 Tachyon配置参数一览

10.5 小结

第11章 Spark Streaming原理与实战

11.1 Spark Streaming原理

11.2 Spark Streaming实战

第12章 Spark多语言编程

12.1 Spark多语言编程的特点

12.2 Spark编程模型

12.3 深入Spark多语言编程

12.4 Spark多语言编程综合实例

第13章 R语言的分布式编程之SparkR

13.1 R语言快速入门

13.2 使用SparkR

第14章 Spark性能调优和最佳实践

14.1 Spark性能调优

14.2 Spark性能调优细节

第15章 Spark源码解析

15.1 BlockManager源码解析

15.2 Cache源码解析

15.3 Checkpoint源码解析

附录A 动手实战Scala三部曲

第一部 动手体验Scala

第二部 动手实战Scala面向对象编程

第三部 动手实战Scala函数式编程

累计评论(0条) 0个书友正在讨论这本书 发表评论

发表评论

发表评论,分享你的想法吧!

买过这本书的人还买过

读了这本书的人还在读

回顶部