推荐: Java虚拟机精讲 Boost程序库完全发指南——深C++“准”标准库(第3版) 让用户体验融企业基因 Spring Batch 批处理框架 Cocos2d-x 3.X游戏发门精解(含DVD光盘1张) 游戏自动化测试实践 Life is short, you need Spark! Spark是当今大数据领域*活跃*热门的高效的大数据通用计算平台。基于RDD,Spark成功地构建起了一体化、多元化的大数据处理体系。
售 价:¥
纸质售价:¥88.90购买纸书
温馨提示:数字商品不支持退换货,不提供源文件,不支持导出打印
为你推荐
前言
第1章 Spark编程模型
1.1 Spark:一体化、多元化的高速大数据通用计算平台和库
1.2 Spark大数据处理框架
1.3 Spark子框架解析
第2章 构建Spark分布式集群
2.1 搭建Hadoop单机版本和伪分布式开发环境
2.2 搭建 Hadoop分布式集群
2.3 Spark集群的动手搭建
2.4 构建Hadoop单机版本和伪分布式环境
第3章 Spark开发环境及其测试
3.1 搭建和设置IDEA开发环境
3.2 测试IDEA环境
3.3 实战:在IDEA中开发代码,并运行在Spark集群中
第4章 Spark RDD与编程API实战
4.1 深度解析Spark RDD
4.2 Transformation Operations动手实战
4.3 Action Operations动手实战
4.4 Spark API综合实战
第5章 Spark运行模式深入解析
5.1 Spark运行模式概述
5.2 Standalone模式
5.3 Yarn-Cluster模式
5.4 Yarn-Client模式
第6章 Spark内核解析
6.1 Spark内核初探
6.2 Spark内核核心源码解读
6.3 以RDD的count操作为例触发Job全生命周期源码研究
6.4 Akka驱动下的Driver、Master、Worker
第7章 GraphX大规模图计算与图挖掘实战
7.1 Spark GraphX概览
7.2 Spark GraphX设计实现的核心原理
7.3 Table operator和Graph Operator
7.4 Vertices、edges、triplets
7.5 以最原始的方式构建graph
7.6 动手编写第一个Graph代码实例并进行Vertices、edges、triplets操作
7.7 在Spark集群上使用文件中的数据加载成为graph并进行操作
7.8 在Spark集群上掌握比较重要的图操作
7.9 Spark GraphX图算法
7.10 淘宝对Spark GraphX的大规模使用
第8章 Spark SQL原理与实战
8.1 为什么使用Spark SQL
8.2 Spark SQL运行架构
8.3 解析Spark SQL组件
8.4 深入了解Spark SQL运行的计划
8.5 搭建测试环境
8.6 Spark SQL之基础应用
8.7 ThriftServer和CLI
8.8 Spark SQL之综合应用
8.9 Spark SQL之调优
第9章 Machine Learning on Spark
9.1 Spark MLlib机器学习
9.2 MLlib经典算法解析和案例实战
9.3 MLLib其他常用算法解析和代码实战
第10章 Tachyon文件系统
10.1 Tachyon文件系统概述
10.2 Tachyon入门
10.3 Tachyon深度解析
10.4 Tachyon配置参数一览
10.5 小结
第11章 Spark Streaming原理与实战
11.1 Spark Streaming原理
11.2 Spark Streaming实战
第12章 Spark多语言编程
12.1 Spark多语言编程的特点
12.2 Spark编程模型
12.3 深入Spark多语言编程
12.4 Spark多语言编程综合实例
第13章 R语言的分布式编程之SparkR
13.1 R语言快速入门
13.2 使用SparkR
第14章 Spark性能调优和最佳实践
14.1 Spark性能调优
14.2 Spark性能调优细节
第15章 Spark源码解析
15.1 BlockManager源码解析
15.2 Cache源码解析
15.3 Checkpoint源码解析
附录A 动手实战Scala三部曲
第一部 动手体验Scala
第二部 动手实战Scala面向对象编程
第三部 动手实战Scala函数式编程
买过这本书的人还买过
读了这本书的人还在读
同类图书排行榜