全部产品

Spark用户手册

更新时间:2019-07-25 15:40:21

概述

Spark是专为大规模数据处理而设计的快速通用的计算引擎,应用非常广泛。本文主要介绍Spark相关的知识,主要包括:了解Spark,使用Spark,Spark典型案例(包括实现)、使用Spark过程中遇到的问题FAQ等,谨帮助用户快速了解Spark、以及如何使用Spark。本文内容是面对开发者的用户手册,在开发过程中可以用来查阅此手册。

大纲

基础篇

  1. Spark的入门介绍
    1. 如何使用X-Pack Spark的YarnUI、SparkUI、Spark日志、任务运行状况的分析.
    2. Spark 通用的性能配置方法:内存(executor-memory)和CPU(executor-cores)的配置
    3. Spark本地连接hbase集群做调试.
  2. Spark SQL语法介绍
  3. Spark Streaming介绍(待完善)
  4. Structured Streaming介绍(待完善)
  5. Spark DataSource外部数据源介绍(待完善)

进阶篇(高级功能)

X-Pack Spark使用[FAQ]

FAQ明细请参考:X-Pack Spark使用FAQ

X-Pack Spark之性能优化

  1. Spark Streaming 常见优化。

案例实战

  1. 广告点击数实时统计:Spark StructuredStreaming + Redis Streams
  2. SparkSQL在有赞的实践
  3. HBase+Spark游戏大数据的实践
  4. X-Pack Spark对接阿里云日志服务LogHub