阅读背景:

Spark学习(一)SparkStreaming的官方文档

来源:互联网 

官网地址

1、简介

1.1 概述

Spark Streaming 是Spark核心API的一个扩展,可以实现高吞吐量的、具备容错机制的实时流数据的处理。支持从多种数据源获取数据,包括Kafk、Flume、Twitter、ZeroMQ、Kinesis 以及TCP sockets,从数据源获取数据之后,可以使用诸如map、reduce、join和window等高级函数进行复杂算法的处理。最后还可以将处理结果存储到文件系统,数据库和现场仪表盘。在“One Stack rule them all”的基础上,还可以使用Spark的其他子框架,如机器学习、图计算等,对流数据进行处理。Spark Streaming 是Spark核心




你的当前访问异常,请进行认证后继续阅读剩余内容。

分享到: