4.7 课后作业
一、简答题
1.对比大数据离线批量计算与流式计算的特点及应用场景。
2.什么是分布式流式计算?
3.简述分布式流式计算主要步骤。
4.试述Storm架构及工作机制。
5.简述Topology提交流程。
6.试述大数据内存计算框架。
7.简述Spark Streaming数据处理流程。
8.简述Spark Streaming编程思想。
9.试比较Storm和Spark Streaming。
10.简述Spark生态系统。(https://www.daowen.com)
二、术语解释
1.Topology
2.Stream
3.Spout
4.Bolt
5.Nimbus
6.Supervisor
7.Worker
8.DStream
9.RDD