在传统大数据架构中,批量计算与流式计算长期由两套独立引擎承载:批处理依赖 MapReduce/Spark 等离线引擎,流处理依赖 Storm/Spark Streaming/Flink 等实时引擎。这