Apache Spark是用于大规模数据处理的统一分析引擎,是一个实现快速通用的集群计算平台。
1.环境的准备jdk、zookeeper、hadoop集群。当前服务器:三个服务器节点(hadoop101/hadoop102/hadoop103)2.将安装软件上传到 hadoop101服务器/opt目录下例如:spark-3.5.0-bin-hadoop3-scala2.13.tgz3.将spa
Read More