当前位置 博文首页 > Spark-shell批量命令执行脚本的方法

    Spark-shell批量命令执行脚本的方法

    作者:小蜗牛也有梦想 时间:2021-02-15 06:31

    批量执行spark-shell命令,并指定提交参数

    #!/bin/bash
    
    source /etc/profile
    
    exec $SPARK_HOME/bin/spark-shell --queue tv --name spark-sql-test --executor-cores 8 --executor-memory 8g --num-executors 8 --conf spark.cleaner.ttl=240000 <<!EOF
    import org.apache.spark.sql.SaveMode
    sql("set hive.exec.dynamic.partition=true")
    sql("set hive.exec.dynamic.partition.mode=nonstrict")
    sql("use hr")
    sql("SELECT * FROM t_abc ").rdd.saveAsTextFile("/tmp/out") 
    sql("SELECT * FROM t_abc").rdd.map(_.toString).intersection(sc.textFile("/user/hdfs/t2_abc").map(_.toString).distinct).count
    !EOF

    以上这篇Spark-shell批量命令执行脚本的方法就是小编分享给大家的全部内容了,希望能给大家一个参考,也希望大家多多支持站长博客。

    js