使用IntelliJ IDEA配置Spark应用开发环境及源码阅读环境 含提交到集群.docx_第1页
使用IntelliJ IDEA配置Spark应用开发环境及源码阅读环境 含提交到集群.docx_第2页
使用IntelliJ IDEA配置Spark应用开发环境及源码阅读环境 含提交到集群.docx_第3页
使用IntelliJ IDEA配置Spark应用开发环境及源码阅读环境 含提交到集群.docx_第4页
使用IntelliJ IDEA配置Spark应用开发环境及源码阅读环境 含提交到集群.docx_第5页
已阅读5页,还剩1页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

使用IntelliJ IDEA配置Spark应用开发环境及源码阅读环境(基础)时间2016-03-04 13:13:09极客头条原文http:/blog.tomgou.xyz/shi-yong-intellij-ideapei-zhi-sparkying-yong-kai-fa-huan-jing-ji-yuan-ma-yue-du-huan-jing.html主题SparkIntelliJ IDEA在本地搭建好Spark 1.6.0后,除了使用官方文档中的sbt命令打包,spark-submit提交程序外,我们可以使用IntelliJ IDEA这个IDE在本地进行开发调试,之后再将作业提交到集群生产环境中运行,使用IDE可以提升我们的开发效率。0.安装IntelliJ IDEA我的系统环境(Ubuntu 14.04.4 LTS)下载最新版本的IntelliJ IDEA,官网地址:/idea/download/。 最新版本的IntelliJ IDEA支持新建SBT工程,安装scala插件。安装步骤: - Unpack the idea idea-15.0.4.tar.gz file using the following command: tar xfz idea-15.0.4.tar.gz - Run idea.sh from the bin subdirectory.记得在IntelliJ IDEA的“Configure”菜单中,选择“Plugins”,安装“Scala”插件。1.以本地local模式运行Spark程序1)创建“New Project”,选择“Scala”。“Project SDK”选择JDK目录,“Scala SDK”选择Scala目录。2)选择菜单中的“File” -“Project Structure” -“libraries” -+“java”,导入Spark安装目录/home/tom/spark-1.6.0/lib下的“spark-assembly-1.6.0-hadoop2.6.0.jar”。3)运行Scala示例程序SparkPi: Spark安装目录的examples目录下,可以找到Scala编写的示例程序SparkPi.scala,该程序计算Pi值并输出。 在Project的main目录下新建SparkPitest.scala,复制Spark示例程序代码。选择菜单中的“Run” -“Edit Configurations”,修改“Main class”和“VM options”。运行结果:注意: 在我最初运行Spark的测试程序SparkPi时,点击运行,出现了如下错误: Exception in thread main org.apache.spark.SparkException: A master URL must be set in your configuration 从提示中可以看出找不到程序运行的master,此时需要配置环境变量。 搜索引擎查询错误后,了解到传递给spark的master url可以有如下几种,具体可以查看Spark官方文档: - local 本地单线程 - localK 本地多线程(指定K个内核) - local* 本地多线程(指定所有可用内核) - spark:/HOST:PORT 连接到指定的 Spark standalone cluster master,需要指定端口。 - mesos:/HOST:PORT 连接到指定的 Mesos 集群,需要指定端口。 - yarn-client客户端模式 连接到 YARN 集群。需要配置 HADOOP_CONF_DIR。 - yarn-cluster集群模式 连接到 YARN 集群。需要配置 HADOOP_CONF_DIR。在VM options中输入“-Dspark.master=local”,指示本程序本地单线程运行。2.生成jar包提交到集群1)和本地local模式运行Spark相同,我们建立起project。2)选择菜单中的“File” -“Project Structure” -“Artifact” -“jar” -“From Modules with dependencies”,之后选择Main Class和输出jar的Directory。3)在主菜单选择“Build” -“Build Artifact”,编译生成jar包。 4)将jar包使用spark-submit提交:$SPARK_HOME/bin/spark-submit -class SimpleApp -master local4 simple.jar3.配置Spark源码阅读环境克隆Spark源码:$ git clone https:/

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论