首页手记 [译]Spark 2.1.0官方文档翻译

[译]Spark 2.1.0官方文档翻译

标签：

Spark

注：
1. 本文链接中，包含[]的为已翻译的文档链接，不包含的为官方文档链接。
2. 涉及到编程语言的部分，以翻译Scala的部分为主

Spark概述

Apache Spark是一个快速的，通用的集群计算系统。在Java，Scala，Python和R语言中提供了高层API，并提供一个支持一般图形计算的优化引擎。Spark支持一个丰富的高层工具集，包括Spark SQL用于SQL和结构化数据处理，MLLib用于机器学习，GraphX用于图处理和Spark Streaming。

下载

从官网下载页面获取Spark。本文档适用于Spark 2.1.0版本。Spark为使用HDFS和YARN而需要用到Hadoop客户端库。下载包是为适配主流Hadoop版本预先打包好的。用户还可以下载"Hadoop free"二进制文件，然后通过配置Spark的classpath在任意版本的Hadoop中运行Spark。Scala和Java用户可以使用maven cooridnates在项目中包含Spark。将来Python用户也可以从PyPI中安装Spark。

如果想要从源码编译Spark，访问构建Spark。

Spark可以在Windows和类UNIX系统（如Linux，Mac OS）上运行。Spark很容易在一台机器上本地运行——你需要做的就是在系统PATH上安装了Java，或者在JAVA_HOME环境变量中指定了Java的安装路径。

Spark可以运行在Java 7+，Python 2.6+/3.4+，R 3.1+环境上。对于Scala API，Spark 2.1.0使用的是Scala 2.11。你需要使用一个可兼容的Scala版本（2.11.x）。

请注意，从Spark 2.0.0开始，对Java 7和Python 2.6的支持已弃用，从Spark 2.1.0开始，对Scala 2.10和Hadoop 2.6之前版本的支持已弃用，在Spark 2.2.0时可能会被删除。

运行示例和Shell

Spark自带几个示例程序。Scala，Java，Python和R语言的示例在 examples/src/main 目录下。要运行Java或者Scala示例程序，在Spark的根目录中使用bin/run-example <class> [params]（在后台，将调用更通用的spark-submit脚本来启动应用程序）。例如：

./bin/run-example SparkPi 10

也可以使用一个修改版的Scala Shell以交互方式运行Spark。这是一种学习框架非常好的方式。

./bin/spark-shell --master local[2]

其中--master选项指定了分布式集群的master URL，local以单线程在本地运行，local[N]以N个线程在本地运行。你应该首先使用local来进行测试。完整的选项列表，可使用--help选项来运行Spark。

Spark也提供了Python API。要在Python解释器中以交互方式运行Spark，使用bin/pyspark：

./bin/pyspark --master local[2]

Spark也提供了Python的示例应用程序，例如，

./bin/spark-submit examples/src/main/python/pi.py 10

Spark从1.4版本开始就提供了一个实验的R API（只包含DataFrames API）。要在R语言解释器中交互式地运行Spark，使用bin/sparkR：

./bin/sparkR --master local[2]

Spark也提供了R语言的示例应用程序，例如，

./bin/spark-submit examples/src/main/r/dataframe.R

作者：steanxy
链接：https://www.jianshu.com/p/a78a8ff6e224

点击查看更多内容

为 TA 点赞

若觉得本文不错，就分享一下吧！

评论

评论

共同学习，写下你的评论

评论加载中...

展开查看更多评论

作者其他优质文章

正在加载中

蓝山帝景

软件工程师

手记
篇

粉丝

47

获赞与收藏

152

关注作者，订阅最新文章

阅读免费教程

后端通用面试教程

41个小节 32888 371

网络编程入门教程

20个小节 13641 256

Pandas 入门教程

25个小节 20282 387

推荐

评论

收藏

共同学习，写下你的评论



感谢您的支持，我会继续努力的～

扫码打赏，你说多少就多少

赞赏金额会直接到老师账户

支付方式

打开微信扫一扫，即可进行扫码打赏哦

今天注册有机会得

100积分直接送

付费专栏免费学

大额优惠券免费领

立即参与放弃机会

点击
抽奖

慕课手记新用户专享福利

恭喜你，你的运气太好了，居然抽中了 100个积分！

恭喜你，抽中了价值元的专栏！

太棒了，直接落到你账户里！

积分商城里的罗技鼠标、机械键盘、
Kindle 阅读器、小米平衡车
Apple iPad （10.2英寸）、大额优惠券
在等着你去兑换了噢

作者：

免费赠送

兑换码：1111222211 复制

优惠券可用于购买实战课、体系课
无门槛使用

先去看看，有什么好东西马上兑换我爱学习，选课去


热搜

最近搜索清空

[译]Spark 2.1.0官方文档翻译

Spark概述

下载

运行示例和Shell

阅读免费教程