证书 在线考试 答题题目
1、 8. (单选题)下列关于List的定义,哪个是错误的( )
2、 7. (单选题)下列选项中,( )不属于数据标准化或归一化方法。
3、 8. Spark于2009年诞生于()。
4、 3. (单选题)以下方法中,从外部存储系统中创建RDD使用的方法是( )
5、(判断题) 26. (判断题)RDD采用了惰性调用,即在RDD的处理过程中,真正的计算发生在RDD的“行动”操作
6、 15. (单选题)以下选项中不是spark-submit的指定参数的是( )
7、(判断题) 19. (判断题)DataFrame可以从很多数据源中创建,例如结构化文件、外部数据库、Hive表等数据源。
8、 2. (单选题)下列属于关联规则算法是( )。
9、 6. (单选题)关于Spark MLlib的mllib.stat.Statistics类中的方法,描述错误的是( )。
10、(判断题) 15. (判断题)Spark SQL与Hive不兼容
11、 2. (单选题)下列方法中,不可用于创建RDD的方法的是( )
12、(判断题) 16. (判断题)Spark Master HA主从切换过程不会影响集群已有的作业运行
13、(判断题) 33. (判断题)在Scala中,集合有三大类分别是List、Set以及Map。
14、(填空题) 18. (填空题)在RDD操作中,可使用___ 方法收集查询数据
15、 5. (单选题)DataFrame的show()方法默认输出( )条数据。
16、 1. (单选题)下面哪个端口不是Spark自带服务的端口
17、 7. (单选题)关于RDD集合操作方法,以下选项中描述错误的是
18、 5. (单选题)以元组pair为例,以下关于元组说法错误的是( )
19、(填空题) 10. (填空题)在Spark MLlib库中,经常用于将对象分到高度相似的类中的一种无监督学习算法的是
20、(判断题) 18. (判断题)Spark SQL不仅能够查询MySQL数据库中的数据,还可以向表中插入新的数据
21、(填空题) 12. (填空题)推荐算法有两个主要的类别:一种是_____ ,另一种是____
22、 4. (单选题)下列选项中( )算法属于分类算法。
23、(填空题) 23. (填空题)方法和map()方法类似,但是该方法没有返回值,只用于对参数的结果进行输出。
24、 3. (单选题)以下关于Scala的变量定义、赋值的代码,运行后一定会报错的是( )
25、 8. (单选题)关于键值对RDD的连接操作,以下选项中描述正确的是
26、 21. (单选题)Scala中,用于创建单例对象的关键字是()。
27、(填空题) 24. (填空题)使用____方法可以实现数据过滤
28、(填空题) 20. (填空题)使用 ___方法可以合并多个RDD
29、(填空题) 24. (填空题)RDD的操作主要分为____和____
30、(判断题) 35. (判断题)Scala中声明变量时,可以不给出变量的类型,因为在初始化的时候,Scala的类型推断机制能够根据变量初始化的值自动推算出来。
31、 9. (单选题)关于mllib.feature中创建特征向量的方法,下列说法错误的是( )。
32、(填空题) 22. (填空题)方法可以通过一个函数重新计算列表中的所有元素,并且返回一个包含相同数目元素的新列表。
33、 11. (单选题)saveAsTextFile()方法用于将( )以文本文件的格式存储到文件系统中。
34、 4. (单选题)DataFrame可以将数据保存成持久化的表,使用的方法是( )。
35、 13. (单选题)以下关于Scala的类和单例对象之间的差别描述正确的是( )
36、 7. Spark与Hadoop在基于内存的运算中,说法正确的是()。
37、(填空题) 13. (填空题)spark-shell下清屏的快捷方式为
38、 4. (单选题)以下关于数组a的定义,最终数组a的数据与其他选项不一致的是
39、(判断题) 30. (判断题)在Scala中,使用关键字bar声明的变量,值是不可变的。
40、(判断题) 29. (判断题)Scala语言是一种面向过程编程的语言。
41、(判断题) 15. (判断题)部署Spark高可用集群不需要用到Zookeeper服务
42、(判断题) 21. (判断题)Spark SQL与Hive相互不兼容。
43、 3. Spark支持的运行模式不包括( )
44、 19. (单选题)
定义类Counter,并通过new关键字实例化出counter对象,代码如下,以下选项的操作正确的是( )。
class Counter(name:String)(
val a = 1
var b ="counter”
}
val counter = new Counter("computer")
45、 9. (单选题)关于Spark SQL的DataFrame基础操作,以下选项中说法错误的是( )。
46、 8. (单选题)以下选项中不能对DataFrame列名进行重命名的方法是( )。
47、(判断题) 16. (判断题)在Spark SQL中,若想要使用SQL风格操作,则需要提前将DataFrame注册成一张临时表
48、(填空题) 27. (填空题)在Scala中,模式匹配是由关键字 和 组成的
49、(填空题) 26. (填空题)在Scala中,获取元组中的值是通过 来获取的
50、(判断题) 22. (判断题)Spark SQL为Spark框架在结构化数据分析方面提供重要技术支持。
51、 18. (单选题)以下关于Scala的类和单例对象之间的差别描述正确的是( )。
52、 3. (单选题)下列选项中( )算法不属于有监督学习算法。
53、 3. (单选题)关于Spark SQL的说法,以下选项错误的是( )。
54、(判断题) 31. (判断题)在Scala中定义变长数组时,需要导入可变数组包。
55、 7. (单选题)下列方法中,哪个方法可以正确计算数组arr的长度( )
56、(填空题) 14. (填空题)在DataFrame的操作中,_____用于对记录进行分组。
57、 14. (单选题)以下选项中使用spark-submit指定在YARN框架上运行程序的是( )。
58、(判断题) 20. (判断题)Spark SQL提供了一个编程抽象结构叫做DataFrame的数据模型。
59、(填空题) 23. (填空题)spark-submit常用配置项中 --name Name主要用于
60、(判断题) 18. (判断题)Hadoop的MapReduce进行计算时,每次产生的中间结果都是存储在内存中;而Spark在计算时产生的中间结果存储在本地磁盘中。
61、 16. (单选题)提交Spark程序时,通常需要设置一些配置项,关于配置项,下列说法错误的是( )
62、 1. (单选题)以下不属于Spark架构中的组件的是( )
微信扫一扫 在线答题 在线出卷 随机出题小程序 闯关答题软件 出题答题小程序