62 在线考试 答题题目
1、 5. 关于SparkRDD,下列说法不正确的是( )
2、 10. (单选题)表达式for(i<-1 to 3;for(j<-1 to 3;if i!=j))print((10*i+j))+"",输出结果正确的是( )
3、(填空题) 21. (填空题)方法用于合并具有相同键的值,作用对象是键值对,并且只对键的值进行处理。
4、 18. (单选题)以下关于Scala的类和单例对象之间的差别描述正确的是( )。
5、(判断题) 21. (判断题)Spark SQL与Hive相互不兼容。
6、 3. (单选题)以下方法中,从外部存储系统中创建RDD使用的方法是( )
7、 9. (单选题)对于RDD(a,1),(a,2),(a,3)),使用“reduceByKey(_+_)”进行合并,得到的结果 是( )
8、(判断题) 33. (判断题)在Scala中,集合有三大类分别是List、Set以及Map。
9、(判断题) 25. (判断题)RDD是一个可变、不可分区、里面的元素不可并行计算的集合
10、(填空题) 28. (填空题)在Scala中,使用___关键字来定义的类被称为样例类。
11、(填空题) 13. (填空题)spark-shell下清屏的快捷方式为
12、 4. (单选题)下列选项中( )算法属于分类算法。
13、 19. (单选题)
定义类Counter,并通过new关键字实例化出counter对象,代码如下,以下选项的操作正确的是( )。
class Counter(name:String)(
val a = 1
var b ="counter”
}
val counter = new Counter("computer")
14、 11. (单选题)在Scala语言中,关于列表的定义,不正确的是( )
15、 6. (单选题)获取DataFrame中所有数据,并返回一个数组对象,使用的方法是( )。
16、 16. (单选题)提交Spark程序时,通常需要设置一些配置项,关于配置项,下列说法错误的是( )
17、 8. (单选题)以下选项中不能对DataFrame列名进行重命名的方法是( )。
18、 8. (单选题)下列关于List的定义,哪个是错误的( )
19、(填空题) 14. (填空题)在DataFrame的操作中,_____用于对记录进行分组。
20、 13. (单选题)以下关于Scala的类和单例对象之间的差别描述正确的是( )
21、 1. (单选题)下面哪个端口不是Spark自带服务的端口
22、 5. (单选题)以下是行动操作的方法是()
23、 4. (单选题)以下是转换操作的方法是()
24、(填空题) 25. (填空题)方法可对集合中的元素进行分组操作,返回的结果是一个映射。
25、 6. (单选题)下列选项中,哪个是Scala编译后文件的扩展名( )
26、(判断题) 35. (判断题)Scala中声明变量时,可以不给出变量的类型,因为在初始化的时候,Scala的类型推断机制能够根据变量初始化的值自动推算出来。
27、 6. 下列选项中,可以支持Scala和Python编程的交互式解释器是()。
28、 1. 以下关于Scala解释器(REPL)交互的基本方式说法错误的是( )
29、(判断题) 16. (判断题)在Spark SQL中,若想要使用SQL风格操作,则需要提前将DataFrame注册成一张临时表
30、(判断题) 34. (判断题)Scala中,使用关键字var或val声明变量时,后面紧跟的变量名称可以和Scala中的保留字重名,而且变量名不可以以字母或下划线开头,且变量名是不区分大小写的。
31、(填空题) 23. (填空题)spark-submit常用配置项中 --name Name主要用于
32、 17. (单选题)映射的示例代码如下,运行后res的正确结果是( )。
val data = Map(1 ->"Chinese",2 ->"Math",3 ->"English")
val res = for((k,v)<- data; if(k>1))yield v
33、 8. Spark于2009年诞生于()。
34、(判断题) 26. (判断题)RDD采用了惰性调用,即在RDD的处理过程中,真正的计算发生在RDD的“行动”操作
35、(填空题) 22. (填空题)方法用于对具有相同键的值进行分组,可以对同一组的数据进行计数、求和等操作。
36、 14. (单选题)定义类Counter,并通过new关键字实例化出counter对象,代码如下,以下选项的操作正确的是( )。 class Counter(name:String){val a = 1var b ="counter" } val counter = new Counter("computer")
37、 1. (单选题)以下不属于Spark架构中的组件的是( )
38、(填空题) 23. (填空题)方法和map()方法类似,但是该方法没有返回值,只用于对参数的结果进行输出。
39、(填空题) 10. (填空题)在Spark MLlib库中,经常用于将对象分到高度相似的类中的一种无监督学习算法的是
40、 7. (单选题)下列选项中,( )不属于数据标准化或归一化方法。
41、(判断题) 13. (判断题)标注点是一种带有标签的本地向量,通常用于无监督学习算法中
42、 2. Spark是Hadoop生态下( )组件的替代方案
43、(填空题) 13. (填空题)Spark SQL作为分布式SQL查询引擎,让用户可以通过 、DataFrames API和Datasets API3种方式实现对结构化数据的处理。
44、(填空题) 20. (填空题)使用 ___方法可以合并多个RDD
45、 7. (单选题)下列方法中,哪个方法可以正确计算数组arr的长度( )
46、 9. (单选题)关于Spark SQL的DataFrame基础操作,以下选项中说法错误的是( )。
47、 7. Spark与Hadoop在基于内存的运算中,说法正确的是()。
48、 4. (单选题)DataFrame可以将数据保存成持久化的表,使用的方法是( )。
49、 10. (单选题)在Spark中,调用RDD的()方法,可以将RDD转换为DataFrame对象。
50、 6. (单选题)关于sortBy(方法的三个可输入参数,以下选项中描述错误的是 ( )
51、 2. 以下关于Scala的特性说法错误的是( )
52、 13. (单选题)使用“val rdd: RDD[String]= sc.makeRDD(List("Hello Scala","Hello Spark"))”创建了一个RDD,以下选项中,不能使该RDD实现单词计数的是( )。
53、 5. (单选题)DataFrame的show()方法默认输出( )条数据。
54、(填空题) 27. (填空题)在Scala中,模式匹配是由关键字 和 组成的
55、 2. (单选题)下列属于关联规则算法是( )。
56、(填空题) 11. (填空题)是一个用于处理结构化数据的框架,可被视为一个分布式的SQL查询引擎,提供了一个抽象的可编程数据模型DataFrame
57、(填空题) 24. (填空题)RDD的操作主要分为____和____
58、(填空题) 11. (填空题)协同过滤推荐算法有两种形式,分别是_____和_____
59、 4. (单选题)以下关于数组a的定义,最终数组a的数据与其他选项不一致的是
60、 12. (单选题)Spark中的SparkContext是( )。
61、 4.在Spark中,如果需要对实时数据进行流式计算,那么使用的子框架是( )
62、(判断题) 17. (判断题)Spark SQL可以通过JDBC从关系数据库中读取数据的方式创建DataFrame,通过对DataFrame进行一系列的操作后,不可以将数据重新写入到关系数据库中。
微信扫一扫 在线答题 在线出卷 随机出题小程序 闯关答题软件 出题答题小程序