小曹 选择题 在线考试 答题题目
1、 21. (单选题)Scala中,用于创建单例对象的关键字是()。
2、 1. (单选题)以下不属于Spark架构中的组件的是( )
3、 13. (单选题)以下关于Scala的类和单例对象之间的差别描述正确的是( )
4、 2. 以下关于Scala的特性说法错误的是( )
5、(填空题) 18. (填空题)在RDD操作中,可使用___ 方法收集查询数据
6、(填空题) 22. (填空题)方法用于对具有相同键的值进行分组,可以对同一组的数据进行计数、求和等操作。
7、(判断题) 21. (判断题)Spark SQL与Hive相互不兼容。
8、 20. (单选题)下列方法中,用于计算数组长度的是()。
9、 3. Spark支持的运行模式不包括( )
10、 4. (单选题)下列选项中( )算法属于分类算法。
11、 5. (单选题)以下是行动操作的方法是()
12、(填空题) 14. (填空题)在DataFrame的操作中,_____用于对记录进行分组。
13、 9. (单选题)对于RDD(a,1),(a,2),(a,3)),使用“reduceByKey(_+_)”进行合并,得到的结果 是( )
14、 14. (单选题)定义类Counter,并通过new关键字实例化出counter对象,代码如下,以下选项的操作正确的是( )。 class Counter(name:String){val a = 1var b ="counter" } val counter = new Counter("computer")
15、(判断题) 13. (判断题)标注点是一种带有标签的本地向量,通常用于无监督学习算法中
16、 6. (单选题)关于Spark MLlib的mllib.stat.Statistics类中的方法,描述错误的是( )。
17、(填空题) 23. (填空题)spark-submit常用配置项中 --name Name主要用于
18、(填空题) 13. (填空题)Spark SQL作为分布式SQL查询引擎,让用户可以通过 、DataFrames API和Datasets API3种方式实现对结构化数据的处理。
19、 5. (单选题)DataFrame的show()方法默认输出( )条数据。
20、(填空题) 24. (填空题)RDD的操作主要分为____和____
21、(填空题) 10. (填空题)在Spark MLlib库中,经常用于将对象分到高度相似的类中的一种无监督学习算法的是
22、(判断题) 18. (判断题)Spark SQL不仅能够查询MySQL数据库中的数据,还可以向表中插入新的数据
23、 6. (单选题)下列选项中,哪个是Scala编译后文件的扩展名( )
24、(填空题) 10. (填空题)停止Spark集群的命令为
25、(判断题) 16. (判断题)在Spark SQL中,若想要使用SQL风格操作,则需要提前将DataFrame注册成一张临时表
26、 7. (单选题)关于RDD集合操作方法,以下选项中描述错误的是
27、 4. (单选题)DataFrame可以将数据保存成持久化的表,使用的方法是( )。
28、(填空题) 28. (填空题)在Scala中,使用___关键字来定义的类被称为样例类。
29、 1. 以下关于Scala解释器(REPL)交互的基本方式说法错误的是( )
30、 11. (单选题)saveAsTextFile()方法用于将( )以文本文件的格式存储到文件系统中。
31、 6. (单选题)关于sortBy(方法的三个可输入参数,以下选项中描述错误的是 ( )
32、 10. (单选题)对于RDD1((a,1),(b, 2),(c,3))和RDD2((b,4),(b,5),(a,6)),使用“RDD1.join (RDD2)”,得到的结果是( )。
33、(判断题) 16. (判断题)Spark Master HA主从切换过程不会影响集群已有的作业运行
34、(填空题) 12. (填空题)Spark SQL是Spark用来 的一个模块
35、(判断题) 20. (判断题)Spark SQL提供了一个编程抽象结构叫做DataFrame的数据模型。
36、 15. (单选题)以下程序的输出结果是( )。 val alphabet = List("A","B","C") val nums = List(1,2)
print(alphabet.zip(nums))
37、 4. (单选题)以下是转换操作的方法是()
38、 3. (单选题)以下关于Scala的变量定义、赋值的代码,运行后一定会报错的是( )
39、(填空题) 19. (填空题)方法用于获取RDD的前N个元素,返回数据为数组
40、 12. (单选题)映射的示例代码如下,运行后res的正确结果是val data=Map(1->"Chinese"),2->"Math",3->"English" val res=for(k,v)<-data;if(k>1)) yield v
41、(填空题) 9. (填空题)启动Spark集群的命令为
42、 3. (单选题)关于Spark SQL的说法,以下选项错误的是( )。
43、(填空题) 27. (填空题)在Scala中,模式匹配是由关键字 和 组成的
44、 9. (单选题)关于Spark SQL的DataFrame基础操作,以下选项中说法错误的是( )。
45、(判断题) 19. (判断题)DataFrame可以从很多数据源中创建,例如结构化文件、外部数据库、Hive表等数据源。
46、 10. (单选题)在Spark中,调用RDD的()方法,可以将RDD转换为DataFrame对象。
47、 8. (单选题)关于键值对RDD的连接操作,以下选项中描述正确的是
48、(判断题) 17. (判断题)Spark SQL可以通过JDBC从关系数据库中读取数据的方式创建DataFrame,通过对DataFrame进行一系列的操作后,不可以将数据重新写入到关系数据库中。
49、 4.在Spark中,如果需要对实时数据进行流式计算,那么使用的子框架是( )
50、 16. (单选题)以下选项符合Scala编程规范的是( )。
①"spark".equals("spark") ②"spark".contains(spark)
③val a:String="spark"④val a=List{1,2,3,4}
51、(判断题) 36. (判断题)Scala有两种类型的变量,一种是使用关键字var声明的常量,值是不可变的;另一种是使用关键字val声明的变量,值是可变的。
52、 19. (单选题)
定义类Counter,并通过new关键字实例化出counter对象,代码如下,以下选项的操作正确的是( )。
class Counter(name:String)(
val a = 1
var b ="counter”
}
val counter = new Counter("computer")
53、(判断题) 32. (判断题)Scala语言和Java语言一样,都有静态方法或静态字段。
54、 13. (单选题)使用“val rdd: RDD[String]= sc.makeRDD(List("Hello Scala","Hello Spark"))”创建了一个RDD,以下选项中,不能使该RDD实现单词计数的是( )。
55、(判断题) 25. (判断题)RDD是一个可变、不可分区、里面的元素不可并行计算的集合
56、 8. Spark于2009年诞生于()。
57、 2. (单选题)下列方法中,不可用于创建RDD的方法的是( )
58、(填空题) 21. (填空题)方法用于合并具有相同键的值,作用对象是键值对,并且只对键的值进行处理。
59、 12. (单选题)Spark中的SparkContext是( )。
60、(判断题) 26. (判断题)RDD采用了惰性调用,即在RDD的处理过程中,真正的计算发生在RDD的“行动”操作
61、(填空题) 23. (填空题)方法和map()方法类似,但是该方法没有返回值,只用于对参数的结果进行输出。
62、 2. (单选题)现有一个DataFrame数据命名为data,而在Spark SQL的DataFrame API中有众多方法可以对其数据进行查看。查看data数据的前10条数,以下写法错误是( )。
63、(填空题) 22. (填空题)方法可以通过一个函数重新计算列表中的所有元素,并且返回一个包含相同数目元素的新列表。
64、 9. (单选题)下列选项中,哪个不是Spark生态系统中的组件?
65、(填空题) 12. (填空题)推荐算法有两个主要的类别:一种是_____ ,另一种是____

微信扫一扫 在线答题 在线出卷 随机出题小程序 闯关答题软件 出题答题小程序