首页
›
答案
›
标签
›
Hadoop应用基础
Hadoop应用基础
1
有可能使Hadoop任务输出到多个目录中么?如果可以,怎么做?
2
简要描述如何安装配置apache的一个开源Hadoop,只描述即可,无需列出具体步骤,列出具体步骤更好?
3
什么样的计算不能用mr来提速,举5个例子。
4
如果没有定义partitioner,那数据在被送达reducer前是如何被分区的?
5
如何决定一个job的map和reduce的数量?
6
列举几个hadoop生态圈的组件并做简要描述?
7
HAnamenode是如何工作的?
8
NameNode负责管理metadata,client端每次读写请求,它都会从磁盘中读学取或则会写人metadata信息并反馈client端。()
9
Nagios不可以监控Hadoop集群,因为它不提供Hadoop支持。()
10
hadoopdfsadmin-report命合用于检测HDFS损坏块。()
11
Hadoop自身具有严格的权限管理和安全措施保障集群正常运行。()
12
HDFSFederation方案的优势?
13
Hadoop是Java开发的,所以MapReduce只支持Java语言编写。()
14
NameNode与SecondaryNameNode的区别与联系?
15
谈谈Hadoop序列化和反序列化及自定义bean对象实现序列化?
16
Hadoop默认调度器策略为FIFO()
17
NameNode的WebUI端口是50030,它通过jetty启动的web服务。()
18
Hadoop环境变量中的HADOOP()HEAPSIZE用于设置所有Hadoop守护线程的内存。它默认是200GB。()
19
hadoopdfsadmin-report命令用于检测HDFS损坏块。()
20
因为HDFS有多个副本,所以NameNode是不存在单点问题的。()
21
slave节点要存储数据,所以它的磁盘越大越好。()
22
BlockSize是不可以修改的。()
23
Ganglia不仅可以进行监控,也可以进行告警。()
24
DataNode首次加入cluster的时候,如果log中报告不兼容文件版本,那需要NameNode执行Hadoopnamenode-format操作格式化磁盘。()
25
ClouderaCDH是需要付费使用的。()
26
集群内每个节点都应该配RAID,这样避免单磁盘损坏,影响整个节点运行。()
27
如果NameNode意外终止,SecondaryNameNode会接替它使集群继续工作。()
28
简单描述?下hive中的分区表?
29
hdfs-sitexml的3个主要属性?
30
NameNode负责管理metadata,client端每次读写请求,它都会从磁盘中读取或则会写入metadata信息并反馈client端。()
31
每个map槽就是一个线程。()
32
MapReduce的基本数据类型包括哪些?
33
Hadoop包含哪些优势?
34
简单描述Shuffle过程环形缓冲区的作??
35
简单描述你对Hadoop集群SafeMode模式的理解?
36
简单描述MapReduce不适合对哪些场景的使??其实问的就是它的缺点。
37
如何实现服务器之间的免密登录(便捷版)?SSH采?的是什么加密?
38
Mapreduce执?过程中,在执?ReduceTask之前主要做哪些?作?
39
Mapreduce的inputsplit就是一个block。()
40
Hadoop有哪些应用领域?
41
假如NameNode中没有数据会怎么样?
42
Hadoop支持数据的随机读写。()
43
Hive内部表和外部表的区别?
44
如果需要在NameNode节点群起集群,你需要如何配置?
45
什么是hive,谈谈你的理解?
46
简单描述?下TextInputFormat怎么进??件切分?
47
Hadoop伪分布集群包含哪些守护进程?
48
yarn有哪?部分组成,作?分别是什么?调度器主要有哪三种?hadoop默认的是哪?种?
49
HBase官方版本可以安装在什么操作系统上?
50
Hadoop有几种运行模式?
51
是否可以在Windows上运?Hadoop?
52
HBase构建二级索引的实现方式有哪些?
53
下列关于BloomFilter的描述正确的是?
54
Hadoop20包含哪些核心组件?
55
Clinet在HDFS上进行文件写入时,namenode根据文大小和配置情况,返回部分DataNode信息,谁负责将文件划分为多个block,根据DataNode的地址信息按顺序写入到每一个DataNode块
56
关于HDFS的文件写入,正确的是
57
NameNode在启动时自动进入安全模式,在安全模式阶段,说法错误的是
58
Rowkey设计的原则,下列哪些选项的描述是正确的?
59
HDFS是基于流数据模式访问和处理超大文件的需求而开发的,默认的最基本的存储单位是64M,具有高容错、高可靠性、高扩展性、高吞吐率等特征,适合的读写任务是
60
HBase中的批量加载底层使用()实现。
61
出现在datanode的VERSION文件格式中但不出现在nomenode的VERSION文件格式中的是
62
为销售报表展示开发一个MapReduce作业,Mapper输入数据的Key是年份(IntWritable),Value表示商品标识(Text)。下列哪一项决定该Mapper的数据类型?
63
HDFS的NameNode负责管理文件系统的命名空间,将所有的文件和文件夹的元数据保存在一个文件系统树中,这些信息也会在硬盘上保存成以下文件:
64
HDFS默认的当前工作目录是/user/$USER,fsdefaultname的值需要在哪个配置文件内说明
65
HDFS无法高效存储大量小文件,想让它能处理好小文件,比较可行的改进策略不包括
66
HBase分布式模式最好需要()个节点?
67
HBase虚拟分布式模式需要()个节点?
68
DougCutting所创立的项目的名称都受到其家人的启发,以下项目不是由他创立的项目是
69
配置Hadoop时,JAVA()HOME包含在哪一个配置文件中
70
关于Hadoop单机模式和伪分布式模式的说法,正确的是
71
下列关于Hadoop
72
Hadoop配置文件中,hadoop-sitexml显示覆盖hadoop-defaultxml里的内容。在版本020中,hadoop-sitexml被分离成三个XML文件,不包括
73
下面对LSM结构描述正确的是?
74
LSM结构的数据首先存储在()。
75
LSM的读操作和写操作是独立的?
76
LSM更能保证哪种操作的性能?
77
HBase依赖()提供强大的计算能力
78
HBase依赖()提供强大的计算能力。
79
HBase依靠()存储底层数据。
80
LSM含义是?
81
下面与HDFS类似的框架是?
82
下面与Zookeeper类似的框架是?
83
大数据的特点不包括下面哪一项()。
84
HDFS默认BlockSize的大小是()。
85
HBase来源于哪一项?
86
下列哪项通常是集群的最主要瓶颈()。
87
下列哪个程序通常与NameNode在同一个节点启动()。
88
以下哪一项不属于Hadoop可以运行的模式()
89
关于SecondaryNameNode下面哪项是正确的()
90
联大学堂《Hadoop应用基础(焦作师范高等专科学校)》题库及答案