简答题 HBase数据写入过程会有多个步骤,请选择正确的顺序。
查找对应的region,在region中寻找列族,先向memstore中写入数
去表所在的regionserver进行数据的添加
当mematore写入的值变多,触发溢写操作(flush)
Client访问Zookeeper获取元教据存储所在的regionserver
通过对应的regionserver.拿到对应的表存f诸的的
当溢写的文件过多时,会触发文件的合并(compact))操作

下载APP答题
由4l***2s提供 分享 举报 纠错

相关试题

单选题 (单选)Kafka是一个高吞吐、分布式、基于发布订阅的消息系统,Kafka集群中的一台或多台服务器统称为Broker(缓存代理)。以下关于Kafka及Broker的描述错误的是( )。

A、 Kafka采用基于时间的SLA(服务水平保证),消息保存一定时间后会被删除
B、 消息订阅者可以rewind back到任意位置重新进行消费,当订阅者故障时,可以选择最小的offset(id)进行重新读取消费消息
C、 为了减少磁盘写入的次数,Broker会将消息暂时buffer起来,当消息的个数达到一定阀值时,再flush到磁盘,这样可以减少磁盘IO调用的次数,提升性能
D、 Broker保存订阅者的状态

单选题 (单选)以下哪个选项不是实时检索解决方案的典型业务特点?

A、 统计类查询
B、 高并发
C、 查询速度快
D、 查询条件简单

单选题 (单选)Loader特点不包含( )。

A、

安全

B、

高性能

C、

图形化

D、

实时性

单选题 (单选)HDFS里元数据持久化过程包括Fslmage 持久化和Editlog持久化,其中Fslmage持久化是通过以下哪一种方式完成的?(单选)

A、 快照
B、 日志
C、 网页
D、 图片

单选题 (单选)以下哪种不是Flink提供的部署方式?

A、

Cloud

B、

VM

C、

Cluster

D、

Local

单选题 (单选)Flume提供实时日志信息采集,同时支持合并数据的能力。在此过程中,Flume需要综合考虑服务器的负载均衡,以确保集群性能最优,以下关于负载均衡所使用的算法描述错误的是( )。

A、 使用负载均衡轮询调度算法
B、 算法就是以轮询的方式依次请求调度不同的服务器
C、 算法简洁,无需记录当前所有连接的状态,是一种无状态调度
D、 每次调度执行i =(i+1) mod n,并选择第i+1台服务器

单选题 (单选)ElasticSearch是一个基于( ) 的开源搜索服务。它提供了一个分布式多用户能力的全文搜索引擎,基于( ) 接口。Elasticsearch是用( ) 开发的,并作为( ) 许可条款下的开放源码发布,是当前流行的企业级搜索引擎。设计用于云计算中,能够达到实时搜索,稳定,可靠,快速,安装使用方便。

A、

Lucene、RESTful web、Java、Apache

B、

Lucene、RESTful web、Java、Google

C、

Lucene、RESTful web、Scala、Apache

D、

Apache、RESTful web、Java、Google

单选题 (单选)Flume传输数据过程中,为了防止数据不丢失,使用的Channel类型是 ( )。

A、 HDFS Channel
B、 JDBC Channel
C、 Memory Channel
D、 File Channel