使用当前浏览器访问考试宝,无法享受最佳体验,推荐使用 Chrome 浏览器进行访问。
更新时间: 试题数量: 购买人数: 提供作者:
有效期: 个月
章节介绍: 共有个章节
我的错题 (0道)
我的收藏 (0道)
我的斩题 (0道)
我的笔记 (0道)
顺序练习 练习进度 0 / 0
随机练习 自定义设置练习量
模拟考试 仿真模拟
题型练习 按题型分类练习
易错题 精选高频易错题
学习资料 考试学习相关信息
分布式存储系统为了提高读写性能,通常会采用________技术。
在 HDFS 中,文件的元数据存储在________节点上。
批处理计算适合处理_______数据。
根据对数据处理的时效分类:实时产生的新数据先被存储起来,在未来的某个时间一批批地处理的方式是_______;实时产生的新数据会被实时地一条条处理的方式是______。
HDFS 中,Secondary NameNode 的主要作用是_______。
分布式计算的核心思想是_____。
HDFS 的架构采用了______架构模式。
分布式计算中,把大任务分解成小任务并分配到不同节点执行的过程称为_______。
数据产生的三个阶段是:_____、_____和______。
大数据时代需要的技术支撑有_____、_________和_________。
第 3 次信息化时代到来的时间是:________。
从 “商品编号” 字段(如 “30101”)中截取前 3 位作为 “品类” 信息,可使用 Pandas 的字符串方法_______。
数据分组是根据数据分析对象的特征,按照一定指标将数据划分为______,以揭示数据内在联系。
使用 requests 库发送 GET 请求后,返回的_________对象包含了服务器响应的所有信息。
常用的分布式日志数据采集工具包括 Flume、Kafka 和_________。
线上行为数据是按数据________划分的类别,包括页面数据、交互数据等。
数据预处理的核心环节包括数据清洗、数据集成、数据变换和_____。
处理 DataFrame 中的缺失值时,_______方法用于填充缺失值,_________方法用于删除包含缺失值的行或列。
HTTP 响应状态码中,4xx 系列表示______错误,5xx 系列表示_____错误。;