单选题

[单选题]在Python中,要把采集到的多个小数据集合并成一个大数据集,以下哪种方法可能用到()

A、

all of the above

B、

np.append()

C、

pd.concat()

D、

list.extend()

下载APP答题
由4l***14提供 分享 举报 纠错

相关试题

单选题 [单选题]对于数据采集到的含有大量空白字符(如空格、制表符等)的文本数据,在清洗时通常可以使用()方法来去除。

A、join()
B、split()
C、strip()
D、replace()

单选题 [单选题]在数据采集过程中,想要模拟浏览器的行为,最重要的是设置()

A、

正确的请求体(data)

B、

大量的请求头(headers)参数

C、

复杂的请求路径(url)

D、

合适的User - Agent

单选题 [单选题]若采集到的数据中有日期格式为'2024 - 01 - 01'的字符串,要将其转换为日期类型,在pandas中可以使用()

A、

time.mktime()

B、

datetime.strptime()

C、

pd.to_datetime()

D、

date.fromtimestamp()

单选题 [单选题]对于一个包含大量文本数据的CSV文件,想要读取其中某一列的数据,在pandas中最适合的方法是()

A、

df[column_name]

B、

df.iloc[:, column_index]

C、

df.values

D、

df.loc[:, column_name]

单选题 [单选题]以下哪个不是数据清洗中处理异常值的常见方法?

A、将异常值修改为均值
B、使用中位数替换异常值
C、把异常值设置为固定值 - 1
D、删除包含异常值的行

单选题 [单选题]在使用requests库获取网页内容时,如果遇到编码问题,通常需要修改的参数是()

A、cookies
B、headers
C、params
D、encoding

单选题 [单选题]以下哪个Python库主要用于网页数据采集?

A、statsmodels
B、BeautifulSoup
C、sklearn
D、seaborn

单选题 [单选题]当数据中有缺失值,在pandas中使用()方法可以用均值填充数值型列的缺失值。

A、

df.replace(np.nan, df.mean())

B、

df.mean().fillna()

C、

df.fillna(np.mean(df))

D、

df.fillna(df.mean())