大学网课搜题引擎
首页
爱课程(中国大学MOOC)
大数据导论
第六章 大数据分析
题目详情
简答题
有下列一组符号数据,根据信息熵的定义,求出其信息熵为:( )。(取小数点后3位)。
high
normal
high
high
normal
normal
normal
high
normal
normal
查看答案与解析
简答题
DBSCAN算法属于什么类型的聚类算法 A、划分型聚类算法 B、基于密度的聚类算法 C、层次聚类算法 D、网格聚类算法
简答题
两个随机变量X 与 Y 之间正相关,则其相关系数大于0. A、正确 B、错误
简答题
已知有一组数据:64、65、67、70、71、75、76、77、78、80、81、85、90该组数据样本的方差为: A、60.4 B、63.5 C、70.2 D、71.5
简答题
聚类分析属于有监督学习类型 A、正确 B、错误
简答题
设x、y为向量 (1)x=(1,1,2,2) (2)y=(2,2,2,3) 求两个向量的Pearson相关系数: A、0.524 B、0.561 C、0.577 D、0.512
简答题
正面是一组数据的偏态图示,则其偏度(Skewness)大于0. A、正确 B、错误
简答题
有以下一组数据:78、80、81、85、90、64、65、67、70、71、75、76、77 该组数据样本的中位数为: A、75 B、76 C、77 D、65
简答题
ID3算法在进行某个节点进行划分时,会偏向于取值较多的属性 A、正确 B、错误
简答题
变量的不确定性越大,信息熵也就越大 A、正确 B、错误
简答题
好的聚类方法需要产生高质量的聚类结果,所形成的簇要有高的内部相异性。 A、正确 B、错误
简答题
以下哪一项属于k-means算法的优点 A、不必事先知道划分为几个簇 B、可以处理噪声和离群点 C、可以发现非凸形状的簇 D、效率较高
简答题
聚类质量Compactness(紧密性)指标以簇内误差的( )作为度量标准
简答题
决策树算法ID3基于( )作为属性选择的度量。 A、信息增益比 B、信息增益 C、基尼指数 D、数据分散度
大数据导论
章节列表
第一章 绪论
12
第二章 大数据相关技术基础
5
第三章 数据采集与预处理
5
第四章 Hadoop架构和大数据存储简介
19
第五章 典型大数据计算框架
10
第六章 大数据分析
14
第七章 大数据可视化
10