大学网课搜题引擎
首页
国家开发大学
大数据分析与挖掘技术
形考任务
题目详情
多选题
5.聚类任务中,衡量个体之间的相似性通常使用下面哪些度量( )A.
距离 B.
相关系数 C.
相似系数 D.
匹配系数
查看答案与解析
简答题
1.典型相关分析解决的问题是两组变量之间的非线性相关关系。( )对 错
多选题
4.个体之间的距离必须满足的原则有:( )A. 非负性 B. 个体自身与自身的距离为0 C. 对等性 D. 两点之间直线距离最小
多选题
2.数据抽样后( )。A. 数据量会增加 B. 数据量会减少 C. 数据的波动性可能增加 D. 数据波动性可能减小
简答题
3.数据经过标准化处理后,数据的波动性将会减小。( )对 错
多选题
6.回归模型评价时,通常采用0-1损失。( )对 错
判断题
2.下面关于DBSCAN聚类说法错误的是:( )A. DBSCAN是具有噪声的基于密度的空间聚类方法 B. DBSCAN算法不能发现任意形状的空间聚类 C. DBSCAN聚类有一个参数是半径(Eps) D. DBSCAN聚类还有一个参数是以点P为中心的邻域内最少点的数量(MinPts)
多选题
8.所谓截尾,是指在自相关系数图或偏自相关系数图中( )A. 自相关系数或偏自相关系数在滞后的前几期可能处于置信区间之外 B. 自相关系数或偏自相关系数在某期之后的系数基本上都落入置信区间内 C. 自相关系数或偏自相关系数在某期之后的系数逐渐趋于零 D. 自相关系数或偏自相关系数有指数型波动
多选题
6.非平稳的时间序列:( )A. 在整体上有明显的上升的趋势 B. 在局部上有明显的上升的趋势 C. 在整体上有明显的下降的趋势 D. 在局部上有明显的下降的趋势
简答题
8.二元选择模型通常假设观测数据与一个隐藏的标准正态分布或者Logistic分布有关。( )对 错
多选题
9.近邻分类中的近邻个数说法正确的是:( )A. 1-近邻的复杂度最高 B. 随着近邻个数的增加,模型的复杂度增加 C. 近邻个数不会影响模型的预测能力 D. 近邻个数需要人为确定
简答题
5.线性回归模型的拟合优度的判定系数越大,说明回归方程预测能力较好。( )对 错
多选题
10.关于下面的决策树说法不正确的是( )。A. 此决策树根节点的gini为0.145 B. 落入此决策树根节点中的数据有35个 C. 此次划分的gini增益为0.058 D. 落入Petal.Length≤5.05的数据将为判为versicolor一类
多选题
6.数据经过标准化处理后( )。A. 数据的波动性将会增加 B. 数据的波动单位为1 C. 数据的波动性将会减小 D. 数据值将被放大
简答题
10.由于最优解所在空间假设失误将会造成期望预测误差中的方差部分。对 错
多选题
6.由下图中两类数据(红色一类,黄色一类)的划分问题引出的关于线性可分与不可分的概念正确的是( )。A. 左图两类数据的划分是一个线性可分问题 B. 右图的两类数据的划分是一个线性不可分问题 C. 左图两类数据的划分是一个线性不可分问题 D. 右图的两类数据的划分是一个线性可分问题
多选题
15.自相关系数图与偏自相关图如下。下面的说法不正确的是( )A. 自相关系数具有截尾性 B. 偏自相关系数具有拖尾性 C. 此序列可以认为是AR(1)模型 D. 此序列可以认为是MA(1)模型
多选题
4.关于设定虚拟变量时应当遵循如下原则,下列说法错误的是:( )A. 对于有k个表现值的定性变量,只设定(k-1)个虚拟变量; B. 虚拟变量的值通常用“0”或“1”来表示; C. 对于每个样本而言,同一个定性变量对应虚拟变量的值之和不超过1; D. 对于季节变量而言,四个季节需要设定4个虚拟变量
多选题
14.单位根检验在Python中实现时,下面的选项( )不是regressioncans参数的设定值。A. 'c'(仅常数,默认) B. 'ctt'(常数,线性和二次曲线趋势) C. 'ct'(常数和长期趋势) D. 'nct'(无常数无趋势)
多选题
10.期望预测误差是指( )。A. 真实值与预测值在某种损失函数下的平均值 B. 真实值与预测值之差 C. 真实值与预测值在某种损失函数下的值 D. 真实值与预测值之比
多选题
2.定性数据之间的相关通常采用( )来度量。A. Pearson相关系数 B. Spearman相关系数 C. Kendall tau-b相关系数 D. Hoeffding’s D相关系数
大数据分析与挖掘技术
章节列表
形考任务
74