简答题下列哪一项能反映出 X 和 Y 之间的强相关性? A、相关系数为 0.9 B、对于无效假设 β=0 的 p 值为 0.0001 C、对于无效假设 β=0 的 t 值为 30 D、以上说法都不对简答题在各类机器学习算法中,过拟合和欠拟合都是可以彻底避免的。 A、正确 B、错误简答题如果 Y 是 X(X1,X2,...,Xn)的线性函数:Y = β0 + β1X1 + β2X2 + ··· + βnXn,则下列说法正确的是? A、如果变量 Xi 改变一个微小变量 ΔXi,其它变量不变。那么 Y 会相应改变 βiΔXi。 B、βi 是固定的,不管 Xi 如何变化 C、Xi 对 Y 的影响是相互独立的,且 X 对 Y 的总的影响为各自分量 Xi 之和简答题假设一个公司的薪资水平中位数是 21,000 和 1,那么它可以被看成是异常值(Outlier)吗? A、可以 B、不可以 C、需要更多的信息才能判断 D、以上说法都不对简答题聚类和分类的区别在于用于聚类的训练样本的类标记是未知的。 A、正确 B、错误简答题向量 X=[1,2,3,4,-9,0] 的 L1 范数为? A、1 B、19 C、6 D、√111简答题列表、元组和字符串都支持双向索引,有效索引的范围为[-L,L],L为列表、元组或字符串的长度。 A、正确 B、错误简答题下面两张图展示了两个拟合回归线(A 和 B),原始数据是随机产生的。现在,我想要计算 A 和 B 各自的残差之和。注意:两种图中的坐标尺度一样。 A、A 比 B 高 B、A 比 B 小 C、A 与 B 相同 D、以上说法都不对简答题直观上看,我们希望“物以类聚”,即聚类的结果“簇内相似度”高,且“簇间”相似度低。 A、正确 B、错误简答题查全率越高,意味着模型漏掉的样本越少,当假阴性的成本很高时,查全率指标有助于衡量模型的好坏。 A、正确 B、错误简答题以下哪些方法不可以直接来对文本分类? A、K-Means B、决策树 C、支持向量机 D、kNN简答题点击率预测是一个正负样本不平衡问题(例如 99% 的没有点击,只有 1% 点击)。假如在这个非平衡的数据集上建立一个模型,得到训练样本的正确率是 99%,则下列说法正确的是? A、模型正确率很高,不需要优化模型了 B、模型正确率并不高,应该建立更好的模型 C、无法对模型做出好坏评价 D、以上说法都不对