我们想要训练一个 ML 模型,样本数量有 100 万个,特征维度是 5000,面对如此大数据,如何有效地训练模型?
A、对训练集随机采样,在随机采样的数据上建立模型
B、尝试使用在线机器学习算法
C、使用 PCA 算法减少特征维度