题目4306 · 机器学习稀疏权重爆炸一个宽 MLP 在 8k 条表格数据上把训练 AUC 拉到 0.99,但验证 AUC 卡在 0.76。特征语义又不支持标签保持的数据增强,而且最大的权重集中在稀疏 one-hot 输入上。你首先应该尝试哪种正则化控制?打开 →