首页 > 代码库 > 每日一个机器学习算法——正则化
每日一个机器学习算法——正则化
在对数据进行拟合,学习模型的过程中,会出现以下情况:
1)high variance, overfitting.过拟合
2)high bias, underfiiting.欠拟合
过拟合出现的原因
1)太多的特征。
2)过少的训练数据。
如何解决?
1)减少特征数
2)模型选择算法(model selection algorithm)
3)正则化:保留特征参数,但尽可能减小其幅值为0。
lambuda为正则化参数:看做是一个tradeoff。用于平衡以下两项
1)更好的适应模型
2)将特征的系数尽可能变小
此参数过大,则会出现underfitting. 过小则会出现overfitting.
如何选择正则化参数?后续章节将会论述。
每日一个机器学习算法——正则化
声明:以上内容来自用户投稿及互联网公开渠道收集整理发布,本网站不拥有所有权,未作人工编辑处理,也不承担相关法律责任,若内容有误或涉及侵权可进行投诉: 投诉/举报 工作人员会在5个工作日内联系你,一经查实,本站将立刻删除涉嫌侵权内容。