机器学习的梯度下降和梯度优化
发布时间
阅读量:
阅读量
在评估机器学习模型时通常使用损失函数作为基准,在我们的训练目标上也基本都是为了最小化损失值。为了实现这一目标的方法通常是优化算法的应用,在机器学习领域中梯度下降算法是最常用的优化方法之一。
导数、方向导数和梯度
为掌握梯度下降算法的基础知识,首先要明确什么是梯度。它们是理解梯度概念的重要基础。
导数
导数表示为函数y=f(x)在某一点随自变量**\textbf{x}轴正方向}的变化率。当导数值大于零(即f'(x)>0)时,在该点附近自变量随\textbf{x}轴正方向增大时函数值表现出递增的趋势;反之亦然(即当导数值小于零时),自变量随\textbf{x}轴正方向增大时函数值表现出递减的趋势。
方向导数
该点沿着某个趋近方向的变化速率即为该点的该趋近方向上的全微分值;而在x轴正向上的变化速度被称为偏微分值;而在其他特定的方向上则称为全微分值
梯度
该方法旨在解决的是:函数在变量空间中某一特定点周围的变化趋势问题。
该点处的梯度向量代表了能够获得最大变化率的方向。
这表明,在这一点上沿着该向量所指的方向会发生最显著的变化。
这是因为当我们在该点沿着这个向量移动时会获得最大的变化幅度。
认识到函数在梯度方向上呈现出最大的变化幅度;在机器学习领域中追求最小化损失的目标下进行优化时,默认采取沿负梯度方向减少目标函数值的方式
全部评论 (0)
还没有任何评论哟~
