博客
关于我
中科大-凸优化 笔记(lec47)-最速下降法
阅读量:320 次
发布时间:2019-03-04

本文共 713 字,大约阅读时间需要 2 分钟。

梯度下降法

梯度下降法是一种广泛应用于优化问题的迭代算法,通过不断调整模型参数使目标函数值逐步减小。其核心思想是沿着目标函数的负梯度方向步进,寻找最优解。具体公式为:

$$x_{k+1} = x_k - \nabla f(x_k)$$

在实际应用中,梯度下降法的收敛速度和最终效果依赖于步长选择和优化策略。为了加快收敛速度,常采用动量项或自适应学习率等方法进行改进。


最速(陡)下降法

最速下降法是梯度下降法的一种变种,采用恒定步长沿着当前点的负梯度方向更新参数。其更新公式与梯度下降法类似,但不考虑动量项或自适应步长。尽管最速下降法的收敛速度较慢,但其实现简单,适用于许多实际问题。


Gradient与Steepest Gradient的变种

为了解决梯度下降法在某些情况下收敛缓慢或无法收敛的问题,研究者提出了多种改进方法。以下是两种常见的变种:


1)坐标轮换法

坐标轮换法是一种处理梯度计算中零点问题的方法。通过轮换目标函数的梯度计算顺序,避免梯度计算过程中出现所有分量同时为零的情况,确保算法能够正常收敛。


2)若$f(x)$在某些点不可微

当目标函数$f(x)$在某些点不可微时,梯度下降法无法直接应用。这种情况下,可以采用插值或近似方法估计不可微点附近的梯度,从而继续优化过程。


例子

假设目标函数$f(x)$在$x_0$处不可微,但其一阶泰勒展开近似为:

$$f(x) \approx f(x_0) + \nabla f(x_0)^T(x - x_0)$$

此时,可以使用梯度近似值$\nabla f(x_0)$代替实际不可微点的梯度,继续进行优化。


下一章传送门

以上内容为本文的全部内容,后续章节请随机访问。

转载地址:http://aepq.baihongyu.com/

你可能感兴趣的文章
Openlayers实战:绘制带箭头的线
查看>>
Openlayers实战:绘制点、线、圆、多边形
查看>>
Openlayers实战:绘制矩形,正方形,正六边形
查看>>
Openlayers实战:自定义放大缩小,显示zoom等级
查看>>
Openlayers实战:自定义版权属性信息
查看>>
Openlayers实战:输入WKT数据,输出GML、Polyline、GeoJSON格式数据
查看>>
Openlayers实战:选择feature,列表滑动,定位到相应的列表位置
查看>>
Openlayers实战:非4326,3857的投影
查看>>
Openlayers高级交互(1/20): 控制功能综合展示(版权、坐标显示、放缩、比例尺、测量等)
查看>>
Openlayers高级交互(10/20):绘制矩形,截取对应部分的地图并保存
查看>>
Openlayers高级交互(11/20):显示带箭头的线段轨迹,箭头居中
查看>>
Openlayers高级交互(12/20):利用高德逆地理编码,点击位置,显示坐标和地址
查看>>
Openlayers高级交互(13/20):选择左右两部分的地图内容,横向卷帘
查看>>
Openlayers高级交互(14/20):汽车移动轨迹动画(开始、暂停、结束)
查看>>
Openlayers高级交互(15/20):显示海量多边形,10ms加载完成
查看>>
Openlayers高级交互(16/20):两个多边形的交集、差集、并集处理
查看>>
Openlayers高级交互(17/20):通过坐标显示多边形,计算出最大幅宽
查看>>
Openlayers高级交互(18/20):根据feature,将图形适配到最可视化窗口
查看>>
Openlayers高级交互(19/20): 地图上点击某处,列表中显示对应位置
查看>>
Openlayers高级交互(2/20):清除所有图层的有效方法
查看>>