Numpy实现优化器 _优化

【Numpy实现优化器】弓背霞明剑照霜，秋风走马出咸阳。这篇文章主要讲述Numpy实现优化器相关的知识，希望能为你提供帮助。

import numpy as np
from mlfromscratch.utils import make_diagonal, normalize

# Optimizers for models that use gradient based methods for finding the
# weights that minimizes the loss.
# A great resource for understanding these methods:
# http://sebastianruder.com/optimizing-gradient-descent/index.html

class StochasticGradientDescent():
def __init__(self, learning_rate=0.01, momentum=0):
self.learning_rate = learning_rate
self.momentum = momentum
self.w_updt = None

def update(self, w, grad_wrt_w):
# If not initialized
if self.w_updt is None:
self.w_updt = np.zeros(np.shape(w))
# Use momentum if set
self.w_updt = self.momentum * self.w_updt + (1 - self.momentum) * grad_wrt_w
# Move against the gradient to minimize loss
return w - self.learning_rate * self.w_updt

class NesterovAcceleratedGradient():
def __init__(self, learning_rate=0.001, momentum=0.4):
self.learning_rate = learning_rate
self.momentum = momentum
self.w_updt = np.array([])

def update(self, w, grad_func):
# Calculate the gradient of the loss a bit further down the slope from w
approx_future_grad = np.clip(grad_func(w - self.momentum * self.w_updt), -1, 1)
# Initialize on first update
if not self.w_updt.any():
self.w_updt = np.zeros(np.shape(w))

self.w_updt = self.momentum * self.w_updt + self.learning_rate * approx_future_grad
# Move against the gradient to minimize loss
return w - self.w_updt

class Adagrad():
def __init__(self, learning_rate=0.01):
self.learning_rate = learning_rate
self.G = None # Sum of squares of the gradients
self.eps = 1e-8

def update(self, w, grad_wrt_w):
# If not initialized
if self.G is None:
self.G = np.zeros(np.shape(w))
# Add the square of the gradient of the loss function at w
self.G += np.power(grad_wrt_w, 2)
# Adaptive gradient with higher learning rate for sparse data
return w - self.learning_rate * grad_wrt_w / np.sqrt(self.G + self.eps)

class Adadelta():
def __init__(self, rho=0.95, eps=1e-6):
self.E_w_updt = None # Running average of squared parameter updates
self.E_grad = None# Running average of the squared gradient of w
self.w_updt = None# Parameter update
self.eps = eps
self.rho = rho

def update(self, w, grad_wrt_w):
# If not initialized
if self.w_updt is None:
self.w_updt = np.zeros(np.shape(w))
self.E_w_updt = np.zeros(np.shape(w))
self.E_grad = np.zeros(np.shape(grad_wrt_w))

# Update average of gradients at w
self.E_grad = self.rho * self.E_grad + (1 - self.rho) * np.power(grad_wrt_w, 2)

RMS_delta_w = np.sqrt(self.E_w_updt + self.eps)
RMS_grad = np.sqrt(self.E_grad + self.eps)

# Adaptive learning rate
adaptive_lr = RMS_delta_w / RMS_grad

# Calculate the update
self.w_updt = adaptive_lr * grad_wrt_w

# Update the running average of w updates
self.E_w_updt = self.rho * self.E_w_updt + (1 - self.rho) * np.power(self.w_updt, 2)

return w - self.w_updt

class RMSprop():
def __init__(self, learning_rate=0.01, rho=0.9):
self.learning_rate = learning_rate
self.Eg = None # Running average of the square gradients at w
self.eps = 1e-8
self.rho = rho

def update(self, w, grad_wrt_w):
# If not initialized
if self.Eg is None:
self.Eg = np.zeros(np.shape(grad_wrt_w))

self.Eg = self.rho * self.Eg + (1 - self.rho) * np.power(grad_wrt_w, 2)

# Divide the learning rate for a weight by a running average of the magnitudes of recent
# gradients for that weight
return w - self.learning_rate *grad_wrt_w / np.sqrt(self.Eg + self.eps)

class Adam():
def __init__(

推荐阅读

不要用 mongodb

能率热水器11 闪烁,主要考虑这几个方面

Java|Java 代码检查工具之PMD入门使用详细教程

请答全名今天是哪位忍者的生日？？火影忍者手游7.3答案

Win10系统Adobe Flash Player失效如何解决?解决Adobe Flash Player失效方法分享

熊童子多肉掉下来的叶子能插活吗图片熊童子多肉掉下来的叶子能插活吗

西游记水帘洞景区在哪里水帘洞在哪里

北京中山公园游览路线北京中山公园银杏几月份可以看2021

在华为系列当中,从高端机到低端机是怎样排列的？

20万启动资金可以做的项目投资20万元做什么生意好

眼睛小怎么整容变大如何让眼睛变大微整，眼睛怎么微整

全文山东省2023年退休养老金调整最新消息山东养老金上调最新方案预算

金枪鱼三明治——镇静安神开胃健脾

大米冬天放外面怕冻，大米白面冬天放在外面怕冻不

南昌八一起义纪念馆要身份证吗现在南昌八一起义纪念馆要身份证吗?

丈母爹打女婿犯法吗

海南月入10000元抚养费标准是什么

五味子配什么补肾效果好

c与mysql数据库连接 c连接mysql代码

印刷报价网站_印刷报价网站程序

stp 生成树协议

zabbix4.2通过163邮箱发邮件报警

Linux系统环境下通过命令启动EasyGBS播放FLV视频流，为何失败了（）

Numpy实现深度学习Model

SMAX发送企业微信通知

我想转行IT，想找一个培训机构，目前看了优就业千峰叩丁狼黑马达内等机构，请问哪个好一点（）

Linux From Scratch（LFS11.0）构建 LFS 系统 - 清理系统

Linux From Scratch（LFS11.0）重启系统

Windows 8系统更新微软补丁时产生的冗余文件如何清理【图】