惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Blog — PlanetScale
Blog — PlanetScale
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Vercel News
Vercel News
B
Blog
腾讯CDC
P
Proofpoint News Feed
Google DeepMind News
Google DeepMind News
N
Netflix TechBlog - Medium
L
LangChain Blog
F
Fortinet All Blogs
T
The Blog of Author Tim Ferriss
人人都是产品经理
人人都是产品经理
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
I
InfoQ
IT之家
IT之家
酷 壳 – CoolShell
酷 壳 – CoolShell
aimingoo的专栏
aimingoo的专栏
D
DataBreaches.Net
Stack Overflow Blog
Stack Overflow Blog
The Cloudflare Blog
Last Week in AI
Last Week in AI
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
博客园 - 三生石上(FineUI控件)
T
Tailwind CSS Blog

博客园 - T.t.T!Ck.¢#

博文阅读密码验证 - 博客园 博文阅读密码验证 - 博客园 人工神经网络(Artificial Neural Netwroks)笔记-模拟退火算法(Simulated Annealing) 人工神经网络(Artificial Neural Netwroks)笔记-径向基函数(Radial Basis Function- RBF) 人工神经网络(Artificial Neural Netwroks)笔记-粒子群优化(Partical Swarm Optimization - PSO) 识别地图上的地名-- 笔记一 人工神经网络(Artificial Neural Netwroks)笔记-基本的非确定性统计训练算法 - T.t.T!Ck.¢# 人工神经网络(Artificial Neural Netwroks)笔记 博文阅读密码验证 - 博客园 人工神经网络(Artificial Neural Netwroks)笔记-连续多输出感知器算法 人工神经网络(Artificial Neural Netwroks)笔记--离散多输出感知器训练算法 博文阅读密码验证 - 博客园 人工神经网络(Artificial Neural Netwroks)笔记-离散单输出感知器算法 Mutual Information 互信息的应用 BeIT Memcached web页面列表的内容抽取 文本相似度计算--余弦定理和广义Jaccard系数 倒排序索引实验 坏事做尽--通过修改IL获取某资源文件 - T.t.T!Ck.¢# - 博客园
人工神经网络(Artificial Neural Netwroks)笔记-消除样本顺序...
T.t.T!Ck.¢# · 2008-07-09 · via 博客园 - T.t.T!Ck.¢#

人工神经网络(Artificial Neural Netwroks)笔记-基本BP算法

上文中已经提到“基础BP算法“偏爱”较后出现的样本,因此较后出现的样本对网络影响较大”

本文将记录如何消除这个影响

用(X1,Y1),(X2,Y2),....(Xs,Ys)的总效果丢该 W^(1),W^(2),...W^(L)

△W^(K)ij=∑△pW^(k)ij

只是替换了原来的简单修改权重矩阵那部分

具体算法流程如下:

1 for k-1 to L do
   1.1初始化 W^(k)

2 初始化精度控制参数ε

3 E=ε+1

4 while E>ε do
   4.1 E=0
   4.2 对所有的i,j,k : △W^(K)ij=0;
   4.3 对S中的每一个样本(Xp,Yp):
      4.3.1计算出Xp对应的实际输出Op
      4.3.2计算出Ep
      4.3.3E=E+Ep
      4.3.4对所有i,j根据相应式子计算△pW^(L)ij
      4.3.5对所有i,j: △W^(L)ij=△W^(L)ij+△pW^(L)ij
      4.3.6 k=L-1
      4.3.7 while k!=0 do
         4.3.7.1对所有 i,j根据相应式子计算△pW^(k)ij
         4.3.7.2对所有i,j :△W^(k)ij=△W^(k)ij+△pW^(k)ij
         4.3.7.3k=k-1
   4.4对所有i,j,k :  W^(k)ij=W^(k)ij=△W^(k)ij
   4.5E=E/2

这是一种最速下降法。采用这样的计算方式较好地解决了因样本的顺序引起的精度问题和训练的抖动问题,但是收敛的速度却相对比较慢了。

下面有几个问题是值得讨论的

收敛速度问题,怎样加快收敛的速度呢?

局部极小点问题,如何逃离或者避开局部极小点呢?

网络瘫痪问题,权变大,但是激活函数的导函数取值很小,那么步长将会变得非常小,进而训练的速度将会下降,最后会导致网络停止收敛,如何是好呢?

稳定性问题,如果网络遇到的是一个连续变化的环境,网络将变得无效,怎么解决?

步长问题,如果步长太小,收敛速度慢,如果步长太大,可能会导致网络瘫痪或者不稳定,咋办?

下篇继续 ^_^