6.3 BP神经网络

🕗 发布于 2024-03-25 07:56 神经网络 人工智能 深度学习 笔记

在多层感知器被引入的同时，也引入了一个新的问题：由于隐藏层的预期输出并没有在训练样例中给出，隐藏层结点的误差无法像单层感知器那样直接计算得到。

为了解决这个问题，反向传播（BP）算法被引入，其核心思想是将误差由输出层向前层反向传播，利用后一层的误差来估计前一层的误差。

反向传播算法由亨利·J.凯莉在1960年首先提出，阿瑟·E.布赖森也在1961年进一步讨论该算法。

使用反向传播算法训练的网络称为BP网络。

一、梯度下降

为了使得误差可以反向传播，梯度下降的算法被采用，其思想是在权值空间中朝着误差下降最快的反向搜索，找到局部的最小值：

w ← w + △w

其中，w 为权值，α为学习率，Loss（·）为损失函数。

损失函数的作用是计算实际输出与期望输出之间的误差。

常用的损失函数如下：

1、均方误差，实际输出为oi，预期输出为yi ：

2、交叉熵（CE）：

由于求偏导需要激活函数是连续的，而符号函数不满足连续的要求，因此通常使用连续可微的函数，如sigmoid作为激活函数。

特别的，sigmoid具有良好的求导性质：

σ ' = σ（1 - σ）

sigmoid函数使得计算偏导时较为方便，因此被广泛应用。

二、反向传播

使得误差反向传播的关键在于利用求偏导的链式法则。

我们知道，神经网络是直观展示的一系列计算操作，每个节点可以用一个函数 f (·) 来表示。

下图所示的神经网络则可以表达一个以 w₁，...，w₆ 为参量，以 i₁，...，i₄ 为变量的函数：

在梯度下降中，为了求 △Wk，我们需要用链式规则去求，

例如求：

通过这种方式，误差得以反向传播并用于更新每一个连续权值，使得神经网络在整体上逼近损失函数的局部最小值，从而达到训练目的。

原文地址：https://blog.csdn.net/Ting_28/article/details/136914545

免责声明：本站文章内容转载自网络资源，如本站内容侵犯了原著者的合法权益，可联系本站删除。更多内容请关注自学内容网（zxcms.com）！

上一篇：AI大模型的训练与优化
下一篇：linux系统——tar，gzip，zip命令

Java项目实战II基于Java+Spring Boot+MySQL的共享汽车管理系统(源码+数据库+文档)
在共享经济蓬勃发展的背景下，共享汽车作为一种新型的出行方式，正逐渐改变着人们的出行习惯。然而，随着共享汽车市场规模的不断扩大，车辆管理、用户服务、数据安全等问题日益凸显，传统的管理方式已难以满足当前的
阅读更多2024-11-19
【青牛科技】汽车收音机调频中频放大器——D1145
无线麦克风对讲机。
阅读更多2024-11-19
鸿蒙中位置权限和相机权限
State permissionsMessage: string | Resource = "\"获取当前位置\"需获取定位权限才能正常使用"this.perm
阅读更多2024-11-19
UE5 第一人称射击项目学习（二）
然后，把子弹的向前向量提升（在ue5的标准向量是以1cm为单位，所以虽然子弹跟随视角发射，但是速度太慢），从生成Actor的return Value处拉一根线，获取向前向量乘1000.运行程序，按
阅读更多2024-11-19
【软考】系统架构设计师-数据库设计基础
数据库设计基础知识
阅读更多2024-11-19
MongoDB 监控：确保数据库性能和可靠性
MongoDB 是一个流行的开源 NoSQL 数据库，以其灵活的文档模型和强大的查询语言而闻名。然而，为了确保 MongoDB 的性能和可靠性，监控是至关重要的。本文将讨论 MongoDB 监控的重要
阅读更多2024-11-19
电脑插入U盘，电脑显示新增了，但是双击却显示请将磁盘插入
`CHKDSK 无法供 RAW 驱动器使用` 表明内存卡的文件系统已损坏或丢失，当前处于 **RAW 文件系统** 状态。RAW 表示文件系统无法识别，可能由以下原因导致：
阅读更多2024-11-19
【论文阅读】InstructIR: High-Quality Image Restoration Following Human Instructions
图像恢复是一个基本问题，旨在从退化的图像中恢复出高质量的清晰图像。All-In-One 图像恢复模型能够利用退化特定的信息作为提示，引导恢复模型有效地恢复多种类型和不同程度的退化图像。本研究提出了首个
阅读更多2024-11-19
【Next】字体修改
next/font 包括任何字体文件的内置自动自托管。首先从 next/font/google 导入您想要使用的字体作为函数。（可以按住 ctrl 点进去 google 查看所有字体）然后导入该字体函
阅读更多2024-11-19
Springboot基于GIS的旅游信息管理系统
项目编号：springbootA100基于GIS的旅游信息管理系统是在旅游业迅速发展、旅游需求日益多样化的背景下应运而生的一套综合性信息管理平台，它通过整合旅游资源、提供实时信息、优化服务流程，旨在为
阅读更多2024-11-19

6.3 BP神经网络

一、梯度下降

二、反向传播

相关文章