pytorch中的backward

2023年6月12日下午4:17 • 数据结构和算法 • 阅读 77

这个函数的作用是反向传播计算梯度的。

这个只有标量才能直接使用 backward()，如果使用自定义的函数，得到的不是标量，则backward()时需要传入 grad_variable 参数。

torch.tensor是autograd包的基础类，如果你设置tensor的requires_grads为True，就会开始跟踪这个tensor上面的所有运算，如果你做完运算后使用tensor.backward()，所有的梯度就会自动运算，tensor的梯度将会累加到它的.grad属性里面去。
如果没有进行tensor.backward()的话，梯度值将会是None，因此loss.backward()要写在optimizer.step()之前。

在用pytorch训练模型时，通常会在遍历epochs的过程中依次用到optimizer.zero_grad(),loss.backward()和optimizer.step()三个函数，如下所示：

总得来说，这三个函数的作用是先将梯度归零（optimizer.zero_grad()），然后反向传播计算得到每个参数的梯度值（loss.backward()），最后通过梯度下降执行一步参数更新（optimizer.step()）

接下来将通过源码分别理解这三个函数的具体实现过程。在此之前，先简要说明一下函数中常见的参数变量：

param_groups：Optimizer类在实例化时会在构造函数中创建一个param_groups列表，列表中有num_groups个长度为6的param_group字典（num_groups取决于你定义optimizer时传入了几组参数），每个param_group包含了 [‘params’, ‘lr’, ‘momentum’, ‘dampening’, ‘weight_decay’, ‘nesterov’] 这6组键值对。

param_group[‘params’]：由传入的模型参数组成的列表，即实例化Optimizer类时传入该group的参数，如果参数没有分组，则为整个模型的参数model.parameters()，每个参数是一个torch.nn.parameter.Parameter对象。

optimizer.zero_grad()函数会遍历模型的所有参数，通过p.grad.detach_()方法截断反向传播的梯度流，再通过p.grad.zero_()函数将每个参数的梯度值设为0，即上一次的梯度记录被清空。

因为训练的过程通常使用mini-batch方法，所以如果不将梯度清零的话，梯度会与上一个batch的数据相关，因此该函数要写在反向传播和梯度下降之前。

PyTorch的反向传播(即tensor.backward())是通过autograd包来实现的，autograd包会根据tensor进行过的数学运算来自动计算其对应的梯度。

具体来说，torch.tensor是autograd包的基础类，如果你设置tensor的requires_grads为True，就会开始跟踪这个tensor上面的所有运算， 如果你做完运算后使用tensor.backward()，所有的梯度就会自动运算，tensor的梯度将会累加到它的.grad属性里面去。

更具体地说，损失函数loss是由模型的所有权重w经过一系列运算得到的，若某个w的requires_grads为True，则w的所有上层参数（后面层的权重w）的.grad_fn属性中就保存了对应的运算，然后在使用loss.backward()后，会一层层的反向传播计算每个w的梯度值，并保存到该w的.grad属性中。

如果没有进行tensor.backward()的话，梯度值将会是None，因此loss.backward()要写在optimizer.step()之前。

以SGD为例，torch.optim.SGD().step()源码如下：

step()函数的作用是执行一次优化步骤，通过梯度下降法来更新参数的值。因为梯度下降是基于梯度的，所以在 执行optimizer.step()函数前应先执行loss.backward()函数来计算梯度。

注意：optimizer只负责通过梯度下降进行优化，而不负责产生梯度，梯度是tensor.backward()方法产生的。

参考：https://www.cnblogs.com/Thinker-pcw/p/9630367.html

Original: https://www.cnblogs.com/ccfco/p/15791804.html
Author: 小筱痕
Title: pytorch中的backward

原创文章受到原创版权保护。转载请注明出处：https://www.johngo689.com/604653/

转载文章受原作者版权保护。转载请注明原作者出处！

数据结构和算法

【自取】最近整理的，有需要可以领取学习：

Linux核心资料大放送~

全栈面试题汇总（持续更新&可下载）

一个提高学习100%效率的工具！

【超详细】深度学习面试题目！

LeetCode Python刷题答案下载！

LeetCode Java版刷题答案下载！

LeetCode C++ 版本，抓紧保存！

LeetCode GO语言刷题答案下载！

【Codeforces-420D】Cup Trick(无旋treap-平衡树)

题目传送门：https://codeforces.com/problemset/problem/420/D 题意：给出m次操作，每次操作输入两个值x，y，将y位置值为x的数移到最前…

数据结构和算法 2023年6月8日
00132
最新漏洞：Spring Framework远程代码执行漏洞

Spring Framework远程代码执行漏洞发布时间 2022-03-31 漏洞等级 High CVE编号 CVE-2022-22965 影响范围：同时满足以下三个条件可确定…

数据结构和算法 2023年6月16日
00190
基于不同策略的英文单词的词频统计和检索系统（C++）

基于不同策略的英文单词的词频统计和检索系统。在这个系统中，我们使用了两种不同的数据结构，分别是哈希表和二叉搜索树。 1. 类设计 2. 插入单词操作这个操作用于将给定的单词插入到…

数据结构和算法 2023年5月2日
00353
Git&GitHub 03 使用 SSH 协议

为什么使用 SSH protocol 在之前的教程中, 我们使用 HTTPS 协议连接远程仓库. HTTPS 协议是目前比较受用户青睐的连接方式, 用以下命令可以查看到当前 o…

数据结构和算法 2023年6月12日
0091
在排序数组中查找元素的第一个和最后一个位置

给定一个按照升序排列的整数数组 nums，和一个目标值 target。找出给定目标值在数组中的开始位置和结束位置。如果数组中不存在目标值 target，返回 [-1, -1]。 …

数据结构和算法 2023年6月12日
00102
蓝桥杯 ALGO-998 娜神平衡(简单粗暴)

试题算法训练娜神平衡资源限制时间限制：1.0s 内存限制：256.0MB 问题描述娜娜是一个特别可爱的女孩子，作为学神的她最近在情感方面出现了一点点小问题。她暗恋的琦琦是…

数据结构和算法 2023年6月7日
0076
移动元素

就离谱，再次被语文AK，顺便学了点unordered_set 移动元素后分四种情况假设元素原位置为(i)，移动后为(j)(pre[])为序列前缀和,(suf[])为序列后缀和 1…

数据结构和算法 2023年6月7日
0092
创建线程有几种方式？

创建线程的几种方式 1️⃣ 继承 Thread 类继承 Thread 类创建线程的步骤为： 1）创建一个类继承Thread类，重写run()方法，将所要完成的任务代码写进run(…

数据结构和算法 2023年6月8日
00137
h5c3/01-html 鼠标悬停在文字上，文字内容改变

前言我们知道 :hover 可以选择鼠标指针浮动在上面的元素，并设置样式。我们可以改变元素的颜色，大小。但是如何改变它的显示内容呢？效果是这样的: 详解我们可以用伪元素选…

数据结构和算法 2023年6月8日
0074
初识设计模式-原型模式

简介对于大部分系统来说，创建对象包括申请内存、给成员变量赋值等过程，这些操作耗费的时间基本可以忽略不计。如果对象中的数据需要经过复杂的计算才能得到（比如排序、计算哈希值），或者…

数据结构和算法 2023年6月8日
0089
SQL(二)DQL查询总结

SQL(二)DQL查询总结简单查询查询一个字段 select 字段名 from 表名; 查询多个字段 selsct 字段1,字段2 from 表名; 查询所有字段 //法一(实…

数据结构和算法 2023年6月7日
0088
剑指 Offer 20. 表示数值的字符串

剑指 Offer 20. 表示数值的字符串这种大模拟题真的就是磨练心态的，太麻烦了，wa得没脾气。总结起来就是一定要有数字，小数点前必须有数字并且小数点前面不能有e，e前面必须有…

数据结构和算法 2023年6月7日
0094
今天才发现ThinkPad的触摸板简直好用！傻乎乎的自己

最近经常看到这句话，天下武功，唯快不破。今天才发现ThinkPad的触摸板简直好用！今天才发现，傻乎乎的自己。前一阵鼠标不好用了，没有滚轮，一直傻瓜式操作点击浏览器的滚动条。。。遇…

数据结构和算法 2023年6月12日
00122
Leetcode第8题：字符串转换整数 (atoi)

/** 这题就是要细心，首先要通过循环去掉前面的空格然后看看有没有正号或者负号，或者没有符号再看看数字有没有越界 */ class Solution { public int …

数据结构和算法 2023年6月8日
0092
算法竞赛进阶指南 0x58 数据结构优化DP

农民约翰正在指挥他的 N 头牛进行清理工作。他将一天划分为了 T 个班次（1∼ T）。每头牛都只能在一天中的某一个时间段内进行不间断的工作。你需要帮助约翰排列出一个合理的奶牛的…

数据结构和算法 2023年6月12日
0078
MySQL实战45讲 13

13 | 为什么表数据删掉一半，表文件大小不变？一个 InnoDB 表包含两部分，即：表结构定义和数据。在 MySQL 8.0 版本以前，表结构是存在以.frm 为后缀的…

数据结构和算法 2023年6月8日
00110

2024 年 5 月
一	二	三	四	五	六	日
		1	2	3	4	5
6	7	8	9	10	11	12
13	14	15	16	17	18	19
20	21	22	23	24	25	26
27	28	29	30	31

pytorch中的backward

大家都在看