码农知识堂 - 1000bd
  •   Python
  •   PHP
  •   JS/TS
  •   JAVA
  •   C/C++
  •   C#
  •   GO
  •   Kotlin
  •   Swift
  • Pytorch model.apply/net.apply


    Pytorch model.apply/net.apply

        • 示例1:
        • 示例2
        • 示例3

    net.apply(fn: Callable[[ForwardRef(‘Module’)], NoneType]) -> ~T

    • 介绍:Pytorch 中的 model.apply(fn) 会递归地将函数 fn 应用到父模块的每个子模块以及model这个父模块自身。通常用于初始化模型的参数。
    • 参数:fn (:class:`Module` -> None)->将应用于每个子模块的函数
    • 返回:Module: self

    示例1:

    来看以下示例:

    @torch.no_grad()
    def init_weights(m):
        print(m)
        if type(m) == nn.Linear:
            m.weight.fill_(1.0)
            print(m.weight)
    net = nn.Sequential(nn.Linear(2, 2), nn.Linear(2, 2))
    net.apply(init_weights)
    
    • 1
    • 2
    • 3
    • 4
    • 5
    • 6
    • 7
    • 8

    在这个网络示例中,模块 net 有两个子模块,均为 Linear(2,4)。函数首先对这两个子模块调用 init_weights 函数,然后再对 net 模块进行同样的操作。
    会打印以下信息:
    Linear(in_features=2, out_features=2, bias=True)
    Parameter containing:
    tensor([[ 1., 1.],
            [ 1., 1.]])
    Linear(in_features=2, out_features=2, bias=True)
    Parameter containing:
    tensor([[ 1., 1.],
            [ 1., 1.]])
    Sequential(
       (0): Linear(in_features=2, out_features=2, bias=True)
       (1): Linear(in_features=2, out_features=2, bias=True)
    )
    Sequential(
       (0): Linear(in_features=2, out_features=2, bias=True)
       (1): Linear(in_features=2, out_features=2, bias=True)
    )

    可以看见的使,不仅仅分别打印两个Linear,还加上父模块自身自己父模块的返回Sequential。

    示例2

    或者下面这个例子:

    net = nn.Sequential(nn.Flatten(), 
                        nn.Linear(784, 256),
                        nn.ReLU(), 
                        nn.Linear(256, 10))
    def init_weights(m):
        print(m)
            
    net.apply(init_weights)
    
    • 1
    • 2
    • 3
    • 4
    • 5
    • 6
    • 7
    • 8

    会打印以下信息:
    Flatten(start_dim=1, end_dim=-1)
    Linear(in_features=784, out_features=256, bias=True)
    ReLU()
    Linear(in_features=256, out_features=10, bias=True)
    Sequential(
       (0): Flatten(start_dim=1, end_dim=-1)
       (1): Linear(in_features=784, out_features=256, bias=True)
       (2): ReLU()
       (3): Linear(in_features=256, out_features=10, bias=True)
    )

    示例3

    如果我们想对某些特定的子模块submodule做一些针对性的处理,该怎么做呢?我们可以加入type(m) == nn.Linear:这类判断语句,从而对特定子模块m进行处理:

    net = nn.Sequential(nn.Flatten(), 
                        nn.Linear(784, 256),
                        nn.ReLU(), 
                        nn.Linear(256, 10))
    def init_weights(m):
        if type(m) == nn.Linear:
            nn.init.normal_(m.weight, std=0.01)
            
    net.apply(init_weights)
    
    • 1
    • 2
    • 3
    • 4
    • 5
    • 6
    • 7
    • 8
    • 9
  • 相关阅读:
    Java中多态的优势和劣势是什么?
    【问题征集】向 iPod 之父、iPhone 联合设计者、Google Nest 创始人 Tony Fadell 提问啦
    网络安全岗位面试经验总结(附面试题)
    猫罐头怎么选?千万别错过这5款好吃放心的猫罐头推荐!
    YOLO目标检测——无人机航拍输电线路绝缘瓷瓶数据集下载分享【对应voc、coco和yolo三种格式标签】
    第五章 音视频-FFmpeg实现播放器解封装、读AVPacket包
    Spring 简介和基础使用
    蓝桥杯实战应用【算法代码篇】-次数差(附Java、Python和C++代码)
    聚观早报 | 美团打车接入腾讯出行;腾讯音乐将在港交所上市
    OpenHarmony自定义组件的生命周期
  • 原文地址:https://blog.csdn.net/qq_28087491/article/details/127984999
  • 最新文章
  • 沪漂五周年了:我越来越迷茫了
    Agentic Skill Routing 实战:别再把所有 Skill 塞进 AI Agent 上下文
    MySQL-Seconds_behind_master的精度误差
    [MAF预定义ChatClient中间件-03]CachingChatClient——利用缓存省钱省时间
    AI的至暗历史:从万众期待到被政府撤资,AI的两次死亡徘徊
    Agent OS :五种驯服不确定性的范式
    PortSwigger SQL注入LAB11
    数据库即时编译JIT
    [Begin]AI Learn Data Day 0
    深度学习进阶(二十七)现代 LLM 的核心架构设计其二:SwiGLU
  • 热门文章
  • 十款代码表白小特效 一个比一个浪漫 赶紧收藏起来吧!!!
    奉劝各位学弟学妹们,该打造你的技术影响力了!
    五年了,我在 CSDN 的两个一百万。
    Java俄罗斯方块,老程序员花了一个周末,连接中学年代!
    面试官都震惊,你这网络基础可以啊!
    你真的会用百度吗?我不信 — 那些不为人知的搜索引擎语法
    心情不好的时候,用 Python 画棵樱花树送给自己吧
    通宵一晚做出来的一款类似CS的第一人称射击游戏Demo!原来做游戏也不是很难,连憨憨学妹都学会了!
    13 万字 C 语言从入门到精通保姆级教程2021 年版
    10行代码集2000张美女图,Python爬虫120例,再上征途
小工具 小游戏
Copyright © 2022 侵权请联系2656653265@qq.com    京ICP备2022015340号-1

京公网安备 11010502049817号