码农知识堂 - 1000bd
  •   Python
  •   PHP
  •   JS/TS
  •   JAVA
  •   C/C++
  •   C#
  •   GO
  •   Kotlin
  •   Swift
  • 机器学习基础知识


    监督学习:回归和分类

    无监督学习:聚类 用一张image去聚类然后生成一个3D空间图

    强化学习:利用一个学习算法,通过一系列的决策,让他学会什么是好什么是坏。程序操控直升机,当他下降给他说:bad ,如果做了正确的事情,上升就说good,有一个reward函数,需要找一个更多的good和更少的bad。这样直升机就会学会更多的good操作来获取更多的奖励。

    梯度下降:假设在一个三维小山坡,去找一个方向能让你下坡速度更快,就是梯度的方向,站到新的方向继续思考。(不同的初始起点,会造成不同的方向)

     随机梯度下降:用每一个样本计算一次误差然后走一步,顺序进行。所以整个过程都是无限接近最小值。

    最小二乘法:

    朴素贝叶斯:朴素贝叶斯模型假设属性之间相互独立,这个假设在实际应用中往往是不成立的,在属性个数比较多或者属性之间相关性较大时,分类效果不好。而在属性相关性较小时,朴素贝叶斯性能最为良好。对于这一点,有半朴素贝叶斯之类的算法通过考虑部分关联性适度改进。

    经验风险最小化:

    机器学习笔记8: 经验风险最小化 - 简书icon-default.png?t=M5H6https://www.jianshu.com/p/216feebdfdb7

    特征选择:之所以要考虑特征选择,是因为机器学习经常面临过拟合的问题。 过拟合的表现是模型参数太贴合训练集数据,模型在训练集上效果很好而在测试集上表现不好,也就是在高方差。简言之模型的泛化能力差。过拟合的原因是模型对于训练集数据来说太复杂,要解决过拟合问题,一般考虑如下方法:

    误差=偏差+方差,偏差=期望-真实值 方差:离散程度

    如何理解过拟合=高方差、欠拟合=高偏差_再进步一点点的博客-CSDN博客_过拟合 高方差欠拟合=高偏差还好理解一些,一直不太明白过拟合和高方差有什么关系,那么我们首先就要理解各种 ‘差’ 的定义定义:我们评价一个模型好不好,是通过测试集的数据来评价的,而不是训练集或者交叉验证集,如果在测试集上预测数据表现得不好,那么我们就说这个训练出来的模型有很大的误差。那么误差来自于哪里呢?误差 = 偏差 + 方差在不写出这个式子时,很多人可能不会察觉误差和偏差有什么区别?因此总是想当然的认为误差和偏差是一个东西,这样就会造成我们无法理解方差是什么?误差:在测试集上,预测值和实际值之间存在的差距https://blog.csdn.net/tiaochewang219/article/details/107631221

    1. 收集更多数据
    2. 通过正则化引入对复杂度的惩罚
    3. 选择更少参数的简单模型
    4. 对数据降维(降维有两种方式:特征选择和特征抽取)

    【机器学习】特征选择(Feature Selection)方法汇总 - 知乎介绍 特征选择是特征工程里的一个重要问题,其目标是寻找最优特征子集。特征选择能剔除不相关(irrelevant)或冗余(redundant )的特征,从而达到减少特征个数,提高模型精确度,减少运行时间的目的。另一方面,选取…https://zhuanlan.zhihu.com/p/74198735#:~:text=【机器学习】特征选择%20%28Feature%20Selection%29方法汇总%201%20收集更多数据,2%20通过正则化引入对复杂度的惩罚%203%20选择更少参数的简单模型%204%20对数据降维(降维有两种方式:特征选择和特征抽取)

    主成分分析法:极大线性无关组=降维如何理解主成分分析法 (PCA) - 知乎什么是主成分分析法 主成分分析法:英文全名 Principal Component Analysis 简称 PCA ,由名字就可以看出来,这是一个挑重点分析的方法。主成分分析 法是通过 恰当 的数学变换 ,使新变量—— 主成分成为原变量 的…https://zhuanlan.zhihu.com/p/170398464

    我们需要考虑删除哪一列信息可以使得损失最小?或者是通过变换数据就能使得损失信息更小?又如何度量信息的丢失量?原始数据的处理降维有哪些步骤?

     找一个新坐标系。能够找到一个主成分一(也就是新坐标X轴)上投影分布的方差最大的时候,说明主成分一保留着更多的原始信息,这个方向就是最好的一个坐标系。

    用最直观的方式告诉你:什么是主成分分析PCA_哔哩哔哩_bilibiliPPT不提供不用问https://www.bilibili.com/video/BV1E5411E71z?spm_id_from=333.337.search-card.all.click&vd_source=1d56bba3304958bfdb80c190ceff8f70

     

    奇异值分解:正交矩阵转置就是逆奇异值分解(SVD) - 知乎以下内容来自刘建平Pinard-博客园的学习笔记,总结如下:奇异值分解(Singular Value Decomposition,以下简称SVD)是在机器学习领域广泛应用的算法,它不光可以用于降维算法中的特征分解,还可以用于推荐系统,以及…https://zhuanlan.zhihu.com/p/29846048

    【学长小课堂】什么是奇异值分解SVD--SVD如何分解时空矩阵_哔哩哔哩_bilibiliPPT不提供不用问https://www.bilibili.com/video/BV16A411T7zX?spm_id_from=333.337.search-card.all.click&vd_source=1d56bba3304958bfdb80c190ceff8f70

     

  • 相关阅读:
    区块链之光:揭秘Web3时代的创新契机
    我测试用的mark down教程
    在 Python 中使用 Selenium 按文本查找元素
    不想自己开车,Python帮你搞定自动驾驶
    零时科技 || Victor the Fortune攻击事件分析
    计算机毕业设计django基于python街区医院管理系统
    C++DAY48
    《论文阅读》同情对话生成的知识桥梁 AAAI 2021
    ubuntu linux 配置PATH JAVA PATH(解决双击不能启动eclipse的问题)
    Shopee买家通系统全自动化操作简单方便又快速
  • 原文地址:https://blog.csdn.net/daxuan1881/article/details/125394143
  • 最新文章
  • 沪漂五周年了:我越来越迷茫了
    Agentic Skill Routing 实战:别再把所有 Skill 塞进 AI Agent 上下文
    MySQL-Seconds_behind_master的精度误差
    [MAF预定义ChatClient中间件-03]CachingChatClient——利用缓存省钱省时间
    AI的至暗历史:从万众期待到被政府撤资,AI的两次死亡徘徊
    Agent OS :五种驯服不确定性的范式
    PortSwigger SQL注入LAB11
    数据库即时编译JIT
    [Begin]AI Learn Data Day 0
    深度学习进阶(二十七)现代 LLM 的核心架构设计其二:SwiGLU
  • 热门文章
  • 十款代码表白小特效 一个比一个浪漫 赶紧收藏起来吧!!!
    奉劝各位学弟学妹们,该打造你的技术影响力了!
    五年了,我在 CSDN 的两个一百万。
    Java俄罗斯方块,老程序员花了一个周末,连接中学年代!
    面试官都震惊,你这网络基础可以啊!
    你真的会用百度吗?我不信 — 那些不为人知的搜索引擎语法
    心情不好的时候,用 Python 画棵樱花树送给自己吧
    通宵一晚做出来的一款类似CS的第一人称射击游戏Demo!原来做游戏也不是很难,连憨憨学妹都学会了!
    13 万字 C 语言从入门到精通保姆级教程2021 年版
    10行代码集2000张美女图,Python爬虫120例,再上征途
小工具 小游戏
Copyright © 2022 侵权请联系2656653265@qq.com    京ICP备2022015340号-1

京公网安备 11010502049817号