码农知识堂 - 1000bd
  •   Python
  •   PHP
  •   JS/TS
  •   JAVA
  •   C/C++
  •   C#
  •   GO
  •   Kotlin
  •   Swift
  • 机器学习:PCA(Principal Component Analysis主成分)降维


    参考:PCA降维原理 操作步骤与优缺点_TranSad的博客-CSDN博客

     PCA降维算法_偶尔努力翻身的咸鱼的博客-CSDN博客

    需要提前了解的数学知识:

     一、PCA的主要思想

    PCA,即主成分分析方法,是一种使用最广泛的数据降维算法。PCA的主要思想是将n维特征映射到k维上,这k维是全新的正交特征也被称为主成分,是在原有n维特征的基础上重新构造出来的k维特征。PCA的工作就是从原始的空间中顺序地找一组相互正交的坐标轴,新的坐标轴的选择与数据本身是密切相关的。其中,第一个新坐标轴选择是原始数据中方差最大的方向,第二个新坐标轴选取是与第一个坐标轴正交的平面中使得方差最大的,第三个轴是与第1,2个轴正交的平面中方差最大的。依次类推,可以得到n个这样的坐标轴。通过这种方式获得的新的坐标轴,我们发现,大部分方差都包含在前面k个坐标轴中,后面的坐标轴所含的方差几乎为0。于是,我们可以忽略余下的坐标轴,只保留前面k个含有绝大部分方差的坐标轴。事实上,这相当于只保留包含绝大部分方差的维度特征,而忽略包含方差几乎为0的特征维度,实现对数据特征的降维处理。 

     二、PCA的计算过程

    有m个样本,每个样本有n维特征,现在使用PCA降到n维

    m * n ——>     m * k

    1.在变的那个维度上(n),去中心化,得到X:

    2.计算X的协方差矩阵C = \frac{1}{m - 1}X\ast X\ ^{T}

    3.求协方差矩阵的特征值,以及对应特征向量(对应的特征向量就是第一个主成分、第二个主成分……),取前K个最大特征值,他们对应的特征向量组成矩阵P,Y = P * X即为降维后的特征

  • 相关阅读:
    SpringCloud 分布式锁与分布式事务
    动漫主题dreamweaver作业静态HTML网页设计——仿京东(海贼王)版本
    【C++】基础,数据类型,函数,字符串,引用,输入输出,数据结构
    情绪化软文怎么写?媒介盒子分享五大步骤
    C++11的weak_ptr弱引用的智能指针
    【html5的video标签在移动端的使用】【微信内部浏览器video自动播放】【vue-video-player】
    第三节:运算符【java】
    spring boot课程评价系统 毕业设计源码211004
    APP启动流程二(源码30)之APP进程创建
    电商API知识问答
  • 原文地址:https://blog.csdn.net/weixin_62848630/article/details/132845774
  • 最新文章
  • 攻防演习之三天拿下官网站群
    数据安全治理学习——前期安全规划和安全管理体系建设
    企业安全 | 企业内一次钓鱼演练准备过程
    内网渗透测试 | Kerberos协议及其部分攻击手法
    0day的产生 | 不懂代码的"代码审计"
    安装scrcpy-client模块av模块异常,环境问题解决方案
    leetcode hot100【LeetCode 279. 完全平方数】java实现
    OpenWrt下安装Mosquitto
    AnatoMask论文汇总
    【AI日记】24.11.01 LangChain、openai api和github copilot
  • 热门文章
  • 十款代码表白小特效 一个比一个浪漫 赶紧收藏起来吧!!!
    奉劝各位学弟学妹们,该打造你的技术影响力了!
    五年了,我在 CSDN 的两个一百万。
    Java俄罗斯方块,老程序员花了一个周末,连接中学年代!
    面试官都震惊,你这网络基础可以啊!
    你真的会用百度吗?我不信 — 那些不为人知的搜索引擎语法
    心情不好的时候,用 Python 画棵樱花树送给自己吧
    通宵一晚做出来的一款类似CS的第一人称射击游戏Demo!原来做游戏也不是很难,连憨憨学妹都学会了!
    13 万字 C 语言从入门到精通保姆级教程2021 年版
    10行代码集2000张美女图,Python爬虫120例,再上征途
Copyright © 2022 侵权请联系2656653265@qq.com    京ICP备2022015340号-1
正则表达式工具 cron表达式工具 密码生成工具

京公网安备 11010502049817号