环球电气之家-午夜精彩视频-中国专业电气电子产品行业服务网站!

產(chǎn)品分類

當(dāng)前位置: 首頁 > 工業(yè)控制產(chǎn)品 > 自動(dòng)化控制 > 人工智能

類型分類:
科普知識(shí)
數(shù)據(jù)分類:
人工智能

人工智能之PCA算法

發(fā)布日期:2022-10-09 點(diǎn)擊率:90

前言:人工智能機(jī)器學(xué)習(xí)有關(guān)算法內(nèi)容,人工智能之機(jī)器學(xué)習(xí)主要有三大類:1)分類;2)回歸;3)聚類。今天我們重點(diǎn)探討一下PCA算法。

PCA(主成分分析)是十大經(jīng)典機(jī)器學(xué)習(xí)算法之一。PCA是Pearson在1901年提出的,后來由Hotelling在1933年加以發(fā)展提出的一種多變量的統(tǒng)計(jì)方法。

對于維數(shù)比較多的數(shù)據(jù),首先需要做的事就是在盡量保證數(shù)據(jù)本質(zhì)的前提下將數(shù)據(jù)中的維數(shù)降低。降維是一種數(shù)據(jù)集預(yù)處理技術(shù),往往在數(shù)據(jù)應(yīng)用在其他算法之前使用,它可以去除掉數(shù)據(jù)的一些冗余信息和噪聲,使數(shù)據(jù)變得更加簡單高效,從而實(shí)現(xiàn)提升數(shù)據(jù)處理速度的目的,節(jié)省大量的時(shí)間和成本。降維也成為了應(yīng)用非常廣泛的數(shù)據(jù)預(yù)處理方法。目前處理降維的技術(shù)有很多種,如SVD奇異值分解,主成分分析(PCA),因子分析(FA),獨(dú)立成分分析(ICA)等。今天重點(diǎn)介紹主成分分析(PCA)。

PCA(主成分分析)算法目的是在“信息”損失較小的前提下,將高維的數(shù)據(jù)轉(zhuǎn)換到低維,通過析取主成分顯出的最大的個(gè)別差異,也可以用來削減回歸分析和聚類分析中變量的數(shù)目,從而減小計(jì)算量。

PCA(主成分分析)通常用于高維數(shù)據(jù)集的探索與可視化,還可以用于數(shù)據(jù)壓縮,數(shù)據(jù)預(yù)處理等。

PCA算法概念:

PCA(PrincipalComponent Analysis)主成分分析,也稱為卡爾胡寧-勒夫變換(Karhunen-Loeve Transform),是一種用于探索高維數(shù)據(jù)結(jié)構(gòu)的技術(shù)。

PCA是一種較為常用的降維技術(shù),PCA的思想是將維特征映射到維上,這維是全新的正交特征。這維特征稱為主元,是重新構(gòu)造出來的維特征。在PCA中,數(shù)據(jù)從原來的坐標(biāo)系轉(zhuǎn)換到新的坐標(biāo)系下,新的坐標(biāo)系的選擇與數(shù)據(jù)本身是密切相關(guān)的。第一個(gè)新坐標(biāo)軸選擇的是原始數(shù)據(jù)中方差最大的方向,第二個(gè)新坐標(biāo)軸選擇和第一個(gè)坐標(biāo)軸正交且具有最大方差的方向。該過程一直重復(fù),重復(fù)次數(shù)為原始數(shù)據(jù)中特征的數(shù)目。大部分方差都包含在最前面的幾個(gè)新坐標(biāo)軸中。因此,可以忽略余下的坐標(biāo)軸,即對數(shù)據(jù)進(jìn)行降維處理。

PCA算法本質(zhì)

PCA算法本質(zhì)就是找一些投影方向,使得數(shù)據(jù)在這些投影方向上的方差最大,而且這些投影方向是相互正交的。這其實(shí)就是找新的正交基的過程,計(jì)算原始數(shù)據(jù)在這些正交基上投影的方差,方差越大,就說明在對應(yīng)正交基上包含了更多的信息量。原始數(shù)據(jù)協(xié)方差矩陣的特征值越大,對應(yīng)的方差越大,在對應(yīng)的特征向量上投影的信息量就越大。反之,如果特征值較小,則說明數(shù)據(jù)在這些特征向量上投影的信息量很小,可以將小特征值對應(yīng)方向的數(shù)據(jù)刪除,從而達(dá)到了降維的目的。

PCA把可能具有相關(guān)性的高維變量合成線性無關(guān)的低維變量,稱為主成分( principal components)。新的低維數(shù)據(jù)集會(huì)盡可能保留原始數(shù)據(jù)的變量。

簡而言之,PCA本質(zhì)上是將方差最大的方向作為主要特征,并且在各個(gè)正交方向上將數(shù)據(jù)“離相關(guān)”,也就是讓它們在不同正交方向上沒有相關(guān)性

PCA算法中術(shù)語

1、樣本“信息量”

樣本的“信息量”指的是樣本在特征方向上投影的方差。方差越大,則樣本在該特征上的差異就越大,因此該特征就越重要。在分類問題里,樣本的方差越大,越容易將不同類別的樣本區(qū)分開。

2、方差

希望投影后投影值盡可能分散,而這種分散程度,可以用數(shù)學(xué)上的方差來表述。在統(tǒng)計(jì)描述中,方差用來計(jì)算每一個(gè)變量(觀察值)與總體均數(shù)之間的差異。此處,一個(gè)字段的方差可以看做是每個(gè)元素與字段均值的差的平方和的均值,即:

3、協(xié)方差

對于二維降成一維的問題來說,找到使得方差最大的方向就可以了。但是對于更高維的問題,需要用到協(xié)方差來表示其相關(guān)性。即:

PCA理論基礎(chǔ):

PCA理論基礎(chǔ)如下:

1)最大方差理論。

2)最小錯(cuò)誤理論。

3)坐標(biāo)軸相關(guān)度理論。

PCA算法流程:

1)去平均值,即每一位特征減去各自的平均值;

2)計(jì)算協(xié)方差矩陣;

3)計(jì)算協(xié)方差矩陣的特征值與特征向量;

4)對特征值從大到小排序;

5)保留最大的個(gè)特征向量;

6)將數(shù)據(jù)轉(zhuǎn)換到個(gè)特征向量構(gòu)建的新空間中。

PCA降維準(zhǔn)則:
1) 最近重構(gòu)性:樣本集中所有點(diǎn),重構(gòu)后的點(diǎn)距離原來的點(diǎn)的誤差之和最小。
2) 最大可分性:樣本在低維空間的投影盡可能分

PCA算法優(yōu)點(diǎn):

1)使得數(shù)據(jù)集更易使用;

2)降低算法的計(jì)算開銷;

3)去除噪聲;

4)使得結(jié)果容易理解;

5)完全無參數(shù)限制。

PCA算法缺點(diǎn):

1)    如果用戶對觀測對象有一定的先驗(yàn)知識(shí),掌握了數(shù)據(jù)的一些特征,卻無法通過參數(shù)化等方法對處理過程進(jìn)行干預(yù),可能會(huì)得不到預(yù)期的效果,效率也不高;

2)    特征值分解有一些局限性,比如變換的矩陣必須是方陣

3)    在非高斯分布情況下,PCA方法得出的主元可能并不是最優(yōu)的。

PCA算法應(yīng)用:

PCA算法已經(jīng)被廣泛的應(yīng)用于高維數(shù)據(jù)集的探索與可視化,還可以用于數(shù)據(jù)壓縮,數(shù)據(jù)預(yù)處理等領(lǐng)域。在機(jī)器學(xué)習(xí)當(dāng)中應(yīng)用很廣,比如圖像,語音,通信的分析處理。PCA算法最主要的用途在于“降維”,去除掉數(shù)據(jù)的一些冗余信息和噪聲,使數(shù)據(jù)變得更加簡單高效,提高其他機(jī)器學(xué)習(xí)任務(wù)的計(jì)算效率。

結(jié)語:

PCA是一種常用的數(shù)據(jù)分析方法。PCA通過線性變換將原始數(shù)據(jù)變換為一組各維度線性無關(guān)的表示,可用于識(shí)別和提取數(shù)據(jù)的主要特征分量,通過將數(shù)據(jù)坐標(biāo)軸旋轉(zhuǎn)到數(shù)據(jù)角度上那些最重要的方向(方差最大);然后通過特征值分析,確定出需要保留的主成分個(gè)數(shù),舍棄其他非主成分,從而實(shí)現(xiàn)數(shù)據(jù)的降維降維使數(shù)據(jù)變得更加簡單高效,從而實(shí)現(xiàn)提升數(shù)據(jù)處理速度的目的,節(jié)省大量的時(shí)間和成本。降維也成為了應(yīng)用非常廣泛的數(shù)據(jù)預(yù)處理方法。PCA算法已經(jīng)被廣泛的應(yīng)用于高維數(shù)據(jù)集的探索與可視化,還可以用于數(shù)據(jù)壓縮,數(shù)據(jù)預(yù)處理,圖像,語音,通信的分析處理等領(lǐng)域。

下一篇: PLC、DCS、FCS三大控

上一篇: 索爾維全系列Solef?PV

推薦產(chǎn)品

更多
主站蜘蛛池模板: 【ph计】|在线ph计|工业ph计|ph计厂家|ph计价格|酸度计生产厂家_武汉吉尔德科技有限公司 | 并网柜,汇流箱,电控设备,中高低压开关柜,电气电力成套设备,PLC控制设备订制厂家,江苏昌伟业新能源科技有限公司 | 截齿|煤截齿|采煤机截齿|掘进机截齿|旋挖截齿-山东卓力截齿厂家报价 | 全自动固相萃取仪_高通量真空平行浓缩仪-勤业永为 | 中央空调维修、中央空调保养、螺杆压缩机维修-苏州东菱空调 | 四川成都干燥设备_回转筒干燥机_脉冲除尘器_输送设备_热风炉_成都川工星科机电设备有限公司 | 锂辉石检测仪器,水泥成分快速分析仪-湘潭宇科分析仪器有限公司 | 书法培训-高考书法艺考培训班-山东艺霖书法培训凭实力挺进央美 | 佛山市钱丰金属不锈钢蜂窝板定制厂家|不锈钢装饰线条|不锈钢屏风| 电梯装饰板|不锈钢蜂窝板不锈钢工艺板材厂家佛山市钱丰金属制品有限公司 | EFM 022静电场测试仪-套帽式风量计-静电平板监测器-上海民仪电子有限公司 | 西门子代理商_西门子变频器总代理-翰粤百科 | 玻璃钢型材-玻璃钢风管-玻璃钢管道,生产厂家-[江苏欧升玻璃钢制造有限公司] | 工业机械三维动画制作 环保设备原理三维演示动画 自动化装配产线三维动画制作公司-南京燃动数字 聚合氯化铝_喷雾聚氯化铝_聚合氯化铝铁厂家_郑州亿升化工有限公司 | 爆破器材运输车|烟花爆竹运输车|1-9类危险品厢式运输车|湖北江南专用特种汽车有限公司 | Pos机办理_个人商户免费POS机申请-拉卡拉办理网 | 电子海图系统-电梯检验系统-智慧供热系统开发-商品房预售资金监管系统 | 真空上料机(一种真空输送机)-百科 | 单锥双螺旋混合机_双螺旋锥形混合机-无锡新洋设备科技有限公司 | 方源木业官网-四川木门-全国木门专业品牌 | 特种阀门-调节阀门-高温熔盐阀-镍合金截止阀-钛阀门-高温阀门-高性能蝶阀-蒙乃尔合金阀门-福建捷斯特阀门制造有限公司 | 法钢特种钢材(上海)有限公司 - 耐磨钢板、高强度钢板销售加工 阀门智能定位器_电液动执行器_气动执行机构-赫尔法流体技术(北京)有限公司 | 100_150_200_250_300_350_400公斤压力空气压缩机-舰艇航天配套厂家 | 渣油泵,KCB齿轮泵,不锈钢齿轮泵,重油泵,煤焦油泵,泊头市泰邦泵阀制造有限公司 | 必胜高考网_全国高考备考和志愿填报信息平台 | 线粒体膜电位荧光探针-细胞膜-标记二抗-上海复申生物科技有限公司 | 双工位钻铣攻牙机-转换工作台钻攻中心-钻铣攻牙机一体机-浙江利硕自动化设备有限公司 | 热处理炉-退火炉-回火炉设备厂家-丹阳市电炉厂有限公司 | 西安展台设计搭建_西安活动策划公司_西安会议会场布置_西安展厅设计西安旭阳展览展示 | 胶泥瓷砖胶,轻质粉刷石膏,嵌缝石膏厂家,腻子粉批发,永康家德兴,永康市家德兴建材厂 | 亿立分板机_曲线_锯片式_走刀_在线式全自动_铣刀_在线V槽分板机-杭州亿协智能装备有限公司 | 塑钢课桌椅、学生课桌椅、课桌椅厂家-学仕教育设备首页 | 防腐木批发价格_深圳_惠州_东莞防腐木厂家_森源(深圳)防腐木有限公司 | 手持气象站_便携式气象站_农业气象站_负氧离子监测站-山东万象环境 | 电磁辐射仪-电磁辐射检测仪-pm2.5检测仪-多功能射线检测仪-上海何亦仪器仪表有限公司 | 潍坊青州古城旅游景点攻略_青州酒店美食推荐-青州旅游网 | 丙烷/液氧/液氮气化器,丙烷/液氧/液氮汽化器-无锡舍勒能源科技有限公司 | 飞行者联盟-飞机模拟机_无人机_低空经济_航空技术交流平台 | 万博士范文网-您身边的范文参考网站Vanbs.com | 浇注料-高铝砖耐火砖-郑州凯瑞得窑炉耐火材料有限公司 | 北京软件开发_软件开发公司_北京软件公司-北京宜天信达软件开发公司 | 胀套-锁紧盘-风电锁紧盘-蛇形联轴器「厂家」-瑞安市宝德隆机械配件有限公司 |