日本黄色一级经典视频|伊人久久精品视频|亚洲黄色色周成人视频九九九|av免费网址黄色小短片|黄色Av无码亚洲成年人|亚洲1区2区3区无码|真人黄片免费观看|无码一级小说欧美日免费三级|日韩中文字幕91在线看|精品久久久无码中文字幕边打电话

當前位置:首頁 > 智能硬件 > 人工智能AI
[導讀] PCA(主成分分析)是十大經(jīng)典機器學習算法之一。PCA是Pearson在1901年提出的,后來由Hotelling在1933年加以發(fā)展提出的一種多變量的統(tǒng)計方法。 對于維數(shù)比較

PCA(主成分分析)是十大經(jīng)典機器學習算法之一。PCA是Pearson在1901年提出的,后來由Hotelling在1933年加以發(fā)展提出的一種多變量的統(tǒng)計方法。

對于維數(shù)比較多的數(shù)據(jù),首先需要做的事就是在盡量保證數(shù)據(jù)本質的前提下將數(shù)據(jù)中的維數(shù)降低。降維是一種數(shù)據(jù)集預處理技術,往往在數(shù)據(jù)應用在其他算法之前使用,它可以去除掉數(shù)據(jù)的一些冗余信息和噪聲,使數(shù)據(jù)變得更加簡單高效,從而實現(xiàn)提升數(shù)據(jù)處理速度的目的,節(jié)省大量的時間和成本。降維也成為了應用非常廣泛的數(shù)據(jù)預處理方法。目前處理降維的技術有很多種,如SVD奇異值分解,主成分分析(PCA),因子分析(FA),獨立成分分析(ICA)等。今天重點介紹主成分分析(PCA)。

PCA(主成分分析)算法目的是在“信息”損失較小的前提下,將高維的數(shù)據(jù)轉換到低維,通過析取主成分顯出的最大的個別差異,也可以用來削減回歸分析和聚類分析中變量的數(shù)目,從而減小計算量。

PCA(主成分分析)通常用于高維數(shù)據(jù)集的探索與可視化,還可以用于數(shù)據(jù)壓縮,數(shù)據(jù)預處理等。

PCA算法概念:

PCA(PrincipalComponent Analysis)主成分分析,也稱為卡爾胡寧-勒夫變換(Karhunen-Loeve Transform),是一種用于探索高維數(shù)據(jù)結構的技術。

PCA是一種較為常用的降維技術,PCA的思想是將維特征映射到維上,這維是全新的正交特征。這維特征稱為主元,是重新構造出來的維特征。在PCA中,數(shù)據(jù)從原來的坐標系轉換到新的坐標系下,新的坐標系的選擇與數(shù)據(jù)本身是密切相關的。第一個新坐標軸選擇的是原始數(shù)據(jù)中方差最大的方向,第二個新坐標軸選擇和第一個坐標軸正交且具有最大方差的方向。該過程一直重復,重復次數(shù)為原始數(shù)據(jù)中特征的數(shù)目。大部分方差都包含在最前面的幾個新坐標軸中。因此,可以忽略余下的坐標軸,即對數(shù)據(jù)進行降維處理。

PCA算法本質:

PCA算法本質就是找一些投影方向,使得數(shù)據(jù)在這些投影方向上的方差最大,而且這些投影方向是相互正交的。這其實就是找新的正交基的過程,計算原始數(shù)據(jù)在這些正交基上投影的方差,方差越大,就說明在對應正交基上包含了更多的信息量。原始數(shù)據(jù)協(xié)方差矩陣的特征值越大,對應的方差越大,在對應的特征向量上投影的信息量就越大。反之,如果特征值較小,則說明數(shù)據(jù)在這些特征向量上投影的信息量很小,可以將小特征值對應方向的數(shù)據(jù)刪除,從而達到了降維的目的。

PCA把可能具有相關性的高維變量合成線性無關的低維變量,稱為主成分( principal components)。新的低維數(shù)據(jù)集會盡可能保留原始數(shù)據(jù)的變量。

簡而言之,PCA本質上是將方差最大的方向作為主要特征,并且在各個正交方向上將數(shù)據(jù)“離相關”,也就是讓它們在不同正交方向上沒有相關性。

PCA算法中術語: 1、樣本“信息量”

樣本的“信息量”指的是樣本在特征方向上投影的方差。方差越大,則樣本在該特征上的差異就越大,因此該特征就越重要。在分類問題里,樣本的方差越大,越容易將不同類別的樣本區(qū)分開。

2、方差

希望投影后投影值盡可能分散,而這種分散程度,可以用數(shù)學上的方差來表述。在統(tǒng)計描述中,方差用來計算每一個變量(觀察值)與總體均數(shù)之間的差異。此處,一個字段的方差可以看做是每個元素與字段均值的差的平方和的均值,即:

3、協(xié)方差

對于二維降成一維的問題來說,找到使得方差最大的方向就可以了。但是對于更高維的問題,需要用到協(xié)方差來表示其相關性。即:

PCA理論基礎:

PCA理論基礎如下:

1)最大方差理論。

2)最小錯誤理論。

3)坐標軸相關度理論。

PCA算法流程:

1)去平均值,即每一位特征減去各自的平均值;

2)計算協(xié)方差矩陣;

3)計算協(xié)方差矩陣的特征值與特征向量;

4)對特征值從大到小排序;

5)保留最大的個特征向量;

6)將數(shù)據(jù)轉換到個特征向量構建的新空間中。

PCA降維準則:

1) 最近重構性:樣本集中所有點,重構后的點距離原來的點的誤差之和最小。

2) 最大可分性:樣本在低維空間的投影盡可能分開。

PCA算法優(yōu)點:

1)使得數(shù)據(jù)集更易使用;

2)降低算法的計算開銷;

3)去除噪聲;

4)使得結果容易理解;

5)完全無參數(shù)限制。

PCA算法缺點:

1) 如果用戶對觀測對象有一定的先驗知識,掌握了數(shù)據(jù)的一些特征,卻無法通過參數(shù)化等方法對處理過程進行干預,可能會得不到預期的效果,效率也不高;

2) 特征值分解有一些局限性,比如變換的矩陣必須是方陣;

3) 在非高斯分布情況下,PCA方法得出的主元可能并不是最優(yōu)的。

PCA算法應用:

PCA算法已經(jīng)被廣泛的應用于高維數(shù)據(jù)集的探索與可視化,還可以用于數(shù)據(jù)壓縮,數(shù)據(jù)預處理等領域。在機器學習當中應用很廣,比如圖像,語音,通信的分析處理。PCA算法最主要的用途在于“降維”,去除掉數(shù)據(jù)的一些冗余信息和噪聲,使數(shù)據(jù)變得更加簡單高效,提高其他機器學習任務的計算效率。

結語:

PCA是一種常用的數(shù)據(jù)分析方法。PCA通過線性變換將原始數(shù)據(jù)變換為一組各維度線性無關的表示,可用于識別和提取數(shù)據(jù)的主要特征分量,通過將數(shù)據(jù)坐標軸旋轉到數(shù)據(jù)角度上那些最重要的方向(方差最大);然后通過特征值分析,確定出需要保留的主成分個數(shù),舍棄其他非主成分,從而實現(xiàn)數(shù)據(jù)的降維。降維使數(shù)據(jù)變得更加簡單高效,從而實現(xiàn)提升數(shù)據(jù)處理速度的目的,節(jié)省大量的時間和成本。降維也成為了應用非常廣泛的數(shù)據(jù)預處理方法。PCA算法已經(jīng)被廣泛的應用于高維數(shù)據(jù)集的探索與可視化,還可以用于數(shù)據(jù)壓縮,數(shù)據(jù)預處理,圖像,語音,通信的分析處理等領域。

本站聲明: 本文章由作者或相關機構授權發(fā)布,目的在于傳遞更多信息,并不代表本站贊同其觀點,本站亦不保證或承諾內容真實性等。需要轉載請聯(lián)系該專欄作者,如若文章內容侵犯您的權益,請及時聯(lián)系本站刪除。
換一批
延伸閱讀

LED驅動電源的輸入包括高壓工頻交流(即市電)、低壓直流、高壓直流、低壓高頻交流(如電子變壓器的輸出)等。

關鍵字: 驅動電源

在工業(yè)自動化蓬勃發(fā)展的當下,工業(yè)電機作為核心動力設備,其驅動電源的性能直接關系到整個系統(tǒng)的穩(wěn)定性和可靠性。其中,反電動勢抑制與過流保護是驅動電源設計中至關重要的兩個環(huán)節(jié),集成化方案的設計成為提升電機驅動性能的關鍵。

關鍵字: 工業(yè)電機 驅動電源

LED 驅動電源作為 LED 照明系統(tǒng)的 “心臟”,其穩(wěn)定性直接決定了整個照明設備的使用壽命。然而,在實際應用中,LED 驅動電源易損壞的問題卻十分常見,不僅增加了維護成本,還影響了用戶體驗。要解決這一問題,需從設計、生...

關鍵字: 驅動電源 照明系統(tǒng) 散熱

根據(jù)LED驅動電源的公式,電感內電流波動大小和電感值成反比,輸出紋波和輸出電容值成反比。所以加大電感值和輸出電容值可以減小紋波。

關鍵字: LED 設計 驅動電源

電動汽車(EV)作為新能源汽車的重要代表,正逐漸成為全球汽車產(chǎn)業(yè)的重要發(fā)展方向。電動汽車的核心技術之一是電機驅動控制系統(tǒng),而絕緣柵雙極型晶體管(IGBT)作為電機驅動系統(tǒng)中的關鍵元件,其性能直接影響到電動汽車的動力性能和...

關鍵字: 電動汽車 新能源 驅動電源

在現(xiàn)代城市建設中,街道及停車場照明作為基礎設施的重要組成部分,其質量和效率直接關系到城市的公共安全、居民生活質量和能源利用效率。隨著科技的進步,高亮度白光發(fā)光二極管(LED)因其獨特的優(yōu)勢逐漸取代傳統(tǒng)光源,成為大功率區(qū)域...

關鍵字: 發(fā)光二極管 驅動電源 LED

LED通用照明設計工程師會遇到許多挑戰(zhàn),如功率密度、功率因數(shù)校正(PFC)、空間受限和可靠性等。

關鍵字: LED 驅動電源 功率因數(shù)校正

在LED照明技術日益普及的今天,LED驅動電源的電磁干擾(EMI)問題成為了一個不可忽視的挑戰(zhàn)。電磁干擾不僅會影響LED燈具的正常工作,還可能對周圍電子設備造成不利影響,甚至引發(fā)系統(tǒng)故障。因此,采取有效的硬件措施來解決L...

關鍵字: LED照明技術 電磁干擾 驅動電源

開關電源具有效率高的特性,而且開關電源的變壓器體積比串聯(lián)穩(wěn)壓型電源的要小得多,電源電路比較整潔,整機重量也有所下降,所以,現(xiàn)在的LED驅動電源

關鍵字: LED 驅動電源 開關電源

LED驅動電源是把電源供應轉換為特定的電壓電流以驅動LED發(fā)光的電壓轉換器,通常情況下:LED驅動電源的輸入包括高壓工頻交流(即市電)、低壓直流、高壓直流、低壓高頻交流(如電子變壓器的輸出)等。

關鍵字: LED 隧道燈 驅動電源
關閉