美女网站一区二区_在线观看日韩毛片_成人在线视频首页_欧美精品一区二区三区久久久_国产精品亚洲一区二区三区在线_日本免费新一区视频_日本美女一区二区三区_精品亚洲成a人_久久不见久久见免费视频1_91首页免费视频_欧美一区二区在线看_91精品91久久久中77777_天堂蜜桃一区二区三区_av在线一区二区_欧美不卡一区二区_欧美影视一区二区三区

產(chǎn)品分類

當(dāng)前位置: 首頁 > 工業(yè)控制產(chǎn)品 > 自動(dòng)化控制 > 人工智能

類型分類:
科普知識(shí)
數(shù)據(jù)分類:
人工智能

人工智能之CART算法

發(fā)布日期:2022-10-09 點(diǎn)擊率:57

人工智能機(jī)器學(xué)習(xí)有關(guān)算法內(nèi)容,請(qǐng)參見公眾號(hào)“科技優(yōu)化生活”之前相關(guān)文章。人工智能之機(jī)器學(xué)習(xí)主要有三大類:1)分類;2)回歸;3)聚類。今天我們重點(diǎn)探討一下CART算法。 

繼上兩篇決策樹算法之ID3算法[參見人工智能(41)]和ID3的改進(jìn)算法-C4.5算法[參見人工智能(42)]后,本文繼續(xù)討論另一種二分決策樹算法-CART算法。我們知道十大機(jī)器學(xué)習(xí)中決策樹算法占有兩席位置,即C4.5算法和CART算法,可見CART算法的重要性。下面重點(diǎn)介紹CART算法。

不同于ID3與C4.5,CART為一種二分決策樹,是滿二叉樹。CART算法由Breiman等人在 1984 年提出,它采用與傳統(tǒng)統(tǒng)計(jì)學(xué)完全不同的方式構(gòu)建預(yù)測準(zhǔn)則,它是以二叉樹的形式給出,易于理解、使用和解釋。由CART 模型構(gòu)建的預(yù)測樹在很多情況下比常用的統(tǒng)計(jì)方法構(gòu)建的代數(shù)學(xué)預(yù)測準(zhǔn)則更加準(zhǔn)確,且數(shù)據(jù)越復(fù)雜、變量越多,算法的優(yōu)越性越顯著

CART算法既可用于分類也可用于回歸。CART算法被稱為數(shù)據(jù)挖掘領(lǐng)域內(nèi)里程碑式的算法。

CART算法概念

CART(Classification andRegression Tree) 分類回歸樹是一種決策樹構(gòu)建算法。CART是在給定輸入隨機(jī)變量X條件下輸出隨機(jī)變量Y的條件概率分布的學(xué)習(xí)方法。CART假設(shè)決策樹是二叉樹,內(nèi)部結(jié)點(diǎn)特征的取值為“是”和“否”,左分支是取值為“是”的分支,右分支是取值為“否”的分支。這樣的決策樹等價(jià)于遞歸地二分每個(gè)特征,將輸入空間即特征空間劃分為有限個(gè)單元,并在這些單元上確定預(yù)測的概率分布,也就是在輸入給定的條件下輸出的條件概率分布。

CART算法既可以處理離散型問題,也可以處理連續(xù)型問題。這種算法在處理連續(xù)型問題時(shí),主要通過使用二元切分來處理連續(xù)型變量,即特征值大于某個(gè)給定的值就走左子樹,或者就走右子樹。

CART算法組成

CART算法組成如下:

1)決策樹生成:基于訓(xùn)練數(shù)據(jù)集生成決策樹,生成的決策樹要盡量大;自上而下從根開始建立節(jié)點(diǎn),在每個(gè)節(jié)點(diǎn)處要選擇一個(gè)最好(不同算法使用不同指標(biāo)來定義"最好"的屬性來分裂,使得子節(jié)點(diǎn)中的訓(xùn)練數(shù)據(jù)集盡量的純。

2)決策樹剪枝:用驗(yàn)證數(shù)據(jù)集對(duì)已生成的樹進(jìn)行剪枝并選擇最優(yōu)子樹,這時(shí)損失函數(shù)最小作為剪枝的標(biāo)準(zhǔn)。這里用代價(jià)復(fù)雜度剪枝CCP(Cost-Complexity Pruning)。

決策樹的生成就是通過遞歸地構(gòu)建二叉決策樹的過程,對(duì)回歸樹用平方誤差最小化準(zhǔn)則,對(duì)分類樹用基尼指數(shù)最小化準(zhǔn)則,進(jìn)行特征選擇,生成二叉樹。

CART決策樹生成

1)回歸樹生成

回歸樹采用均方誤差作為損失函數(shù),樹生成時(shí)會(huì)遞歸的按最優(yōu)特征與最優(yōu)特征下的最優(yōu)取值對(duì)空間進(jìn)行劃分,直到滿足停止條件為止,停止條件可以人為設(shè)定,比如當(dāng)切分后的損失減小值小于給定的閾值 ε,則停止切分,生成葉節(jié)點(diǎn)。對(duì)于生成的回歸樹,每個(gè)葉節(jié)點(diǎn)的類別為落到該葉節(jié)點(diǎn)數(shù)據(jù)的標(biāo)簽的均值。

回歸樹為一棵二叉樹,每次都是按特征下的某個(gè)取值進(jìn)行劃分,每一個(gè)內(nèi)部節(jié)點(diǎn)都是做一個(gè)對(duì)應(yīng)特征的判斷,直至走到葉節(jié)點(diǎn)得到其類別,構(gòu)建這棵樹的難點(diǎn)在于如何選取最優(yōu)的切分特征與切分特征對(duì)應(yīng)的切分變量。

回歸樹與模型樹既可以處理連續(xù)特征也可以處理離散特征。

回歸樹生成算法如下:

輸入:訓(xùn)練數(shù)據(jù)集 D={(x1,y1),(x2,y2),…,(xN,yN)}

輸出:回歸樹 T

1)求解選擇切分特征 j 與切分特征取值 s ,j 將訓(xùn)練集 D 劃分為兩部分,R1 與R2 ,依照(j,s)切分后如下:

R1(j,s)={xi|xji≤s}   R2(j,s)={xi|xji>s}

c1=1N1∑xi∈R1yi    c2=1N2∑xi∈R2yi

2)遍歷所有可能的解(j,s),找到最優(yōu)的 (j*,s*) ,最優(yōu)的解使得對(duì)應(yīng)損失最小,按照最優(yōu)特征(j*,s*)來切分即可。

Min { ∑ (yi–c1)^2 +∑ (yi–c2)^2 }

j,s    xi∈R1          xi∈R2

3)遞歸調(diào)用 1)和2),直到滿足停止條件。

4)返回決策樹 T。

回歸樹主要采用了分治策略,對(duì)于無法用唯一的全局線性回歸來優(yōu)化的目標(biāo)進(jìn)行分而治之,進(jìn)而取得比較準(zhǔn)確的結(jié)果,但分段取均值并不是一個(gè)明智的選擇,可以考慮將葉節(jié)點(diǎn)設(shè)置為一個(gè)線性函數(shù),這便是所謂的分段線性模型樹。實(shí)驗(yàn)表明:模型樹效果比回歸樹的效果要好一些。模型樹只需在回歸樹的基礎(chǔ)上稍加修改即可,對(duì)于分到葉節(jié)點(diǎn)的數(shù)據(jù),采用線性回歸的最小均方損失來計(jì)算該節(jié)點(diǎn)的損失。

2)分類樹生成

分類樹是CART中用來分類的,不同于 ID3 與 C4.5,CART分類樹采用基尼指數(shù)來選擇最優(yōu)的切分特征,而且每次都是二分。

基尼指數(shù)是一個(gè)類似與熵的概念,對(duì)于一個(gè)有 K 種狀態(tài)對(duì)應(yīng)的概率為 p1,p2,…,pK的隨機(jī)變量 X ,其基尼指數(shù)Gini定義如下:

Gini(X)=∑pk(1?pk)=1?∑kp2k

k                       k

在已知特征 A條件下集合 D 的基尼指數(shù):

Gini(D,A)=(|D1|/|D|)*Gini(D1)+(|D2|/|D|)*Gini(D2)

Gini(D,A)取值越大,樣本的不確定性也越大,這一點(diǎn)與熵類似,所以選擇特征 A 的標(biāo)準(zhǔn)是 Gini(D,A) 的取值越小越好。

分類樹生成算法如下:

輸入:訓(xùn)練數(shù)據(jù)集 D={(x1,y1),(x2,y2),…,(xN,yN)},停止條件

輸出:分類樹 T

1)利用特征 A 的取值 a 將數(shù)據(jù)分為兩部分,計(jì)算 A=a時(shí)的基尼系數(shù):

Gini(D,A)=(|D1|/|D|)*Gini(D1)+(|D2|/|D|)*Gini(D2)

2)對(duì)整個(gè)數(shù)據(jù)集中所有的可能特征 A 以及其可能取值 a 選取基尼系數(shù)最小的特征 A* 與特征下的取值 a*,來將數(shù)據(jù)集切分,將數(shù)據(jù) D1、D2 分到兩個(gè)子節(jié)點(diǎn)中去。

3)對(duì)子節(jié)點(diǎn)遞歸調(diào)用 1)和2) ,直至滿足停止條件

4)返回 CART 樹 T

該算法停止條件可以是節(jié)點(diǎn)中的樣本數(shù)不能小于給定閾值,或者樣本集的基尼系數(shù)小于給定閾值,或者沒有更多的特征。

3)剪枝

CART需要對(duì)生成的樹進(jìn)行剪枝,避免模型過度擬合訓(xùn)練數(shù)據(jù),剪枝時(shí)使用的損失函數(shù)如下:

Ca(T)=C(T)+a|T|

C(T)為樹 T 對(duì)訓(xùn)練數(shù)據(jù)的誤差,可以用基尼系數(shù)或者均方損失來表示,a≥0 代表一個(gè)權(quán)衡訓(xùn)練數(shù)據(jù)損失 C(T)與總節(jié)點(diǎn)數(shù) |T|的參數(shù),Ca(T) 代表了樹 T 的整體損失,對(duì)于固定的 a,一定存在一個(gè)確定的使得 Ca(T)最小的子樹,當(dāng) a偏大時(shí), |T| 偏小,樹 T 的規(guī)模偏小,反之,樹 T 的規(guī)模偏大,Breiman 等人采用遞歸的方法對(duì) CART 進(jìn)行剪枝,將 a從小增大  0=a0<a1<…<an,如此產(chǎn)生的區(qū)間 a∈[ai,ai+1), i=1,2,…,n用對(duì)應(yīng)此區(qū)間的 a 產(chǎn)生一系列的子樹序列 {T0,T1,…,Tn}這里 Ti+1總是由 Ti 剪枝后產(chǎn)生。

剪枝算法如下:

輸入:CART 生成樹 T0

輸出:剪枝后的最優(yōu)樹 T*

1)設(shè) k=0 , T=T0 ,a=+∞

3) 自下而上的對(duì)內(nèi)部節(jié)點(diǎn) t 計(jì)算:

g(t)=[Ct?C(Tt)]/(|Tt|?1)

a=min(a,g(t))

4) 自上而下的訪問內(nèi)部節(jié)點(diǎn) t ,對(duì)最小的 g(t)=a進(jìn)行剪枝,并對(duì)葉節(jié)點(diǎn) t 以多數(shù)表決形式?jīng)Q定其類別,得到樹 T

5) k=k+1, ak=a,Tk=T

6) 如果 T 為非單節(jié)點(diǎn)樹,回到4)

7) 對(duì)于產(chǎn)生的子樹序列 {T0,T1,…,Tn}分別計(jì)算損失,得到最優(yōu)子樹 T*并返回.

剪枝后的樹便是所需要的CART決策樹。

CART優(yōu)點(diǎn):

1) 可以生成可以理解的規(guī)則;

2) 計(jì)算量相對(duì)來說不是很大;

3) 可以處理連續(xù)和種類字段;

4)決策樹可以清晰的顯示哪些字段比較重要。

CART缺點(diǎn)

1) 對(duì)連續(xù)性的字段比較難預(yù)測;

2) 對(duì)有時(shí)間順序的數(shù)據(jù),需要很多預(yù)處理的工作;

3)當(dāng)類別太多時(shí),錯(cuò)誤可能就會(huì)增加的比較快;

4)一般的算法分類的時(shí)候,只是根據(jù)一個(gè)字段來分類。

CART應(yīng)用場景:

CART算法既可以處理離散型問題,也可以處理連續(xù)型問題。CART算法是一種非常有趣且十分有效的非參數(shù)分類回歸方法。它通過構(gòu)建二叉樹達(dá)到預(yù)測目的。它已在統(tǒng)計(jì)、數(shù)據(jù)挖掘和機(jī)器學(xué)習(xí)領(lǐng)域中普遍使用,是一種應(yīng)用廣泛的決策樹算法。

結(jié)語:

CART 模型最早由Breiman 等人提出,它采用與傳統(tǒng)統(tǒng)計(jì)學(xué)完全不同的方式構(gòu)建預(yù)測準(zhǔn)則,它是以二叉樹形式給出,易于理解、使用和解釋。由CART 模型構(gòu)建的預(yù)測樹在很多情況下比常用的統(tǒng)計(jì)方法構(gòu)建的代數(shù)學(xué)預(yù)測準(zhǔn)則更加準(zhǔn)確,且數(shù)據(jù)越復(fù)雜、變量越多,CART算法優(yōu)越性就越顯著。模型的關(guān)鍵是預(yù)測準(zhǔn)則的構(gòu)建。CART算法在統(tǒng)計(jì)、數(shù)據(jù)挖掘機(jī)器學(xué)習(xí)等領(lǐng)域得到廣泛應(yīng)用。

------以往文章推薦------

機(jī)器學(xué)習(xí)

深度學(xué)習(xí)

人工神經(jīng)網(wǎng)絡(luò)

決策樹

隨機(jī)森林

強(qiáng)化學(xué)習(xí)

遷移學(xué)習(xí)

遺傳算法

樸素貝葉斯

支持向量機(jī)

蒙特卡羅方法

馬爾科夫模型

Hopfield神經(jīng)網(wǎng)絡(luò)

回歸模型

K鄰近算法

卷積神經(jīng)網(wǎng)絡(luò)

受限玻爾茲曼機(jī)

循環(huán)神經(jīng)網(wǎng)絡(luò)

長短時(shí)記憶神經(jīng)網(wǎng)絡(luò)

Adaboost算法

ID3算法

C4.5算法

下一篇: PLC、DCS、FCS三大控

上一篇: 索爾維全系列Solef?PV

推薦產(chǎn)品

更多
美女网站一区二区_在线观看日韩毛片_成人在线视频首页_欧美精品一区二区三区久久久_国产精品亚洲一区二区三区在线_日本免费新一区视频_日本美女一区二区三区_精品亚洲成a人_久久不见久久见免费视频1_91首页免费视频_欧美一区二区在线看_91精品91久久久中77777_天堂蜜桃一区二区三区_av在线一区二区_欧美不卡一区二区_欧美影视一区二区三区


        欧美唯美清纯偷拍| 久久久久久久久一区| 亚洲成人资源网| 一区二区三区国产豹纹内裤在线| 亚洲天堂福利av| 亚洲精品中文字幕乱码三区| 亚洲综合久久av| 午夜不卡av免费| 久久国产日韩欧美精品| 国产成人精品综合在线观看| k8久久久一区二区三区| www.久久爱.cn| 日本一区二区三区四区在线观看 | 欧美极品另类videosde| 中文字幕国产一区二区| 亚洲美女淫视频| 日本最新不卡在线| 国产一本一道久久香蕉| gogo大胆日本视频一区| 精品综合久久| 91国产免费观看| 精品成人在线观看| 一区二区三区在线看| 久久国产精品色| aa成人免费视频| 亚洲精品高清国产一线久久| 欧美综合亚洲图片综合区| 欧美v国产在线一区二区三区| 国产精品久久综合| 美腿丝袜亚洲三区| av一区观看| 色综合久久88色综合天天免费| 欧美一级理论片| 一区二区三区久久| 国产精品18久久久久久久久久久久| 超碰97网站| 在线精品视频免费播放| 国产亚洲精久久久久久| 午夜在线电影亚洲一区| 99精品黄色片免费大全| 伊人av成人| 国产亚洲综合在线| 免费观看一级欧美片| 99r国产精品视频| 欧美在线小视频| 国产精品久久影院| 国产精一区二区三区| 日本免费高清不卡| 精品国产精品一区二区夜夜嗨| 亚洲综合999| av不卡一区二区三区| 中文字幕一区二区三区5566| 国产亚洲美州欧州综合国| 裸体一区二区三区| 久久国产日韩欧美| 日韩一卡二卡三卡四卡| 亚洲高清一区二区三区| 91蜜桃在线免费视频| 欧美三级电影在线看| 亚洲欧美另类久久久精品| 国产99久久久国产精品免费看| 日韩av电影免费在线观看| 久久午夜国产精品| 国产中文一区二区三区| 日韩精品不卡| 亚洲国产精品99久久久久久久久 | 麻豆精品在线播放| 九色91国产| 久久久久国产精品人| 国产精品99久久久久久久vr | 7777精品伊久久久大香线蕉语言| 亚洲丰满在线| 一区在线中文字幕| 成人app在线观看| 欧美日韩久久不卡| 午夜精品久久久久久不卡8050| 成人欧美一区二区| 日韩欧美综合一区| 久久精品久久99精品久久| 色一情一乱一伦一区二区三欧美 | 欧美在线免费观看亚洲| 尤物视频一区二区| 国产伦精品一区二区三区在线| 欧美一区二区女人| 激情文学综合丁香| 在线免费视频一区二区| 日日摸夜夜添夜夜添国产精品| 欧美成人一区二区在线| 亚洲视频一二三区| 久久人人爽爽人人爽人人片av| 国产亚洲精品福利| 91aaaa| 久久精品一区二区| 91久久伊人青青碰碰婷婷| 精品粉嫩aⅴ一区二区三区四区| 国产 日韩 欧美大片| 欧美一级高清大全免费观看| 国产精品中文字幕日韩精品| 欧美福利视频一区| 国产成人免费网站| 精品日韩在线观看| 91污片在线观看| 国产视频一区二区三区在线观看| 不卡一区二区三区四区| 久久免费视频一区| 国产欧美一区二区三区另类精品 | 久久国产精品一区二区| 一本一本大道香蕉久在线精品| 五月天中文字幕一区二区| 色综合激情五月| 麻豆91精品视频| 欧美一级二级在线观看| 成人a免费在线看| 精品国产一二三| 国产精品久久一区二区三区| 亚洲视频网在线直播| 亚洲春色在线| 免费观看成人av| 日韩一区二区精品在线观看| 91香蕉视频污在线| 国产精品免费av| 日本不卡在线播放| 蜜桃视频在线观看一区二区| 欧美日韩国产综合久久| aaa欧美色吧激情视频| 国产精品进线69影院| 五月天婷亚洲天综合网鲁鲁鲁| 免费高清视频精品| 欧美一区二区三区婷婷月色| 99精彩视频| 亚洲成a人片在线观看中文| 欧美无人高清视频在线观看| 成人免费毛片嘿嘿连载视频| 国产日产欧美一区| 日本一区免费看| 国产在线国偷精品免费看| 国产日韩欧美高清| 杨幂一区欧美专区| www.激情成人| 亚洲一级二级在线| 日韩精品一区二区三区中文精品 | 欧美精品在线观看一区二区| 不卡在线视频中文字幕| 亚洲激情网站免费观看| 欧美日韩国产综合视频在线观看| 91在线观看下载| 舔着乳尖日韩一区| 久久综合网色—综合色88| 日韩av高清在线播放| 国产成人久久精品77777最新版本| 亚洲欧美综合色| 欧美理论在线播放| 免费在线国产精品| 国产成a人无v码亚洲福利| 中文字幕一区二区三区色视频| 欧美影院一区二区三区| 成人av免费看| 国产在线播精品第三| 亚洲精品成人悠悠色影视| 日韩欧美一区二区不卡| 色播亚洲婷婷| 91视频在线观看免费| 秋霞成人午夜伦在线观看| 国产精品免费丝袜| 91麻豆精品国产综合久久久久久| 久久精品99| voyeur盗摄精品| 裸体一区二区三区| 亚洲少妇30p| 精品久久人人做人人爽| 亚洲日本精品一区| 国产精品一区二区三区免费观看| 精品影视av免费| 一卡二卡欧美日韩| 中文欧美字幕免费| 日韩一区二区三区四区| 伊人久久青草| 欧美人xxxxx| 成人免费在线一区二区三区| 国产黄色91视频| 久久国产精品色婷婷| 亚洲自拍偷拍网站| 欧美极品另类videosde| 日韩精品一区二| 精品视频一区三区九区| 日韩片电影在线免费观看| 国产精品xxx在线观看www| 成人精品gif动图一区| 美国三级日本三级久久99 | 粉嫩嫩av羞羞动漫久久久| 午夜精品久久久久久久99樱桃| 中文字幕av一区二区三区| 精品国产三级电影在线观看| 欧美日韩一二三| 亚洲一区二区三区精品在线观看| 国产一区二区中文字幕免费看| 91原创在线视频| av中文字幕不卡| 波多野结衣一区二区三区| 国产91在线|亚洲|