99999久久久久久亚洲,欧美人与禽猛交狂配,高清日韩av在线影院,一个人在线高清免费观看,啦啦啦在线视频免费观看www

熱線電話：13121318867

登錄

首頁精彩閱讀R語言與數(shù)據(jù)分析之三：分類算法1_數(shù)據(jù)分析師

R語言與數(shù)據(jù)分析之三：分類算法1_數(shù)據(jù)分析師

2014-12-12

R語言與數(shù)據(jù)分析之三：分類算法1_數(shù)據(jù)分析師

分類算法與我們的生活息息相關(guān)，也是目前數(shù)據(jù)挖掘中應(yīng)用最為廣泛的算法，如：已知系列的溫度、濕度的序列和歷史的是否下雨的統(tǒng)計，我們需要利用歷史的數(shù)據(jù)作為學(xué)習(xí)集來判斷明天是否下雨；又如銀行信用卡詐騙判別。

分類問題都有一個學(xué)習(xí)集，根據(jù)學(xué)習(xí)集構(gòu)造判別函數(shù)，最后根據(jù)判別函數(shù)計算我們所需要判別的個體屬于哪一類的。

常見的分類模型與算法

傳統(tǒng)方法

1、線性判別法；2、距離判別法；3、貝葉斯分類器；

現(xiàn)代方法：

1、決策樹；2、支持向量機；3、神經(jīng)網(wǎng)絡(luò)；

線性判別法：

天氣預(yù)報數(shù)據(jù)(x1,x2分別為溫度和濕度，G為是否下雨)

[plain] view plaincopy

G=c(1,1,1,1,1,1,1,1,1,1,2,2,2,2,2,2,2,2,2,2)
x1=c(-1.9,-6.9,5.2,5.0,7.3,6.8,0.9,-12.5,1.5,3.8,0.2,-0.1,0.4,2.7,2.1,-4.6,-1.7,-2.6,2.6,-2.8)
x2=c(3.2,0.4,2.0,2.5,0.0,12.7,-5.4,-2.5,1.3,6.8,6.2,7.5,14.6,8.3,0.8,4.3,10.9,13.1,12.8,10.0)
a=data.frame(G,x1,x2)
plot(x1,x2)
text(x1,x2,G,adj=-0.5)

觀察上圖可以1點分布在右下方區(qū)域，2點主要分布在上方區(qū)域，肉眼可見這兩個集合分離的比較明顯，線性判別法的原理就是在平面中找出一條直線，使得屬于學(xué)習(xí)集1號的分布在直線一側(cè)，屬于學(xué)習(xí)集2號的分布在直線另一側(cè)。

判別式是允許有出差的，只要在一定的范圍內(nèi)即可。

R語言的表達(dá)如下

[plain] view plaincopy

library(MASS)
ld=lda(G~x1+x2)
z=predict(ld)
newG=z$class
y=cbind(G,z$x,newG)

由上左圖可以看出，首先計算先驗概率，數(shù)據(jù)中1，2各占50%，然后計算x1和x2的平均值，最后給出了判別函數(shù)的代數(shù)表達(dá)：

觀察上右圖可見，newG為預(yù)測的判別，可見兩類分別只有一個判錯，同時可以見判別函數(shù)的值為正值時判為第2類，判別函數(shù)值為負(fù)值時判為第1類。

距離判別法

計算待測點和各類的距離，選擇最近的分類進(jìn)行歸類。其中距離的計算非常關(guān)鍵，常見的距離為馬氏距離：

R語言沒有自動距離判別法的函數(shù)，我們需要自己手動寫：

[plain] view plaincopy

myDiscriminiant<- function(TrnX1,TrnX2,TstX =NULL,var.equal=FALSE)
{
if(is.null(TstX)==TRUE) TstX <- rbind(TrnX1,TrnX2)
if(is.vector(TstX)==TRUE) TstX<- t(as.matrix(TstX))
else if(is.matrix(TstX) !=TRUE)
TstX <- as.matrix(TstX)
if(is.matrix(TrnX1)!=TRUE) TrnX1 <- as.matrix(TrnX1)
if(is.matrix(TrnX2)!=TRUE) TrnX2 <- as.matrix(TrnX2)
nx <- nrow(TstX)
blong <- matrix(rep(0,nx),nrow=1,byrow=TRUE,dimnames=list("blong",1:nx))
mu1 <-colMeans(TrnX1);mu2 <- colMeans(TrnX2)
if(var.equal==TRUE || var.equal==T){
S<- var(rbind(TrnX1,TrnX2))
w<- mahalanobis(TstX,mu2,S)-mahalanobis(TstX,mu1,S)
}
else{
S1<-var(TrnX1);S2<-var(TrnX2)
w<-mahalanobis(TstX,mu2,S2)-mahalanobis(TstX,mu1,S1)
}
for(i in 1:nx){
if(w[i]>0)
blong[i] <- 1
else
blong[i] <- 2
}
blong
}

保存到當(dāng)前空間后，在控制臺調(diào)用它：

[plain] view plaincopy

classX1 <- data.frame(
x1=c(6.6,6.6,6.1,6.1,8.4,7.2,8.4,7.5,7.5,8.3,7.8,7.8),
x2=c(39,39,47,47,32,6,113,52,52,113,172,172),
x3=c(1,1,1,1,2,1,3.5,1,3.5,0,1,1.5)
)
classX2 <- data.frame(
x1=c(8.4,8.4,8.4,6.3,7,7,7,8.3,8.3,7.2,7.2,7.2,5.5,8.4,8.4,7.5,7.5,8.3,8.3,8.3,8.3,7.8,7.8),
x2=c(32,32,32,11,8,8,8,161,161,6,6,6,6,113,113,52,52,97,97,89,56,172,283),
x3=c(1,2,2.5,4.5,4.5,6,1.5,1.5,0.5,3.5,1.0,1.0,2.5,3.5,3.5,1,1,0,2.5,0,1.5,1,1)
)
source("myDiscriminiant.R")
myDiscriminiant(classX1,classX2,var.equal=TRUE)

觀看blong就可以看出個體屬于哪一分類

貝葉斯分類器：

計算個體屬于所有分類的概率，根據(jù)概率大小選擇所屬分類，已兩個總體總體的判別情況來看，X1，X2分別具有概率密度函數(shù)f1(x)和f2(x)，則樣本實際來自X1卻誤判為X2的概率為：

同樣來自X2卻誤判為X1的概率簡單轉(zhuǎn)換下即可；

來自X1也被判為X1的概率為：

來自X2也被判為X2的也類似

設(shè)p1,p2分別表示X1和X2的先驗概率，則

用L(1|2)表示X2被誤判為X1的損失，其他類似，為了是分類越準(zhǔn)確，則需降低平均誤判損失（expected cost of misclassification:ECM）越小越好:

上式便為Bayes版別式。

按照上述數(shù)學(xué)推導(dǎo)，我們構(gòu)建自己的兩個總體的Bayes判別程序：

[plain] view plaincopy

myBayes <- function(TrnX1,TrnX2,rate=1,TstX=NULL,var.equal=FALSE){
if(is.null(TstX)==TRUE) TstX<-rbind(TrnX1,TrnX2)
if(is.vector(TstX)==TRUE) TstX<-t(as.matrix(TstX))
else if(is.matrix(TstX)!=TRUE)
TstX <- as.matrix(TstX)
if(is.matrix(TrnX1)!=TRUE) TrnX1 <- as.matrix(TrnX1)
if(is.matrix(TrnX2)!=TRUE) TrnX2 <- as.matrix(TrnX2)
nx <- nrow(TstX)
blong <- matrix(rep(0,nx),nrow=1,byrow=TRUE,dimnames=list("blong",1:nx))
mu1 <-colMeans(TrnX1);mu2 <- colMeans(TrnX2)
if(var.equal==TRUE || var.equal==T){
S<- var(rbind(TrnX1,TrnX2))
w<- mahalanobis(TstX,mu2,S)-mahalanobis(TstX,mu1,S)
}
else{
S1<-var(TrnX1);S2<-var(TrnX2)
beta <-2*log(rate)+log(det(S1)/det(S2))
w<-mahalanobis(TstX,mu2,S2)-mahalanobis(TstX,mu1,S1)
}
for(i in 1:nx){
if(w[i]>beta)
blong[i] <- 1
else
blong[i] <- 2
}
blong
}

以天氣預(yù)報為案例，我們看看如何使用Bayse分類器：

我們在控制臺錄入數(shù)據(jù)：

[plain] view plaincopy

TrnX1<- matrix(
c(24.8,24.1,26.6,23.5,25.5,27.4,
-2,-2.4,-3,-1.9,-2.1,-3.1),
ncol=2)
TrnX2<-matrix(
c(22.1,21.6,22,22.8,22.7,21.5,22.1,21.4,
-0.7,-1.4,-0.8,-1.6,-1.5,-1,-1.2,-1.3),
ncol=2)
source("myBayes.R")
myBayes(TrnX1,TrnX2,rate=8/6)

下圖可見所有的樣本全部判別正確:

CDA數(shù)據(jù)分析師考試相關(guān)入口一覽（建議收藏）：

? 想報名CDA認(rèn)證考試，點擊>>> “CDA報名” 了解CDA考試詳情；

? 想學(xué)習(xí)CDA考試教材，點擊>>> “CDA教材” 了解CDA考試詳情；

? 想加入CDA考試題庫，點擊>>> “CDA題庫” 了解CDA考試詳情；

? 想了解CDA考試含金量，點擊>>> “CDA含金量” 了解CDA考試詳情；

先驗概率數(shù)據(jù)分析 R語言支持向量機決策樹神經(jīng)網(wǎng)絡(luò) 數(shù)據(jù)挖掘

數(shù)據(jù)分析咨詢請掃描二維碼

若不方便掃碼，搜微信號：CDAshujufenxi

上一篇圖論在大數(shù)據(jù)分析中的作用！

下一篇CDA認(rèn)證再升一檔！與國家共同推進(jìn)大數(shù)據(jù)人才培養(yǎng)標(biāo)準(zhǔn)教育事業(yè)！

CDA報考指南

報考流程
考試時間
報名費用
聯(lián)系我們

數(shù)據(jù)分析學(xué)習(xí)

數(shù)據(jù)分析師資訊

京公網(wǎng)安備 11010802034615號經(jīng)營許可證編號：京B2-20210330

聯(lián)系電話：13321103290 (微信同號)

CDA教材
CDA題庫
CDA大綱

客服在線

立即咨詢

客服在線

立即咨詢

免密碼登錄

提交首次登錄驗證后自動注冊

') } function initGt() { var handler = function (captchaObj) { captchaObj.appendTo('#captcha'); captchaObj.onReady(function () { $("#wait").hide(); }).onSuccess(function(){ $('.getcheckcode').removeClass('dis'); $('.getcheckcode').trigger('click'); }); window.captchaObj = captchaObj; }; $('#captcha').show(); $.ajax({ url: "/login/gtstart?t=" + (new Date()).getTime(), // 加隨機數(shù)防止緩存 type: "get", dataType: "json", success: function (data) { $('#text').hide(); $('#wait').show(); // 調(diào)用 initGeetest 進(jìn)行初始化 // 參數(shù)1：配置參數(shù) // 參數(shù)2：回調(diào)，回調(diào)的第一個參數(shù)驗證碼對象，之后可以使用它調(diào)用相應(yīng)的接口 initGeetest({ // 以下 4 個配置參數(shù)為必須，不能缺少 gt: data.gt, challenge: data.challenge, offline: !data.success, // 表示用戶后臺檢測極驗服務(wù)器是否宕機 new_captcha: data.new_captcha, // 用于宕機時表示是新驗證碼的宕機 product: "float", // 產(chǎn)品形式，包括：float，popup width: "280px", https: true // 更多配置參數(shù)說明請參見：http://docs.geetest.com/install/client/web-front/ }, handler); } }); } function codeCutdown() { if(_wait == 0){ //倒計時完成 $(".getcheckcode").removeClass('dis').html("重新獲取"); }else{ $(".getcheckcode").addClass('dis').html("重新獲取("+_wait+"s)"); _wait--; setTimeout(function () { codeCutdown(); },1000); } } function inputValidate(ele,telInput) { var oInput = ele; var inputVal = oInput.val(); var oType = ele.attr('data-type'); var oEtag = $('#etag').val(); var oErr = oInput.closest('.form_box').next('.err_txt'); var empTxt = '請輸入'+oInput.attr('placeholder')+'！'; var errTxt = '請輸入正確的'+oInput.attr('placeholder')+'！'; var pattern; if(inputVal==""){ if(!telInput){ errFun(oErr,empTxt); } return false; }else { switch (oType){ case 'login_mobile': pattern = /^1[3456789]\d{9}$/; if(inputVal.length==11) { $.ajax({ url: '/login/checkmobile', type: "post", dataType: "json", data: { mobile: inputVal, etag: oEtag, page_ur: window.location.href, page_referer: document.referrer }, success: function (data) { } }); } break; case 'login_yzm': pattern = /^\d{6}$/; break; } if(oType=='login_mobile'){ } if(!!validateFun(pattern,inputVal)){ errFun(oErr,'') if(telInput){ $('.getcheckcode').removeClass('dis'); } }else { if(!telInput) { errFun(oErr, errTxt); }else { $('.getcheckcode').addClass('dis'); } return false; } } return true; } function errFun(obj,msg) { obj.html(msg); if(msg==''){ $('.login_submit').removeClass('dis'); }else { $('.login_submit').addClass('dis'); } } function validateFun(pat,val) { return pat.test(val); }

99999久久久久久亚洲,欧美人与禽猛交狂配,高清日韩av在线影院,一个人在线高清免费观看,啦啦啦在线视频免费观看www

R語言與數(shù)據(jù)分析之三：分類算法1_數(shù)據(jù)分析師

R語言與數(shù)據(jù)分析之三：分類算法1_數(shù)據(jù)分析師

線性判別法：

距離判別法

貝葉斯分類器：

數(shù)據(jù)分析師考試動態(tài)

CDA報考指南

數(shù)據(jù)分析學(xué)習(xí)

數(shù)據(jù)分析師資訊

【CDA干貨】訓(xùn)練與驗證損失驟升：機器學(xué)習(xí)訓(xùn)練中的 ...

【CDA干貨】解析 DataHub 與 Kafka：數(shù)據(jù)生態(tài)中兩類 ...

CDA 數(shù)據(jù)分析師：讓統(tǒng)計基本概念成為業(yè)務(wù)決策的底層 ...

CDA 數(shù)據(jù)分析師：表結(jié)構(gòu)數(shù)據(jù) “獲取 - 加工 - 使用 ...

【CDA干貨】SQL Server 中 CONVERT 函數(shù)的日期轉(zhuǎn)換 ...

【CDA干貨】MySQL 大表拆分與關(guān)聯(lián)查詢效率：打破 “ ...

【CDA干貨】DSGE 模型中的 Et：理性預(yù)期算子的內(nèi)涵 ...

【CDA干貨】Python 提取 TIF 中地名的完整指南 ...

CDA 數(shù)據(jù)分析師：解鎖表結(jié)構(gòu)數(shù)據(jù)特征價值的專業(yè)核心 ...

【CDA干貨】Excel 導(dǎo)入數(shù)據(jù)含缺失值？詳解 dropna ...

【CDA干貨】深入解析卡方檢驗與 t 檢驗：差異、適用 ...

CDA 數(shù)據(jù)分析師：掌控表格結(jié)構(gòu)數(shù)據(jù)全功能周期的專業(yè) ...

【CDA干貨】MySQL 執(zhí)行計劃中 rows 數(shù)量的準(zhǔn)確性解 ...

【CDA干貨】解析 Python 中 Response 對象的 text ...

CDA 數(shù)據(jù)分析師：激活表格結(jié)構(gòu)數(shù)據(jù)價值的核心操盤手 ...

【CDA干貨】Python HTTP 請求工具對比：urllib.requ ...

【CDA干貨】解決 pd.read\_csv 讀取長浮點數(shù)據(jù)的科 ...

CDA 數(shù)據(jù)分析師：業(yè)務(wù)數(shù)據(jù)分析步驟的落地者與價值優(yōu) ...

【CDA干貨】用 SQL 驗證業(yè)務(wù)邏輯：從規(guī)則拆解到數(shù)據(jù) ...

【CDA干貨】塔吉特百貨孕婦營銷案例：數(shù)據(jù)驅(qū)動下的 ...

CDA教育閉環(huán)

常見問題

關(guān)于我們

CDA數(shù)據(jù)分析師公眾號

CDA考試中心小程序

CDA數(shù)據(jù)分析師App下載

99999久久久久久亚洲,欧美人与禽猛交狂配,高清日韩av在线影院,一个人在线高清免费观看,啦啦啦在线视频免费观看www

R語言與數(shù)據(jù)分析之三：分類算法1_數(shù)據(jù)分析師

R語言與數(shù)據(jù)分析之三：分類算法1_數(shù)據(jù)分析師

線性判別法：

距離判別法

貝葉斯分類器：

數(shù)據(jù)分析師考試動態(tài)

CDA報考指南

數(shù)據(jù)分析學(xué)習(xí)

數(shù)據(jù)分析師資訊

【CDA干貨】訓(xùn)練與驗證損失驟升：機器學(xué)習(xí)訓(xùn)練中的 ...

【CDA干貨】解析 DataHub 與 Kafka：數(shù)據(jù)生態(tài)中兩類 ...

CDA 數(shù)據(jù)分析師：讓統(tǒng)計基本概念成為業(yè)務(wù)決策的底層 ...

CDA 數(shù)據(jù)分析師：表結(jié)構(gòu)數(shù)據(jù) “獲取 - 加工 - 使用 ...

【CDA干貨】SQL Server 中 CONVERT 函數(shù)的日期轉(zhuǎn)換 ...

【CDA干貨】MySQL 大表拆分與關(guān)聯(lián)查詢效率：打破 “ ...

【CDA干貨】DSGE 模型中的 Et：理性預(yù)期算子的內(nèi)涵 ...

【CDA干貨】Python 提取 TIF 中地名的完整指南 ...

CDA 數(shù)據(jù)分析師：解鎖表結(jié)構(gòu)數(shù)據(jù)特征價值的專業(yè)核心 ...

【CDA干貨】Excel 導(dǎo)入數(shù)據(jù)含缺失值？詳解 dropna ...

【CDA干貨】深入解析卡方檢驗與 t 檢驗：差異、適用 ...

CDA 數(shù)據(jù)分析師：掌控表格結(jié)構(gòu)數(shù)據(jù)全功能周期的專業(yè) ...

【CDA干貨】MySQL 執(zhí)行計劃中 rows 數(shù)量的準(zhǔn)確性解 ...

【CDA干貨】解析 Python 中 Response 對象的 text ...

CDA 數(shù)據(jù)分析師：激活表格結(jié)構(gòu)數(shù)據(jù)價值的核心操盤手 ...

【CDA干貨】Python HTTP 請求工具對比：urllib.requ ...

【CDA干貨】解決 pd.read\_csv 讀取長浮點數(shù)據(jù)的科 ...

CDA 數(shù)據(jù)分析師：業(yè)務(wù)數(shù)據(jù)分析步驟的落地者與價值優(yōu) ...

【CDA干貨】用 SQL 驗證業(yè)務(wù)邏輯：從規(guī)則拆解到數(shù)據(jù) ...

【CDA干貨】塔吉特百貨孕婦營銷案例：數(shù)據(jù)驅(qū)動下的 ...

CDA教育閉環(huán)

常見問題

關(guān)于我們

CDA數(shù)據(jù)分析師公眾號

CDA考試中心小程序

CDA數(shù)據(jù)分析師App下載

【CDA干貨】Excel 導(dǎo)入數(shù)據(jù)含缺失值？詳解 dropna ...

【CDA干貨】深入解析卡方檢驗與 t 檢驗：差異、適用 ...