99999久久久久久亚洲,欧美人与禽猛交狂配,高清日韩av在线影院,一个人在线高清免费观看,啦啦啦在线视频免费观看www

熱線電話:13121318867

登錄
首頁精彩閱讀數(shù)據(jù)挖掘中需要注意的四點(diǎn)
數(shù)據(jù)挖掘中需要注意的四點(diǎn)
2019-04-12
收藏


我們?cè)谧?a href='/map/shujuwajue/' style='color:#000;font-size:inherit;'>數(shù)據(jù)挖掘工作或?qū)W習(xí)數(shù)據(jù)挖掘課程的時(shí)候需要注意很多的事情,在這篇文章中我們就從數(shù)據(jù)轉(zhuǎn)換成文本、數(shù)據(jù)裝箱、Naive Bayes算法、聚類分析模型這四個(gè)方面講解需要注意的地方。希望這篇文章能夠幫助到大家。


1.數(shù)字轉(zhuǎn)換文本

我們?cè)谶M(jìn)行將數(shù)字轉(zhuǎn)換為文本的時(shí)候,通常執(zhí)行編碼是為了簡化數(shù)據(jù)輸入或者節(jié)省數(shù)據(jù)庫的存儲(chǔ)空間,不過此編碼可能導(dǎo)致值的性質(zhì)和意義不明確。此外,由于離散值以數(shù)字形式存儲(chǔ),當(dāng)我們?cè)趹?yīng)用程序之間移動(dòng)數(shù)據(jù)時(shí),可能會(huì)遇到數(shù)據(jù)類型轉(zhuǎn)換錯(cuò)誤,這些值可能被計(jì)算或被視為連續(xù)值。若要避免此類問題,應(yīng)該在開始數(shù)據(jù)挖掘之前,將數(shù)值標(biāo)簽轉(zhuǎn)換回離散的文本標(biāo)簽。


2.數(shù)字裝箱

在進(jìn)行對(duì)數(shù)字進(jìn)行裝箱的時(shí)候,從原則來說,所有數(shù)值都是無限的并因此是連續(xù)的,但在我們對(duì)信息進(jìn)行建模時(shí),可能會(huì)發(fā)現(xiàn)將可用值離散化或裝箱可能更有效。我們可以通過許多方式將數(shù)據(jù)裝箱,第一種方式就是指定數(shù)目有限的存儲(chǔ)桶并且讓算法對(duì)存儲(chǔ)桶中的值進(jìn)行排序。這是我們通過創(chuàng)建某些分組集合,自己預(yù)先對(duì)值進(jìn)行分組。使用此方法,這樣常常會(huì)喪失值的真正分布,但范圍更易于用戶讀取。讓算法確定存儲(chǔ)桶的最佳數(shù)目以及值的分布。這是大多數(shù)工具中的默認(rèn)行為,但我們可以在數(shù)據(jù)挖掘工具欄向?qū)е兄貙戇@些默認(rèn)行為。而某些在外接程序中使用的算法需要特定的數(shù)據(jù)類型或內(nèi)容類型才能創(chuàng)建模型。這樣就需要我們對(duì)算法的使用多加重視。


3.Naive Bayes模型,

一般來說,Naive Bayes 算法不能使用連續(xù)列作為輸入。這意味著,我們必須對(duì)數(shù)字裝箱,或者如果值足夠少,可以按離散值處理。當(dāng)然此類模型也不能預(yù)測(cè)連續(xù)值。因此,如果要預(yù)測(cè)連續(xù)數(shù)字,應(yīng)先將值裝箱到有意義的范圍中。如果不確定合適的范圍,可以使用聚類分析算法確定數(shù)據(jù)中的數(shù)字聚類?;诖怂惴ㄊ褂孟?qū)r(shí),向?qū)?huì)對(duì)連續(xù)列裝箱。


4.聚類分析模型

在聚類分析模型中,聚類分析工具也不能使用連續(xù)數(shù)字,但這兩個(gè)工具都會(huì)自動(dòng)對(duì)數(shù)字列裝箱。這兩種工具都向您提供選項(xiàng)以便可以選擇結(jié)果中輸出類別的數(shù)目,但是,如果想要控制對(duì)單獨(dú)列中的值進(jìn)行分組的方式,則應(yīng)該通過所需分組來創(chuàng)建新列。


在這篇文章中我們給大家介紹了很多數(shù)據(jù)挖掘中需要注意的地方,具體就是數(shù)據(jù)轉(zhuǎn)換成文本、數(shù)據(jù)裝箱、Naive Bayes算法、聚類分析模型的相關(guān)知識(shí)。當(dāng)然,這些都是在數(shù)據(jù)挖掘工作中需要注意的事情,我們?cè)谧?a href='/map/shujuwajue/' style='color:#000;font-size:inherit;'>數(shù)據(jù)挖掘工作或?qū)W習(xí)過程中一定要重視這些細(xì)節(jié)。

數(shù)據(jù)分析咨詢請(qǐng)掃描二維碼

若不方便掃碼,搜微信號(hào):CDAshujufenxi

數(shù)據(jù)分析師資訊
更多

OK
客服在線
立即咨詢
客服在線
立即咨詢
') } function initGt() { var handler = function (captchaObj) { captchaObj.appendTo('#captcha'); captchaObj.onReady(function () { $("#wait").hide(); }).onSuccess(function(){ $('.getcheckcode').removeClass('dis'); $('.getcheckcode').trigger('click'); }); window.captchaObj = captchaObj; }; $('#captcha').show(); $.ajax({ url: "/login/gtstart?t=" + (new Date()).getTime(), // 加隨機(jī)數(shù)防止緩存 type: "get", dataType: "json", success: function (data) { $('#text').hide(); $('#wait').show(); // 調(diào)用 initGeetest 進(jìn)行初始化 // 參數(shù)1:配置參數(shù) // 參數(shù)2:回調(diào),回調(diào)的第一個(gè)參數(shù)驗(yàn)證碼對(duì)象,之后可以使用它調(diào)用相應(yīng)的接口 initGeetest({ // 以下 4 個(gè)配置參數(shù)為必須,不能缺少 gt: data.gt, challenge: data.challenge, offline: !data.success, // 表示用戶后臺(tái)檢測(cè)極驗(yàn)服務(wù)器是否宕機(jī) new_captcha: data.new_captcha, // 用于宕機(jī)時(shí)表示是新驗(yàn)證碼的宕機(jī) product: "float", // 產(chǎn)品形式,包括:float,popup width: "280px", https: true // 更多配置參數(shù)說明請(qǐng)參見:http://docs.geetest.com/install/client/web-front/ }, handler); } }); } function codeCutdown() { if(_wait == 0){ //倒計(jì)時(shí)完成 $(".getcheckcode").removeClass('dis').html("重新獲取"); }else{ $(".getcheckcode").addClass('dis').html("重新獲取("+_wait+"s)"); _wait--; setTimeout(function () { codeCutdown(); },1000); } } function inputValidate(ele,telInput) { var oInput = ele; var inputVal = oInput.val(); var oType = ele.attr('data-type'); var oEtag = $('#etag').val(); var oErr = oInput.closest('.form_box').next('.err_txt'); var empTxt = '請(qǐng)輸入'+oInput.attr('placeholder')+'!'; var errTxt = '請(qǐng)輸入正確的'+oInput.attr('placeholder')+'!'; var pattern; if(inputVal==""){ if(!telInput){ errFun(oErr,empTxt); } return false; }else { switch (oType){ case 'login_mobile': pattern = /^1[3456789]\d{9}$/; if(inputVal.length==11) { $.ajax({ url: '/login/checkmobile', type: "post", dataType: "json", data: { mobile: inputVal, etag: oEtag, page_ur: window.location.href, page_referer: document.referrer }, success: function (data) { } }); } break; case 'login_yzm': pattern = /^\d{6}$/; break; } if(oType=='login_mobile'){ } if(!!validateFun(pattern,inputVal)){ errFun(oErr,'') if(telInput){ $('.getcheckcode').removeClass('dis'); } }else { if(!telInput) { errFun(oErr, errTxt); }else { $('.getcheckcode').addClass('dis'); } return false; } } return true; } function errFun(obj,msg) { obj.html(msg); if(msg==''){ $('.login_submit').removeClass('dis'); }else { $('.login_submit').addClass('dis'); } } function validateFun(pat,val) { return pat.test(val); }