
SAS學(xué)習(xí)筆記(8):數(shù)據(jù)集轉(zhuǎn)置描述統(tǒng)計(jì)相關(guān)系數(shù)計(jì)算
本篇SAS讀書筆記主要介紹SAS相關(guān)數(shù)據(jù)處理過程,譬如數(shù)據(jù)集轉(zhuǎn)置、描述統(tǒng)計(jì)以及相關(guān)系數(shù)的計(jì)算。
5數(shù)據(jù)集轉(zhuǎn)置
有時(shí)我們需要改變觀測(cè)與列的關(guān)系,這可以用TRANSPOSE過程來實(shí)現(xiàn)。
先舉一個(gè)合并觀測(cè)的例子。
例1:假設(shè)我們對(duì)若干個(gè)病人先后試驗(yàn)了A藥和B藥,藥效記錄在val變量中,數(shù)據(jù)見表
為了進(jìn)行統(tǒng)計(jì)分析我們需要把兩次的藥效存入兩個(gè)變量,即兩個(gè)觀測(cè)合并為一個(gè)觀測(cè),用如下程序可以實(shí)現(xiàn):
proc sort data=onecol;
by num;run;
proc transpose data=onecol out=twotest;
var val;
id test;
by num;
run;
例2:轉(zhuǎn)置當(dāng)然也可以是同時(shí)對(duì)多行和多列進(jìn)行,比如下面的例子中原始數(shù)據(jù)集為4行3列,轉(zhuǎn)置后變成了3行4列。
data mat;
input x1 x2 x3;
cards;
1 2 3
4 5 6
7 8 9
10 11 12
;
run;
程序如下
proc transpose data=mat out=matt;
var x1 x2 x3;
run;
6 描述統(tǒng)計(jì)
MEANS、UNIVARIATE和FREQ這三個(gè)過程用來計(jì)算簡(jiǎn)單的描述統(tǒng)計(jì)量。MEANS和UNIVARIATE過程對(duì)區(qū)間變量計(jì)算均值、標(biāo)準(zhǔn)差等數(shù)字特征,而FREQ過程對(duì)離散變量計(jì)算取值頻數(shù)分布。
例1:要統(tǒng)計(jì)學(xué)生信息中的數(shù)學(xué)與語文成績相關(guān)的統(tǒng)計(jì)量。
proc means data=student;
var math chinese;
run;
結(jié)果將輸出相關(guān)的:樣本數(shù)目n,均值,標(biāo)準(zhǔn)差,最小值,最大值
UNIVARIATE過程則可以計(jì)算較多的統(tǒng)計(jì)量,輸出包括五個(gè)部分。第一部分是矩統(tǒng)計(jì)量。第二部分為基本的位置和分散程度統(tǒng)計(jì)量,位置統(tǒng)計(jì)量包括均值、中位數(shù)、眾數(shù),分散程度統(tǒng)計(jì)量包括標(biāo)準(zhǔn)差、方差、極差、四分位間距。第三部分為關(guān)于均值等于零的三種檢驗(yàn)的結(jié)果,包括t檢驗(yàn)、符號(hào)檢驗(yàn)和符號(hào)秩檢驗(yàn)。第四部分為各個(gè)重要的分為數(shù)估計(jì)。第五部分是變量的五個(gè)最低值和五個(gè)最高值。
FREQ過程可以考察離散變量的取值分布,在TABLES語句中指定要分析的變量。比如,我們想了解C9501中性別的分布情況,可以用:
注意:也可以在INSIGHT模塊計(jì)算
7 相關(guān)系數(shù)計(jì)算
CORR過程用來計(jì)算變量的相關(guān)系數(shù)
例:計(jì)算變量x1,x2,x3兩兩之間相關(guān)系數(shù)
proc corr data=aa;
var x1 x2 x3;
run;
注意:也可以在INSIGHT分析模塊的多元部分計(jì)算。
數(shù)據(jù)分析咨詢請(qǐng)掃描二維碼
若不方便掃碼,搜微信號(hào):CDAshujufenxi
CDA 精益業(yè)務(wù)數(shù)據(jù)分析:數(shù)據(jù)驅(qū)動(dòng)業(yè)務(wù)增長的實(shí)戰(zhàn)方法論 在企業(yè)數(shù)字化轉(zhuǎn)型的浪潮中,“數(shù)據(jù)分析” 已從 “加分項(xiàng)” 成為 “必修課 ...
2025-07-16MySQL 中 ADD KEY 與 ADD INDEX 詳解:用法、差異與優(yōu)化實(shí)踐 在 MySQL 數(shù)據(jù)庫表結(jié)構(gòu)設(shè)計(jì)中,索引是提升查詢性能的核心手段。無論 ...
2025-07-16解析 MySQL Update 語句中 “query end” 狀態(tài):含義、成因與優(yōu)化指南? 在 MySQL 數(shù)據(jù)庫的日常運(yùn)維與開發(fā)中,開發(fā)者和 DBA 常會(huì) ...
2025-07-16如何考取數(shù)據(jù)分析師證書:以 CDA 為例? ? 在數(shù)字化浪潮席卷各行各業(yè)的當(dāng)下,數(shù)據(jù)分析師已然成為企業(yè)挖掘數(shù)據(jù)價(jià)值、驅(qū)動(dòng)決策的 ...
2025-07-15CDA 精益業(yè)務(wù)數(shù)據(jù)分析:驅(qū)動(dòng)企業(yè)高效決策的核心引擎? 在數(shù)字經(jīng)濟(jì)時(shí)代,企業(yè)面臨著前所未有的數(shù)據(jù)洪流,如何從海量數(shù)據(jù)中提取有 ...
2025-07-15MySQL 無外鍵關(guān)聯(lián)表的 JOIN 實(shí)戰(zhàn):數(shù)據(jù)整合的靈活之道? 在 MySQL 數(shù)據(jù)庫的日常操作中,我們經(jīng)常會(huì)遇到需要整合多張表數(shù)據(jù)的場(chǎng)景 ...
2025-07-15Python Pandas:數(shù)據(jù)科學(xué)的瑞士軍刀? ? 在數(shù)據(jù)驅(qū)動(dòng)的時(shí)代,面對(duì)海量、復(fù)雜的數(shù)據(jù),如何高效地進(jìn)行處理、分析和挖掘成為關(guān)鍵。 ...
2025-07-15用 SQL 生成逆向回滾 SQL:數(shù)據(jù)操作的 “后悔藥” 指南? 在數(shù)據(jù)庫操作中,誤刪數(shù)據(jù)、錯(cuò)改字段或誤執(zhí)行批量更新等問題時(shí)有發(fā)生。 ...
2025-07-14t檢驗(yàn)與Wilcoxon檢驗(yàn)的選擇:何時(shí)用t.test,何時(shí)用wilcox.test? t 檢驗(yàn)與 Wilcoxon 檢驗(yàn)的選擇:何時(shí)用 t.test,何時(shí)用 wilcox. ...
2025-07-14AI 浪潮下的生存與進(jìn)階: CDA數(shù)據(jù)分析師—開啟新時(shí)代職業(yè)生涯的鑰匙(深度研究報(bào)告、發(fā)展指導(dǎo)白皮書) 發(fā)布機(jī)構(gòu):CDA數(shù)據(jù)科 ...
2025-07-13LSTM 模型輸入長度選擇技巧:提升序列建模效能的關(guān)鍵? 在循環(huán)神經(jīng)網(wǎng)絡(luò)(RNN)家族中,長短期記憶網(wǎng)絡(luò)(LSTM)憑借其解決長序列 ...
2025-07-11CDA 數(shù)據(jù)分析師報(bào)考條件詳解與準(zhǔn)備指南? ? 在數(shù)據(jù)驅(qū)動(dòng)決策的時(shí)代浪潮下,CDA 數(shù)據(jù)分析師認(rèn)證愈發(fā)受到矚目,成為眾多有志投身數(shù) ...
2025-07-11數(shù)據(jù)透視表中兩列相乘合計(jì)的實(shí)用指南? 在數(shù)據(jù)分析的日常工作中,數(shù)據(jù)透視表憑借其強(qiáng)大的數(shù)據(jù)匯總和分析功能,成為了 Excel 用戶 ...
2025-07-11尊敬的考生: 您好! 我們誠摯通知您,CDA Level I和 Level II考試大綱將于 2025年7月25日 實(shí)施重大更新。 此次更新旨在確保認(rèn) ...
2025-07-10BI 大數(shù)據(jù)分析師:連接數(shù)據(jù)與業(yè)務(wù)的價(jià)值轉(zhuǎn)化者? ? 在大數(shù)據(jù)與商業(yè)智能(Business Intelligence,簡(jiǎn)稱 BI)深度融合的時(shí)代,BI ...
2025-07-10SQL 在預(yù)測(cè)分析中的應(yīng)用:從數(shù)據(jù)查詢到趨勢(shì)預(yù)判? ? 在數(shù)據(jù)驅(qū)動(dòng)決策的時(shí)代,預(yù)測(cè)分析作為挖掘數(shù)據(jù)潛在價(jià)值的核心手段,正被廣泛 ...
2025-07-10數(shù)據(jù)查詢結(jié)束后:分析師的收尾工作與價(jià)值深化? ? 在數(shù)據(jù)分析的全流程中,“query end”(查詢結(jié)束)并非工作的終點(diǎn),而是將數(shù) ...
2025-07-10CDA 數(shù)據(jù)分析師考試:從報(bào)考到取證的全攻略? 在數(shù)字經(jīng)濟(jì)蓬勃發(fā)展的今天,數(shù)據(jù)分析師已成為各行業(yè)爭(zhēng)搶的核心人才,而 CDA(Certi ...
2025-07-09【CDA干貨】單樣本趨勢(shì)性檢驗(yàn):捕捉數(shù)據(jù)背后的時(shí)間軌跡? 在數(shù)據(jù)分析的版圖中,單樣本趨勢(shì)性檢驗(yàn)如同一位耐心的偵探,專注于從單 ...
2025-07-09year_month數(shù)據(jù)類型:時(shí)間維度的精準(zhǔn)切片? ? 在數(shù)據(jù)的世界里,時(shí)間是最不可或缺的維度之一,而year_month數(shù)據(jù)類型就像一把精準(zhǔn) ...
2025-07-09