
高效的數(shù)據(jù)分析不是馬上就能學(xué)會(huì)的,但是可以通過(guò)快速學(xué)習(xí)掌握。這里有7個(gè)數(shù)據(jù)分析的習(xí)慣,我希望有人可以針對(duì)一個(gè)工程團(tuán)隊(duì),告訴我關(guān)于數(shù)據(jù)分析的高效合作,溝通以及投資。
1.相比花哨算法,更重視分析的簡(jiǎn)單性
如果你都不能向一個(gè)5歲的小孩解釋清楚,那么你將很難將你的產(chǎn)品賣給其他人。產(chǎn)品數(shù)據(jù)分析的重點(diǎn)不是分析,別誤會(huì),你還是需要分析,但是它的故事和基于數(shù)據(jù)的推薦真的很重要。
復(fù)雜的分析造成的混亂將導(dǎo)致你獲得完全相反的結(jié)果。你希望能夠驅(qū)動(dòng)工程和投資分析行為。如果你的分析是不清晰的,工程師就不能快速通過(guò)你的分析獲得知識(shí),那么你的分析就會(huì)失去價(jià)值。
關(guān)于數(shù)據(jù)分析的影響力的最終測(cè)試是根據(jù)工程和投資行為的改變程度。應(yīng)該令數(shù)據(jù)分析變得容易,方便人們使用,得以實(shí)現(xiàn)改變。
2.相比數(shù)據(jù),更加重視數(shù)據(jù)源
在更廣泛的時(shí)間段里看更多的數(shù)據(jù)可以給你在分析上有更多的信心。然而,遙測(cè)或日志作為單一的傳遞途徑會(huì)被捕捉到的特性所限制。一般來(lái)說(shuō),一個(gè)單一的途徑只講述產(chǎn)品的一部分。
相同分析+相同原理=相同故事
你需要的是其他數(shù)據(jù)源??梢允撬斜坏怯浽谀程幍?a href='/map/sql/' style='color:#000;font-size:inherit;'>SQL操作記錄,或者是你有工具可以從你的用戶那里獲得日志樣本。更多的數(shù)據(jù)源也會(huì)讓你確定你的故事是否一致。更多的數(shù)據(jù)不能給你更多得洞察力。但是更多的數(shù)據(jù)源可以。
3.相比最新亮眼的工具,更加重視熟悉的工具
亮眼的最新工具使用起來(lái)很有趣,有時(shí)候也很管用。但是,你還記的你的數(shù)據(jù)分析的影響力的最終測(cè)試嗎?
你希望工具變的容易,能夠被人們所使用并得到自己想要的改變,但是改變不是這么容易的。從文章《你的大腦在工作》即《Your Brain at Work》學(xué)到3點(diǎn),希望大家能牢牢記住,它們能給與你們最大程度的幫助來(lái)促進(jìn)改變。
對(duì)于你的工程師伙伴而言,令工具安全很重要,它們可以被使用和促進(jìn)改變。通過(guò)使用你熟悉的工具,講述那些快速吸引大家注意力的故事。遠(yuǎn)離最近,最酷的可視化技術(shù)除非它們?cè)谀愕墓适轮斜夭豢缮佟?/span>
深入分析核心信息
重復(fù)核心信息,不斷的重復(fù)
除非你正在推薦一個(gè)新工具的使用,重點(diǎn)不是在工具,而是你故事的核心信息。
4.相比指標(biāo),更加重視洞察力和投資
指標(biāo)是指你的關(guān)鍵性能指標(biāo)(KPI)。它們可能以圖表,坐標(biāo)或表的形式表現(xiàn)。你的分析不能就此止步。指標(biāo)只是數(shù)據(jù)驅(qū)動(dòng)工程‘3I’里面的第一個(gè)‘I’,告訴別人一個(gè)圍繞數(shù)據(jù)的充滿洞察力的故事,然后建議他們投資。你是改變的代理人,你的分析必須充滿你的見(jiàn)解和對(duì)投資的建議。
5.相比信任,更加重視CUSS
數(shù)據(jù)永遠(yuǎn)都是不干凈的。這就是為什么我常常覺(jué)得自己像一個(gè)門衛(wèi)。作為數(shù)據(jù)門衛(wèi),我很少相信里面的數(shù)據(jù)以及它們的格式是正確的。我總是從使用‘R語(yǔ)言的可能性和統(tǒng)計(jì)的介紹’中應(yīng)用Kern’s CUSS,為了能夠理解數(shù)據(jù)中心,數(shù)據(jù)的異常特征,數(shù)據(jù)的傳播和數(shù)據(jù)的形狀。
中心:數(shù)據(jù)的總體趨勢(shì)所在
異常特征:有缺失的數(shù)據(jù)點(diǎn)?離群值?集群?
傳播:數(shù)據(jù)產(chǎn)生哪些變化?
形狀:如果你來(lái)繪制數(shù)據(jù),數(shù)據(jù)的形狀是什么?
了解數(shù)據(jù)如何生成和數(shù)據(jù)的CUSS可以讓你作出更好且合理的見(jiàn)解和投資。
6.相比確定性,更重視方向
數(shù)據(jù)收集的成本經(jīng)常是解決業(yè)務(wù)和工程問(wèn)題的最終答案的一大障礙。你幾乎總是能得到不完整的答案,雖然比你手中已有的答案好。
《如何測(cè)試任何事》(How To Measure Anything)的作者推薦我們可以問(wèn)這個(gè)問(wèn)題:“是否存在一個(gè)測(cè)試的方法可以減少不確定性,足夠來(lái)確定測(cè)試的成本?”
即使你沒(méi)有相應(yīng)的工具來(lái)明確的回答特定的組件是否有這個(gè)問(wèn)題。你也可以消除一些組件,通過(guò)廉價(jià)的方式來(lái)減少不確定性。也許你可以凝聚幾個(gè)不同來(lái)源的數(shù)據(jù),得到一些非常粗略的結(jié)果,讓事情朝著正確的方向前進(jìn)。
7.相比你在“思考”軟件是如何工作的,軟件的實(shí)際工作更重要
產(chǎn)品數(shù)據(jù)分析的優(yōu)點(diǎn)是看到實(shí)際用戶使用你的軟件產(chǎn)品的足跡。有時(shí)你會(huì)得到一個(gè)很好的的足跡。但也有可能,你得到的部分足跡讓你的調(diào)查更加困難。無(wú)論如何,遙測(cè)和日志的足跡都是現(xiàn)實(shí)的反映。
架構(gòu)知識(shí)是偉大的資產(chǎn)。但是,遙測(cè)和日志通過(guò)確鑿的證據(jù)告訴我們實(shí)際發(fā)生了什么,結(jié)果并不是我們希望看到的。作為一名數(shù)據(jù)科學(xué)家,如果你對(duì)數(shù)據(jù)有著獨(dú)特的看法。那么你看到的軟件,就是軟件的真實(shí)情況。
這是很強(qiáng)大的,因?yàn)槟悴粌H有足夠的證據(jù)顯示軟件是如何工作的,也可以對(duì)廣泛的用戶有針對(duì)性的洞察。你可以聲稱:“77%的用戶沿著的這條編程路徑是和軟件設(shè)計(jì)矛盾的。”相信你的用戶留下的足跡,但是要重復(fù)檢查。在‘統(tǒng)計(jì)學(xué)習(xí)的元素’這篇文章中,有一句引言我很喜歡:“正如我相信上帝一樣,我也相信他人帶來(lái)的數(shù)據(jù)?!?/span>
數(shù)據(jù)分析咨詢請(qǐng)掃描二維碼
若不方便掃碼,搜微信號(hào):CDAshujufenxi
SQL Server 中 CONVERT 函數(shù)的日期轉(zhuǎn)換:從基礎(chǔ)用法到實(shí)戰(zhàn)優(yōu)化 在 SQL Server 的數(shù)據(jù)處理中,日期格式轉(zhuǎn)換是高頻需求 —— 無(wú)論 ...
2025-09-18MySQL 大表拆分與關(guān)聯(lián)查詢效率:打破 “拆分必慢” 的認(rèn)知誤區(qū) 在 MySQL 數(shù)據(jù)庫(kù)管理中,“大表” 始終是性能優(yōu)化繞不開的話題。 ...
2025-09-18CDA 數(shù)據(jù)分析師:表結(jié)構(gòu)數(shù)據(jù) “獲取 - 加工 - 使用” 全流程的賦能者 表結(jié)構(gòu)數(shù)據(jù)(如數(shù)據(jù)庫(kù)表、Excel 表、CSV 文件)是企業(yè)數(shù)字 ...
2025-09-18DSGE 模型中的 Et:理性預(yù)期算子的內(nèi)涵、作用與應(yīng)用解析 動(dòng)態(tài)隨機(jī)一般均衡(Dynamic Stochastic General Equilibrium, DSGE)模 ...
2025-09-17Python 提取 TIF 中地名的完整指南 一、先明確:TIF 中的地名有哪兩種存在形式? 在開始提取前,需先判斷 TIF 文件的類型 —— ...
2025-09-17CDA 數(shù)據(jù)分析師:解鎖表結(jié)構(gòu)數(shù)據(jù)特征價(jià)值的專業(yè)核心 表結(jié)構(gòu)數(shù)據(jù)(以 “行 - 列” 規(guī)范存儲(chǔ)的結(jié)構(gòu)化數(shù)據(jù),如數(shù)據(jù)庫(kù)表、Excel 表、 ...
2025-09-17Excel 導(dǎo)入數(shù)據(jù)含缺失值?詳解 dropna 函數(shù)的功能與實(shí)戰(zhàn)應(yīng)用 在用 Python(如 pandas 庫(kù))處理 Excel 數(shù)據(jù)時(shí),“缺失值” 是高頻 ...
2025-09-16深入解析卡方檢驗(yàn)與 t 檢驗(yàn):差異、適用場(chǎng)景與實(shí)踐應(yīng)用 在數(shù)據(jù)分析與統(tǒng)計(jì)學(xué)領(lǐng)域,假設(shè)檢驗(yàn)是驗(yàn)證研究假設(shè)、判斷數(shù)據(jù)差異是否 “ ...
2025-09-16CDA 數(shù)據(jù)分析師:掌控表格結(jié)構(gòu)數(shù)據(jù)全功能周期的專業(yè)操盤手 表格結(jié)構(gòu)數(shù)據(jù)(以 “行 - 列” 存儲(chǔ)的結(jié)構(gòu)化數(shù)據(jù),如 Excel 表、數(shù)據(jù) ...
2025-09-16MySQL 執(zhí)行計(jì)劃中 rows 數(shù)量的準(zhǔn)確性解析:原理、影響因素與優(yōu)化 在 MySQL SQL 調(diào)優(yōu)中,EXPLAIN執(zhí)行計(jì)劃是核心工具,而其中的row ...
2025-09-15解析 Python 中 Response 對(duì)象的 text 與 content:區(qū)別、場(chǎng)景與實(shí)踐指南 在 Python 進(jìn)行 HTTP 網(wǎng)絡(luò)請(qǐng)求開發(fā)時(shí)(如使用requests ...
2025-09-15CDA 數(shù)據(jù)分析師:激活表格結(jié)構(gòu)數(shù)據(jù)價(jià)值的核心操盤手 表格結(jié)構(gòu)數(shù)據(jù)(如 Excel 表格、數(shù)據(jù)庫(kù)表)是企業(yè)最基礎(chǔ)、最核心的數(shù)據(jù)形態(tài) ...
2025-09-15Python HTTP 請(qǐng)求工具對(duì)比:urllib.request 與 requests 的核心差異與選擇指南 在 Python 處理 HTTP 請(qǐng)求(如接口調(diào)用、數(shù)據(jù)爬取 ...
2025-09-12解決 pd.read_csv 讀取長(zhǎng)浮點(diǎn)數(shù)據(jù)的科學(xué)計(jì)數(shù)法問(wèn)題 為幫助 Python 數(shù)據(jù)從業(yè)者解決pd.read_csv讀取長(zhǎng)浮點(diǎn)數(shù)據(jù)時(shí)的科學(xué)計(jì)數(shù)法問(wèn)題 ...
2025-09-12CDA 數(shù)據(jù)分析師:業(yè)務(wù)數(shù)據(jù)分析步驟的落地者與價(jià)值優(yōu)化者 業(yè)務(wù)數(shù)據(jù)分析是企業(yè)解決日常運(yùn)營(yíng)問(wèn)題、提升執(zhí)行效率的核心手段,其價(jià)值 ...
2025-09-12用 SQL 驗(yàn)證業(yè)務(wù)邏輯:從規(guī)則拆解到數(shù)據(jù)把關(guān)的實(shí)戰(zhàn)指南 在業(yè)務(wù)系統(tǒng)落地過(guò)程中,“業(yè)務(wù)邏輯” 是連接 “需求設(shè)計(jì)” 與 “用戶體驗(yàn) ...
2025-09-11塔吉特百貨孕婦營(yíng)銷案例:數(shù)據(jù)驅(qū)動(dòng)下的精準(zhǔn)零售革命與啟示 在零售行業(yè) “流量紅利見(jiàn)頂” 的當(dāng)下,精準(zhǔn)營(yíng)銷成為企業(yè)突圍的核心方 ...
2025-09-11CDA 數(shù)據(jù)分析師與戰(zhàn)略 / 業(yè)務(wù)數(shù)據(jù)分析:概念辨析與協(xié)同價(jià)值 在數(shù)據(jù)驅(qū)動(dòng)決策的體系中,“戰(zhàn)略數(shù)據(jù)分析”“業(yè)務(wù)數(shù)據(jù)分析” 是企業(yè) ...
2025-09-11Excel 數(shù)據(jù)聚類分析:從操作實(shí)踐到業(yè)務(wù)價(jià)值挖掘 在數(shù)據(jù)分析場(chǎng)景中,聚類分析作為 “無(wú)監(jiān)督分組” 的核心工具,能從雜亂數(shù)據(jù)中挖 ...
2025-09-10統(tǒng)計(jì)模型的核心目的:從數(shù)據(jù)解讀到?jīng)Q策支撐的價(jià)值導(dǎo)向 統(tǒng)計(jì)模型作為數(shù)據(jù)分析的核心工具,并非簡(jiǎn)單的 “公式堆砌”,而是圍繞特定 ...
2025-09-10