
我們只有先度過把數(shù)據(jù)當成權力使用的腐敗時代,向著數(shù)據(jù)分享的時代邁進,才能看到激動人心的大數(shù)據(jù)時代的來臨??傊睦锒喽嗌偕賹ξ覀冞@一代人抱著這么一點點希望,大家一起開心地“玩”吧!
牛津大學教授維克托·邁爾·舍恩伯格所著的《大數(shù)據(jù)時代:生活、工作、思維的大變革》一書,被認為是大數(shù)據(jù)時代到來的先河之作。大數(shù)據(jù)涉及最多的為計算機、生物學、生態(tài)學、經(jīng)濟學、地理學、天文物理和公共衛(wèi)生等領域,應用較多的方向為網(wǎng)絡分析、交通系統(tǒng)、犯罪區(qū)域、人權、動植物保護以及傳染性疾病和感冒預測等。
全球一部分領先者已經(jīng)開始思考大數(shù)據(jù)分析技能和計算水平的提升。大數(shù)據(jù)時代的來臨源于不同領域、不同部門的合作和數(shù)據(jù)分享,可以說是數(shù)據(jù)分享的更高層次。但是不得不承認的一個現(xiàn)象是,國內許多領域卻在糾結于數(shù)據(jù)分享,以及數(shù)據(jù)腐敗斗爭的事實。
什么是數(shù)據(jù)?在我看來就是所有可以進一步分析和推理用的知識點。逐年累月的記錄、基礎數(shù)據(jù)、加工過的數(shù)據(jù)都可以作為數(shù)據(jù)分析中的數(shù)據(jù)。所謂數(shù)據(jù)分享,打個比方,就像幼兒園小朋友交換玩具,如果你不自愿交換就沒人和你玩,那你就得自己玩,雖然你可能會說自己玩也挺好,但就是要注定孤獨終老?!耙黄鹜妗边@個動作延伸到科研領域其實就是一種合作—大家一起“玩”一堆數(shù)據(jù),一起“玩”出一些有趣的結果。但是交換玩具這個在幼兒園里簡單的游戲被放到成人的世界就變得異常復雜。數(shù)據(jù)在成人手中變成了一種稀缺資源和一種權力之后,基本上游戲規(guī)則就變成了“我要看得起你我才和你分享,或者你給我什么好處我才給你分享”,而在國內大體上就是這樣的情況。
那么,在科研中我們?yōu)槭裁匆窒頂?shù)據(jù)?—當然就是為了更好地合作,為了做出更好的工作?!胺窒怼边@個動作基本上是出于互相信任,并且對結果有所期待的情況下發(fā)生的。我們都常常期待著與比你厲害的人,或者懂你的人,分享并得出更好的、更有用的結果。
那么,為什么我們又不能互相分享數(shù)據(jù)呢?我認為這其中涉及三個層面的問題。
出于國家安全的考慮
數(shù)據(jù)分享或者說“泄密”過程中可能損害某些群體的利益。具體不再詳述,因為每個國家、每個地區(qū)對國家安全的定義不一樣。比如,貧困人口比率和饑餓在非洲各國是敏感數(shù)據(jù),在其他國家多少可能都是,只是機密級別不一樣。“安全”這個詞本來也很難界定邊界,而且和國際環(huán)境、國家利益、財團利益結合在一起時,就太模糊。
前幾天看美國喬恩·斯圖爾特的每日秀,最近邀請的是當時斯諾登逃離美國時,在我國香港約見的第一位記者。喬恩問那位記者,你認為斯諾登這樣泄密幼稚嗎?記者回答:“他有一點理想主義,認為盡管自己泄露了機密還是愿意相信國家公正的司法系統(tǒng)?!绷硪粋€例子是維基解密,它使得很多國家和政府的機密數(shù)據(jù)被曝光。不管出發(fā)點怎樣,最后的泄密者基本上要么背井離鄉(xiāng)逃亡,要么淪為階下之徒。所有涉密或者事關國家安全的數(shù)據(jù)都是“分享者”的禁區(qū)。
技術安全與分享
記得我當時和一位老師討要衛(wèi)星影像(他后來給了我數(shù)據(jù)),他和我提到“國家安全”和“技術安全”這兩個詞。這里說的技術安全其實是—要是我給了你數(shù)據(jù),你做出比我更出色的工作怎么辦?作為科研人,每個人多少都會問自己這樣的問題。我們到底要不要和其他人分享自己的數(shù)據(jù)?到底是怕別人超過自己,還是因為獲取數(shù)據(jù)的成本太大你輸不起?還是你認真分析所有的利弊之后作出的決定?
如果僅僅出于“害怕別人做出比自己更出色的工作”的心態(tài),科研的前途就令人擔憂。這里面涉及一個長遠性的問題。長遠性也有三個層次:眼前利益、中長期利益和長期利益。普通人關心的柴米油鹽是今天、明天的事情,政策決策者作決定至少要看未來十幾、二十年后的結果。但科研人員應該看到更長遠的未來。不過,作為每天都要“吃穿用度”的科研人員,我們很容易犯短視的毛病。
在我碰到的各國功成名就的科學家里,在我看來都是秉承著“你需要這個數(shù)據(jù)你就拿去分析,我們一起看看會有什么有趣的結果”這樣一種心態(tài)。首先是“我們”,然后“一起”,“我們一起”的情況是給你數(shù)據(jù)的人尊敬你的知識、能力,才會和你討教、切磋。當你被人欣賞、尊重和信任時,這種轉化成的正能量其實是十分強大的。
數(shù)據(jù)演化成權力
這兩者的關系看似有些千絲萬縷,理不清頭緒。但數(shù)據(jù)其實是可以轉化成一種稀缺資源進而演化成為一種權力的—和國內一些地方政府合作你就會深深體會到這一點,這不僅僅有我個人的部分經(jīng)歷,也聽到周圍一些人的抱怨。有些所謂“不能分享的數(shù)據(jù)”,其實真正看了之后,就像對某某聲嘶力竭地嘶吼:“十幾二十年你們就干了這點事?!”“什么?你們竟然連這個數(shù)據(jù)都不知道?”“沒改過的原始數(shù)據(jù)在哪里?”……有些情況理解,我國建立也只有短短幾十年,很多數(shù)據(jù)沒有,也還未測過,但是也不用編吧?很多社會經(jīng)濟收據(jù)采集其實—
1.數(shù)據(jù)采集部門的工作可以做得更好;
2.拿的是納稅人的錢工作就應該有實實在在可以測量業(yè)績的數(shù)據(jù);
3.分享數(shù)據(jù)雖然要承擔風險但是對未來的政府工作開展更有用。
所以總體來說,我們只有先度過把數(shù)據(jù)當成權力使用的腐敗時代,向著數(shù)據(jù)分享的時代邁進,才能看到激動人心的大數(shù)據(jù)時代的來臨??傊?,心里多多少少對我們這一代人抱著這么一點點希望,大家一起開心地“玩”吧!CDA數(shù)據(jù)分析師培訓官網(wǎng)
數(shù)據(jù)分析咨詢請掃描二維碼
若不方便掃碼,搜微信號:CDAshujufenxi
SQL Server 中 CONVERT 函數(shù)的日期轉換:從基礎用法到實戰(zhàn)優(yōu)化 在 SQL Server 的數(shù)據(jù)處理中,日期格式轉換是高頻需求 —— 無論 ...
2025-09-18MySQL 大表拆分與關聯(lián)查詢效率:打破 “拆分必慢” 的認知誤區(qū) 在 MySQL 數(shù)據(jù)庫管理中,“大表” 始終是性能優(yōu)化繞不開的話題。 ...
2025-09-18CDA 數(shù)據(jù)分析師:表結構數(shù)據(jù) “獲取 - 加工 - 使用” 全流程的賦能者 表結構數(shù)據(jù)(如數(shù)據(jù)庫表、Excel 表、CSV 文件)是企業(yè)數(shù)字 ...
2025-09-18DSGE 模型中的 Et:理性預期算子的內涵、作用與應用解析 動態(tài)隨機一般均衡(Dynamic Stochastic General Equilibrium, DSGE)模 ...
2025-09-17Python 提取 TIF 中地名的完整指南 一、先明確:TIF 中的地名有哪兩種存在形式? 在開始提取前,需先判斷 TIF 文件的類型 —— ...
2025-09-17CDA 數(shù)據(jù)分析師:解鎖表結構數(shù)據(jù)特征價值的專業(yè)核心 表結構數(shù)據(jù)(以 “行 - 列” 規(guī)范存儲的結構化數(shù)據(jù),如數(shù)據(jù)庫表、Excel 表、 ...
2025-09-17Excel 導入數(shù)據(jù)含缺失值?詳解 dropna 函數(shù)的功能與實戰(zhàn)應用 在用 Python(如 pandas 庫)處理 Excel 數(shù)據(jù)時,“缺失值” 是高頻 ...
2025-09-16深入解析卡方檢驗與 t 檢驗:差異、適用場景與實踐應用 在數(shù)據(jù)分析與統(tǒng)計學領域,假設檢驗是驗證研究假設、判斷數(shù)據(jù)差異是否 “ ...
2025-09-16CDA 數(shù)據(jù)分析師:掌控表格結構數(shù)據(jù)全功能周期的專業(yè)操盤手 表格結構數(shù)據(jù)(以 “行 - 列” 存儲的結構化數(shù)據(jù),如 Excel 表、數(shù)據(jù) ...
2025-09-16MySQL 執(zhí)行計劃中 rows 數(shù)量的準確性解析:原理、影響因素與優(yōu)化 在 MySQL SQL 調優(yōu)中,EXPLAIN執(zhí)行計劃是核心工具,而其中的row ...
2025-09-15解析 Python 中 Response 對象的 text 與 content:區(qū)別、場景與實踐指南 在 Python 進行 HTTP 網(wǎng)絡請求開發(fā)時(如使用requests ...
2025-09-15CDA 數(shù)據(jù)分析師:激活表格結構數(shù)據(jù)價值的核心操盤手 表格結構數(shù)據(jù)(如 Excel 表格、數(shù)據(jù)庫表)是企業(yè)最基礎、最核心的數(shù)據(jù)形態(tài) ...
2025-09-15Python HTTP 請求工具對比:urllib.request 與 requests 的核心差異與選擇指南 在 Python 處理 HTTP 請求(如接口調用、數(shù)據(jù)爬取 ...
2025-09-12解決 pd.read_csv 讀取長浮點數(shù)據(jù)的科學計數(shù)法問題 為幫助 Python 數(shù)據(jù)從業(yè)者解決pd.read_csv讀取長浮點數(shù)據(jù)時的科學計數(shù)法問題 ...
2025-09-12CDA 數(shù)據(jù)分析師:業(yè)務數(shù)據(jù)分析步驟的落地者與價值優(yōu)化者 業(yè)務數(shù)據(jù)分析是企業(yè)解決日常運營問題、提升執(zhí)行效率的核心手段,其價值 ...
2025-09-12用 SQL 驗證業(yè)務邏輯:從規(guī)則拆解到數(shù)據(jù)把關的實戰(zhàn)指南 在業(yè)務系統(tǒng)落地過程中,“業(yè)務邏輯” 是連接 “需求設計” 與 “用戶體驗 ...
2025-09-11塔吉特百貨孕婦營銷案例:數(shù)據(jù)驅動下的精準零售革命與啟示 在零售行業(yè) “流量紅利見頂” 的當下,精準營銷成為企業(yè)突圍的核心方 ...
2025-09-11CDA 數(shù)據(jù)分析師與戰(zhàn)略 / 業(yè)務數(shù)據(jù)分析:概念辨析與協(xié)同價值 在數(shù)據(jù)驅動決策的體系中,“戰(zhàn)略數(shù)據(jù)分析”“業(yè)務數(shù)據(jù)分析” 是企業(yè) ...
2025-09-11Excel 數(shù)據(jù)聚類分析:從操作實踐到業(yè)務價值挖掘 在數(shù)據(jù)分析場景中,聚類分析作為 “無監(jiān)督分組” 的核心工具,能從雜亂數(shù)據(jù)中挖 ...
2025-09-10統(tǒng)計模型的核心目的:從數(shù)據(jù)解讀到?jīng)Q策支撐的價值導向 統(tǒng)計模型作為數(shù)據(jù)分析的核心工具,并非簡單的 “公式堆砌”,而是圍繞特定 ...
2025-09-10