高效能數(shù)據(jù)分析的七個(gè)習(xí)慣
高效的數(shù)據(jù)分析不是馬上就能學(xué)會(huì)的,但是可以通過快速學(xué)習(xí)掌握。這里有7個(gè)數(shù)據(jù)分析的習(xí)慣,我希望有人可以針對一個(gè)工程團(tuán)隊(duì),告訴我關(guān)于數(shù)據(jù)分析的高效合作,溝通以及投資。
1.相比花哨算法,更重視分析的簡單性
如果你都不能向一個(gè)5歲的小孩解釋清楚,那么你將很難將你的產(chǎn)品賣給其他人。產(chǎn)品數(shù)據(jù)分析的重點(diǎn)不是分析,別誤會(huì),你還是需要分析,但是它的故事和基于數(shù)據(jù)的推薦真的很重要。
復(fù)雜的分析造成的混亂將導(dǎo)致你獲得完全相反的結(jié)果。你希望能夠驅(qū)動(dòng)工程和投資分析行為。如果你的分析是不清晰的,工程師就不能快速通過你的分析獲得知識,那么你的分析就會(huì)失去價(jià)值。
關(guān)于數(shù)據(jù)分析的影響力的最終測試是根據(jù)工程和投資行為的改變程度。應(yīng)該令數(shù)據(jù)分析變得容易,方便人們使用,得以實(shí)現(xiàn)改變。
2.相比數(shù)據(jù),更加重視數(shù)據(jù)源
在更廣泛的時(shí)間段里看更多的數(shù)據(jù)可以給你在分析上有更多的信心。然而,遙測或日志作為單一的傳遞途徑會(huì)被捕捉到的特性所限制。一般來說,一個(gè)單一的途徑只講述產(chǎn)品的一部分。
相同分析+相同原理=相同故事
你需要的是其他數(shù)據(jù)源??梢允撬斜坏怯浽谀程幍腟QL操作記錄,或者是你有工具可以從你的用戶那里獲得日志樣本。更多的數(shù)據(jù)源也會(huì)讓你確定你的故事是否一致。更多的數(shù)據(jù)不能給你更多得洞察力。但是更多的數(shù)據(jù)源可以。
3.相比最新亮眼的工具,更加重視熟悉的工具
亮眼的最新工具使用起來很有趣,有時(shí)候也很管用。但是,你還記的你的數(shù)據(jù)分析的影響力的最終測試嗎?
你希望工具變的容易,能夠被人們所使用并得到自己想要的改變,但是改變不是這么容易的。從文章《你的大腦在工作》即《Your?Brain?at?Work》學(xué)到3點(diǎn),希望大家能牢牢記住,它們能給與你們最大程度的幫助來促進(jìn)改變。
- 對于你的工程師伙伴而言,令工具安全很重要,它們可以被使用和促進(jìn)改變。通過使用你熟悉的工具,講述那些快速吸引大家注意力的故事。遠(yuǎn)離最近,最酷的可視化技術(shù)除非它們在你的故事中必不可少。
- 深入分析核心信息
- 重復(fù)核心信息,不斷的重復(fù)
除非你正在推薦一個(gè)新工具的使用,重點(diǎn)不是在工具,而是你故事的核心信息。
4.相比指標(biāo),更加重視洞察力和投資
指標(biāo)是指你的關(guān)鍵性能指標(biāo)(KPI)。它們可能以圖表,坐標(biāo)或表的形式表現(xiàn)。你的分析不能就此止步。指標(biāo)只是數(shù)據(jù)驅(qū)動(dòng)工程‘3I’里面的第一個(gè)‘I’,告訴別人一個(gè)圍繞數(shù)據(jù)的充滿洞察力的故事,然后建議他們投資。你是改變的代理人,你的分析必須充滿你的見解和對投資的建議。
5.相比信任,更加重視CUSS
數(shù)據(jù)永遠(yuǎn)都是不干凈的。這就是為什么我常常覺得自己像一個(gè)門衛(wèi)。作為數(shù)據(jù)門衛(wèi),我很少相信里面的數(shù)據(jù)以及它們的格式是正確的。我總是從使用‘R語言的可能性和統(tǒng)計(jì)的介紹’中應(yīng)用Kern’s?CUSS,為了能夠理解數(shù)據(jù)中心,數(shù)據(jù)的異常特征,數(shù)據(jù)的傳播和數(shù)據(jù)的形狀。
- 中心:數(shù)據(jù)的總體趨勢所在
- 異常特征:有缺失的數(shù)據(jù)點(diǎn)?離群值?集群?
- 傳播:數(shù)據(jù)產(chǎn)生哪些變化?
- 形狀:如果你來繪制數(shù)據(jù),數(shù)據(jù)的形狀是什么?
了解數(shù)據(jù)如何生成和數(shù)據(jù)的CUSS可以讓你作出更好且合理的見解和投資。
6.相比確定性,更重視方向
數(shù)據(jù)收集的成本經(jīng)常是解決業(yè)務(wù)和工程問題的最終答案的一大障礙。你幾乎總是能得到不完整的答案,雖然比你手中已有的答案好。
《如何測試任何事》(How?To?Measure?Anything)的作者推薦我們可以問這個(gè)問題:
“是否存在一個(gè)測試的方法可以減少不確定性,足夠來確定測試的成本?”
即使你沒有相應(yīng)的工具來明確的回答特定的組件是否有這個(gè)問題。你也可以消除一些組件,通過廉價(jià)的方式來減少不確定性。也許你可以凝聚幾個(gè)不同來源的數(shù)據(jù),得到一些非常粗略的結(jié)果,讓事情朝著正確的方向前進(jìn)。
讓你或你的團(tuán)隊(duì)朝著正確的方向前進(jìn)比得到超級準(zhǔn)確的,確切的答案更重要。
7.相比你在“思考”軟件是如何工作的,軟件的實(shí)際工作更重要
產(chǎn)品數(shù)據(jù)分析的優(yōu)點(diǎn)是看到實(shí)際用戶使用你的軟件產(chǎn)品的足跡。有時(shí)你會(huì)得到一個(gè)很好的的足跡。但也有可能,你得到的部分足跡讓你的調(diào)查更加困難。無論如何,遙測和日志的足跡都是現(xiàn)實(shí)的反映。
架構(gòu)知識是偉大的資產(chǎn)。但是,遙測和日志通過確鑿的證據(jù)告訴我們實(shí)際發(fā)生了什么,結(jié)果并不是我們希望看到的。作為一名數(shù)據(jù)科學(xué)家,如果你對數(shù)據(jù)有著獨(dú)特的看法。那么你看到的軟件,就是軟件的真實(shí)情況。
這是很強(qiáng)大的,因?yàn)槟悴粌H有足夠的證據(jù)顯示軟件是如何工作的,也可以對廣泛的用戶有針對性的洞察。你可以聲稱:“77%的用戶沿著的這條編程路徑是和軟件設(shè)計(jì)矛盾的?!毕嘈拍愕挠脩袅粝碌淖阚E,但是要重復(fù)檢查。在‘統(tǒng)計(jì)學(xué)習(xí)的元素’這篇文章中,有一句引言我很喜歡:“正如我相信上帝一樣,我也相信他人帶來的數(shù)據(jù)。”
補(bǔ)充:體系知識是你的SMARTCUT(一款可以讓用戶無縫刪除照片目標(biāo)的應(yīng)用)
我今天的內(nèi)容雖然會(huì)有矛盾之處,但是理解產(chǎn)品在不同的組件下一起工作,對于產(chǎn)品數(shù)據(jù)分析是非常有用的。
完全依靠你的遙測和日志來告訴你軟件是如何工作的,這是可能的。雖然它可靠,但是緩慢。應(yīng)該采用SMARTCUT和學(xué)習(xí)編碼是如何執(zhí)行的。通過調(diào)試器進(jìn)行該步驟,在你的腦海中形成一個(gè)模型:組件是如何流動(dòng)和組合在一起的。
腦海緊記SFDIPOT:即結(jié)構(gòu)、功能、數(shù)據(jù)接口,平臺(tái),操作和時(shí)間。
Smartcuts的作者聲稱,你可以通過構(gòu)建平臺(tái)快速學(xué)習(xí)和訓(xùn)練自己。平臺(tái)都是類似工具和他人建立的框架。使用調(diào)試器工具或架構(gòu)文檔可以快速布置你的平臺(tái)。那么你的遙測和日志分析將得到全新的意義,因?yàn)槟憧桃獾挠?xùn)練自己去掌握代碼執(zhí)行模式。
作者@Optimus Prime
來源@36大數(shù)據(jù)
文章鏈接:http://www.36dsj.com/archives/43811
??