隨著互聯(lián)網(wǎng)的發(fā)展,大家對大數(shù)據(jù)的概念也并不陌生,但也不排除有一部分人認為在大數(shù)據(jù)時代,“樣本=全體”,人們得到的不是抽樣數(shù)據(jù)而是全數(shù)據(jù),因而只需要簡單地數(shù)一數(shù)就可以下結(jié)論。如此簡單粗暴的下結(jié)論,是不正確的,為什么這么說?今天千鋒小編就帶你了解一下為什么說大數(shù)據(jù)不能被直接拿來使用?
首先,大數(shù)據(jù)告知信息但不解釋信息。打個比方說,大數(shù)據(jù)是“原油”而不是“汽油”,不能被直接拿來使用。就像股票市場,即使把所有的數(shù)據(jù)都公布出來,不懂的人依然不知道數(shù)據(jù)代表的信息。其實在大數(shù)據(jù)時代,統(tǒng)計學(xué)依然是數(shù)據(jù)分析的靈魂。
其次,全數(shù)據(jù)的概念本身很難經(jīng)得起推敲。全數(shù)據(jù),顧名思義就是全部數(shù)據(jù)。這在某些特定的場合對于某些特定的問題確實可能實現(xiàn)。比如,要比較清華、北大兩校同學(xué)數(shù)學(xué)能力整體上哪個更強,可以收集到兩校同學(xué)高考時的數(shù)學(xué)成績作為研究的數(shù)據(jù)對象。從某種意義上說,這是全數(shù)據(jù)。但是并不是說我們有了這個全數(shù)據(jù)就能得到完全準確的答案。
因為一方面,這個數(shù)據(jù)雖然是全數(shù)據(jù),但仍然具有不確定性。另一方面,事物在不斷地發(fā)展和變化,同學(xué)入校時的成績并不能夠代表現(xiàn)在的能力。全體同學(xué)的高考成績數(shù)據(jù),僅對于那次考試而言是全數(shù)據(jù)。“全”是有邊界的,超出了邊界就不再是全知全能了。事物的發(fā)展充滿了不確定性,而統(tǒng)計學(xué),既研究如何從數(shù)據(jù)中把信息和規(guī)律提取出來,找出最優(yōu)化的方案;也研究如何把數(shù)據(jù)當中的不確定性量化出來。
因此我們說在大數(shù)據(jù)時代,數(shù)據(jù)分析的很多根本性問題和小數(shù)據(jù)時代并沒有本質(zhì)區(qū)別。當然,大數(shù)據(jù)的特點,確實對數(shù)據(jù)分析提出了全新挑戰(zhàn)。如果你對大數(shù)據(jù)感興趣,那么不妨來千鋒大數(shù)據(jù)培訓(xùn)看一看!