中國IDC圈3月7日報道:大數(shù)據(jù)已成為媒體與大眾關注的新技術,大數(shù)據(jù)的應用也預示著信息時代將進入一個新階段,但人們對大數(shù)據(jù)的認識有一個不斷加深的過程。在當下的信息時代,我們對大數(shù)據(jù)應有新的再認識。
大數(shù)據(jù)興起預示信息時代進入新階段
中國已開始進入信息時代,但許多人的思想還停留在工業(yè)時代。經濟和科技工作中出現(xiàn)的許多問題,其根源是對時代的認識不到位。經濟新常態(tài)意味著中國進入了以信息化帶動新型工業(yè)化、城鎮(zhèn)化和農業(yè)現(xiàn)代化的新階段。大數(shù)據(jù)、移動互聯(lián)網、社交網絡、云計算、物聯(lián)網等新一代信息技術構成的IT架構“第三平臺”是信息社會進入新階段的標志,對整個經濟的轉型有引領和帶動作用。媒體上經常出現(xiàn)的互聯(lián)網+、創(chuàng)客、“第二次機器革命”、“工業(yè)4.0”等都與大數(shù)據(jù)和云計算有關。大數(shù)據(jù)和云計算是新常態(tài)下提高生產率的新杠桿,所謂創(chuàng)新驅動發(fā)展就是主要依靠信息技術促進生產率的提高。
中國的大數(shù)據(jù)企業(yè)已經有相當好的基礎。全球十大互聯(lián)網服務企業(yè)中國占有4席(阿里巴巴、騰訊、百度和京東),其他6個Top10 互聯(lián)網服務企業(yè)全部是美國企業(yè),歐洲和日本沒有互聯(lián)網企業(yè)進入Top10。這說明中國企業(yè)在基于大數(shù)據(jù)的互聯(lián)網服務業(yè)務上已處于世界前列。在發(fā)展大數(shù)據(jù)技術上,我國有可能改變過去30年技術受制于人的局面,在大數(shù)據(jù)應用上中國有可能在全世界起到引領作用。我們要吸取過去基礎研究為企業(yè)提供核心技術不夠的教訓,加強大數(shù)據(jù)基礎研究和前瞻技術研究,努力攻克大數(shù)據(jù)核心和關鍵技術。
理解大數(shù)據(jù)需要上升到文化和認識論的高度
數(shù)據(jù)文化的本質是尊重客觀世界的實事求是精神,數(shù)據(jù)就是事實。重視數(shù)據(jù)就是強調用事實說話、按理性思維的科學精神。中國人的傳統(tǒng)習慣是定性思維而不是定量思維。目前許多城市在開展政府數(shù)據(jù)開放共享工作,但是發(fā)現(xiàn)多數(shù)老百姓對政府要開放的數(shù)據(jù)并不感興趣。要讓大數(shù)據(jù)走上健康的發(fā)展軌道,首先要大力弘揚數(shù)據(jù)文化。數(shù)據(jù)文化不只是大數(shù)據(jù)用于文藝、出版等文化產業(yè),而是指全民的數(shù)據(jù)意識。全社會應認識到:信息化的核心是數(shù)據(jù),只有政府和大眾都關注數(shù)據(jù)時,才能真正理解信息化的實質;數(shù)據(jù)是一種新的生產要素,大數(shù)據(jù)的利用可以改變資本和土地等傳統(tǒng)要素在經濟中的權重。
提高數(shù)據(jù)意識的關鍵是要理解大數(shù)據(jù)的戰(zhàn)略意義。數(shù)據(jù)是與物質、能源一樣重要的戰(zhàn)略資源,數(shù)據(jù)的采集和分析涉及每一個行業(yè),是帶有全局性和戰(zhàn)略性的技術。從硬技術到軟技術的轉變是當今全球性的技術發(fā)展趨勢,而從數(shù)據(jù)中發(fā)現(xiàn)價值的技術正是最有活力的軟技術,數(shù)據(jù)技術與數(shù)據(jù)產業(yè)的落后將使我們像錯過工業(yè)革命機會一樣延誤一個時代。
正確認識大數(shù)據(jù)的價值和效益
人們總是期望從大數(shù)據(jù)中挖掘出意想不到的“大價值”。實際上大數(shù)據(jù)的價值主要體現(xiàn)在它的驅動效應,即帶動有關的科研和產業(yè)發(fā)展,提高各行各業(yè)通過數(shù)據(jù)分析解決困難問題和增值的能力。大數(shù)據(jù)對經濟的貢獻并不完全反映在大數(shù)據(jù)公司的直接收入上,應考慮對其他行業(yè)效率和質量提高的貢獻。大數(shù)據(jù)是典型的通用技術,理解通用技術要采用“蜜蜂模型”:蜜蜂的效益主要不是自己釀的蜂蜜,而是蜜蜂傳粉對農業(yè)的貢獻。
有一個家喻戶曉的寓言可以從一個角度說明大數(shù)據(jù)的價值:一位老農民臨終前告訴他的3個兒子,他在他家的地中埋藏了一罐金子,但沒有講埋在哪里。他的兒子們把他家所有的地都深挖了一遍,沒有挖到金子,但由于深挖了土地,從此莊稼收成特別好。數(shù)據(jù)收集、分析的能力提高了,即使沒有發(fā)現(xiàn)什么普適的規(guī)律或令人完全想不到的新知識,大數(shù)據(jù)的價值也已逐步體現(xiàn)。
大數(shù)據(jù)研究和應用要改變過去各部門和各學科相互分割、獨立發(fā)展的傳統(tǒng)思路,重點不是支持單項技術和單個方法的發(fā)展,而是強調不同部門、不同學科的協(xié)作。數(shù)據(jù)科學不是垂直的“煙囪”,而是像環(huán)境、能源科學一樣的橫向集成科學。
從復雜性的角度看大數(shù)據(jù)研究和應用面臨的挑戰(zhàn)
圖文檢索、主題發(fā)現(xiàn)、語義分析、情感分析等數(shù)據(jù)分析工作十分困難,其原因是大數(shù)據(jù)涉及復雜的類型、復雜的結構和復雜的模式,數(shù)據(jù)本身具有很高的復雜性。大數(shù)據(jù)的復雜性還體現(xiàn)在數(shù)據(jù)之間的相互關聯(lián)。大數(shù)據(jù)計算不能像處理小樣本數(shù)據(jù)集那樣做全局數(shù)據(jù)的統(tǒng)計分析和迭代計算,在分析大數(shù)據(jù)時,需要重新審視和研究它的可計算性、計算復雜性和求解算法。