首席数据官

Hi, 请登录

专家解读:企业如何进入大数据行业?

之前参加了Italk活动,听取的有关大数据公司和产业机构的讲座,因此萌生出一个写文章的冲动,想对目前大数据产业中的一些错误现象进行讨论。

陈宇认为大数据是哲学层面上的问题,属于统计学范畴,部分揭示了大数据产业的本质,但是实际上大数据这个概念自身就有着不同的诠释。利用数据进行军事分析,产品定位,交通管理,风险管理,精准营销等等,其实在几十年前就有了。最早的保险产品就是来源于偶然事件的概率分析,其参考历史数据分析,依据计算出的概率来,来对保险产品进行定价。中国古代的军事学家孙膑在战争中,通过逐步减少行军灶坑来迷惑对手,利用其师弟庞涓对数据信任,制造其带领军队溃败的假象,最后在对方轻敌冒进的前提下,突袭了对手,赢得了战争胜利。因此数据分析其实在很久远的古代就存在了。为什么过去的数据分析换成了时髦的名称大数据了呢?

相对于过去的数据,我们来讨论大数据的含义:

1)过于一些记录是以模拟形式出现的,或者以数据形式出现但是存贮在本地,不是公开数据资源,没有开放给互联网用户,例如音乐、照片、视频、监控录像等影音资料。现在这些数据不但数据量巨大,并且放到了互联网上,开放给整个互联网用户,其数量之大是前所未有了。举个例子Facebook每天有18亿张照片上传或被传播,形成了海量的开放数据。

2)移动互联网出现后,移动设备的很多传感器收集了大量的用户点击行为数据,已知iphone有3个传感器淘宝大数据应用案例,三星有6个传感器。它们每天产生了大量的点击数据,这些数据被某些公司所有拥有,形成用户大量行为数据。

3)移动地图出现后,例如高德、百度、google地图,其产生了大量的数据流数据,这些数据不同于传统数据,传统数据代表一个属性或一个度量值,但是这些地图产生的流数据代表着一种行为、一种习惯,这些流数据经频率分析后会产生巨大的商业价值。基于地图产生的数据流是一种新型的数据类型,在过去是不存在的。

4)进入了社交网络的年代后,互联网行为主要由用户参与创造,因此有大量的互联网用户创造出大量的社交行为数据。这些数据是过去不曾想像的,是海量的。某些数据代表特定人群的特点和个性。

5)电子商户崛起带来了大量网上交易行为,其产生了大量的交易数据,包含支付行为淘宝大数据应用案例,查询行为,物流运输、购买行为等等,产生了海量的信息流和资金流数据。

6)传统的互联网入口转向搜索引擎之后,用户的搜索行为和提问行为产生了海量数据。单位存贮价格的下降也为存储这些数据提供了技术上的可能。

现在我们所指的大数据不同与过去传统的数据,其产生方式、存储载体、访问方式、表现形式、来源特点等都同传统的数据不同。简单的讲大数据范围更接近于某个群体行为特点数据,全面的数据。移动互联网和社交网络创造出来了大量的行为数据。

大数据产业是朝阳产业,任何一个想进入此产业的公司和个人向先要思考好以下几个问题。

1、数据在哪里?

2、哪些是有用的数据?

3、如何分析这些数据?(如何将非结构化数据变成结构化数据)

4、需要用数据解决的问题是什么?或者是分析后数据后提出的观点是什么?

5、如何展现你的数据和推理?(图形、图表、曲线、分值、评价、归类、等级、概率、模型等等,大数据要么解决目前的问题,要么支持你的假设,要们引导出另一个未知观点)

6、重新审核数据分析的逻辑和数据来源,是否可以展现一份可以经过推敲的数据分析报告?

如果以上的问题都可以解决,这时你可以进入正产业。中国的大数据产业近几年来逐渐升温,政府有投入了大量的资金。目前正在困扰很多大数据公司的问题是数据在哪里?目前我们了解的大数据来源主要有以下几个方面;

大数据应用 培训_大数据 应用 行业_淘宝大数据应用案例

1)电信运行商(由于其提供互联网接入服务,互联网行为记录数据)

2)第三方支付(支付行为产生的资金流和信息流数据)

3)电商平台(阿里为代表,几亿的淘宝用户和2万亿的网络购买行为的数据)

4)社交平台(微信和微博为代表的社区网络产生的互联网行为数据)

5)电子游戏平台(大量用户产生的数据)

6)移动入口产生大量数据(包含移动APP,导航,地图等)

7)搜索引擎上产生的数据

除了这些新兴的大数据来源,其实在传统行业,由于很多数据是不能公开和共享的,还有很多大数据来源没有被重点关注。例如:

1)政府掌握的经济社会的统计数据

大数据应用 培训_淘宝大数据应用案例_大数据 应用 行业

2)金融行业内部交易和支付数据

3)医疗行业的病历数据

4)教育行业的考试数据

5)交通运输行业物流数据

6)科学研究方面大量重复的论文、专利、科研实验的数据

7)生物工程、农林牧渔等方面的数据

目前在中国大数据产业投入最多的是政府,这是一个好事情,因为在中国政府是最大数据的拥有者,最财大气粗的投资者,最具有资源的市场参与者。如果政府可以有效利用手中的数据,经过科学严谨的分析后,利用其进行资源的配置、重大经济决策、市场未来趋势预见、经济风险提示、产业管理、投资管理、财政费用管理、等,将有利于政府进行宏观调控、技术干预、行政管理、资源配置、财富分配。同时也有助于政府提高对公共事务包含社会福利的管理水平。

但是我发现目前很多政府参与的大数据产业集中在两个领域,第一个搭建云计算和云存储平台,利用政府具有的资源,委托研究机构搭建政府主导的大数据生态圈,让企业将数据提供出来,政府提过产业机构来帮助企业分析数据,提供大数据解决方案。简单的讲营造大数据平台和生态圈,从事大数据收集和开发的工作。

第二个是委托具有大数据技术的公司,利用互联网公开的数据和政府拥有的数据进行舆情监控,了解自己重视和关心的焦点问题,关注社会群体的舆论行为、社交行为,以及区域电商交易行为、服务投诉行为等等。简单的讲是利用互联网采集技术来了解舆情,作为一种情报输入来帮助政府来制定工作决策。

这两种参与方式我都不十分赞同,第一种明显是过度参与市场,政府应该制定规则来帮助大数据产业健康发展,而不是作为运动员参与产业发展。政府应该制定相关制

试看结束,如继续查看请付费↓↓↓↓
打赏0.5元才能查看本内容,立即打赏

来源【首席数据官】,更多内容/合作请关注「辉声辉语」公众号,送10G营销资料!

版权声明:本文内容来源互联网整理,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 jkhui22@126.com举报,一经查实,本站将立刻删除。

相关推荐

二维码
评论