在这篇博文中,我们聚焦于在数据科学领域所遇到的四种类型的数据分析模式:描述型、诊断型、预测型和指导型。当我与刚涉足数据科学领域的年轻分析师们交谈时,通常,我会问他们认为什么是数据科学家最重要的能力。他们的答案相当多样化。

我想告诉他们的是,他们最重要的能力将是能够把数据转化为对非专业人士而言清楚而有意义的见解。瑞典统计学家Hans Rosling在这方面很有名。这种能力往往被忽略。下面Hans Rosling的这个TedTalk谈到了这些。分析能辅助开发有价值的见解,很有必要用一些工具来让人们了解分析所起的作用。其中一种工具是分析四维图。简单地来说,分析可被划分为4个重要的类别。下面我将详细解释这四个类别。

1. 描述型:发生了什么?

这是最常见的一种。在业务中,它向分析师们提供业务的重要衡量标准的概览。一个例子是每月的利润和损失账单。类似地,分析师可以获得大批客户的数据。了解客户(如,30%的客户是自雇型)的地理信息也可认为是“描述型分析”。充分利用可视化工具能增强描述型分析所带来的信息。

2. 诊断型:为什么会发生?

这是描述型分析的下一步难题。通过评估描述型数据,诊断分析工具使得分析师们能够深入分析问题的核心原因。设计良好的商业信息dashboard整合了时间序列数据(譬如,在多个联系时间点上的数据)的读入、特征的过滤和钻入功能,能够用于这类分析。

3. 预测型:可能发生什么?

预测型分析主要是进行预测。某事件在将来发生的可能性,预测一个可量化的值,或者是估计事情可能发生的某个时间点,这些都可以通过预测模型完成。预测模型通常运用各种可变数据来作出预测。数据成员的多样化与可能预测的目标是相关联的(如,人的年龄越大,越可能发生心脏病,我们可以说年龄与心脏病风险是线性相关的)。随后,这些数据被放在一起,产生分数或预测。

在一个充满不确定性因素的世界里,能够预测允许人们作出更好的决定。预测模型在很多领域都被用到。

4. 指导型:我需要做什么?

在价值和复杂度上,下一步就是指导性模型。指导性模型基于发生了什么、为什么会发生以及一系列“可能发生什么”的分析,帮助用户确定要采取的最好的措施。很显然,指导性分析不是一个单独的行为,实际上它是其他很多行为的主导。交通应用是一个很好的例子,它帮助人们选择最好的回家路线,考虑到了每条路线的距离、在每条路上的速度、以及很关键的目前的交通限制。

另一个例子是生成考试时间表,不让任何学生的时间表发生冲突。

 

关注中国IDC圈官方微信:idc-quan 我们将定期推送IDC产业最新资讯

查看心情排行你看到此篇文章的感受是:


  • 支持

  • 高兴

  • 震惊

  • 愤怒

  • 无聊

  • 无奈

  • 谎言

  • 枪稿

  • 不解

  • 标题党
2018-03-01 11:30:32
大数据应用 孟天广:可利用大数据监测政商腐败,查出“白手套”
“马云说过,有了大数据就可以计划经济。这个是不靠谱的,但是我认为在解决政府监管市场方面大数据还是有效的,包括监管腐败和制度腐败,因为地方现金流完全可以监测出来。 <详情>
2018-02-28 11:08:00
市场情报 Teradata天睿公司入选2018年Gartner分析型数据管理解决方案魔力象限领导者象限
Teradata今年再次入选Gartner公司发布的《2018年分析型数据管理解决方案(DMSA)魔力象限》的领导者象限,这也是Teradata连续16年入选该报告。 <详情>
2018-02-26 17:25:00
大数据资讯 大数据告诉你为什么巴菲特这么乐观
白手起家的亿万富翁巴菲特发表了令人期待以久的年度致股东的信,投资者相信他总能给人最有价值的投资意见。 <详情>
2018-02-26 11:03:00
大数据应用 PTMIND铂金智慧:给所有企业做人人可用的数据分析产品
2017年度诺贝尔经济学奖获得者理查德·泰勒(Richard H. Thaler)曾在2008年与美国哈佛大学法学院教授卡斯·桑斯坦(Cass R. Sunstein)共同提出了一个类似于蝴蝶效应的观 <详情>
2018-02-24 17:52:00
大数据资讯 5年大数据,看互联网下的“花样”春节
春节正在成为中国社会发展的一个缩影。特别是近年来,互联网模式的深入推进,网购年货、好友助力抢车票、旅游式过年、搭顺风车回家、手机红包送祝福……春节的玩法变得越来 <详情>