1. 首页
  2. R语言

数据挖掘是“神马”

关于数据挖掘的作用,Berry and Linoff的定义尽管有些言过其实,但清晰的描述了数据挖掘的作用。“分析报告给你后见之明 (hindsight);统计分析给你先机 (foresight);数据挖掘给你洞察力 (insight)”。

举个例子说。

你看到孙悟空跟二郎神打仗,然后写了个分析报告,说孙悟空在柔韧性上优势明显,二郎神在力气上出类拔萃,所以刚开始不相上下;结果两个人跑到竹林里,在竹子上面打,孙悟空的优势发挥出来,所以孙悟空赢了。这叫分析报告。

孙悟空要跟二郎神打架了,有个赌徒找你预测。你做了个统计,发现两人斗争4567次,其中孙悟空赢3456次。另外,孙悟空斗牛魔王,胜率是89%,二郎神斗牛魔王胜率是71%。你得出趋势是孙悟空赢。因为你假设了这次胜利跟历史的关系,根据经验作了一个假设。这叫统计分析。

你什么都没做,让计算机自己做关联分析,自动找到了出身、教育、经验、单身四个因素。得出结论是孙悟空赢。计算机通过分析发现贫苦出身的孩子一般比皇亲国戚功夫练得刻苦;打架经验丰富的人因为擅长利用环境而机会更多;在都遇得到明师的情况下,贫苦出身的孩子功夫可能会高些;单身的人功夫总比同样环境非单身的高。孙悟空遇到的名师不亚于二郎神,而打架经验绝对丰富,并且单身,所以这次打头,孙悟空赢。这叫数据挖掘。

数据挖掘跟LOAP的区别在于它没有假设,让计算机找出这种背后的关系,而这种关系可能是你所想得到的,也可能是所想不到的。比如数据挖掘找出的结果发现在2亿条打斗记录中,姓孙的跟姓杨的打,总是姓孙的胜利,孙悟空姓孙,所以,悟空胜利。

用在现实中,我们举个例子来说,做OLAP分析,我们找找哪些人总是不及时向电信运营商缴钱,一般会分析收入低的人往往会缴费不及时。通过分析,发现不及时缴钱的穷人占71%。而数据挖掘则不同,它自己去分析原因。原因可能是,家住在五环以外的人,不及时缴钱。这些结论对推进工作有很深的价值,比如在五环外作市场调研,发现需要建立更多的合作渠道以方便缴费。这是数据挖掘的价值。

1、数据挖掘需要‘神马样’的流程?

2、哥,有没有详细点的,来个给力的!

数据挖掘是“神马”

3、数据挖掘在商业上的理解是?

数据挖掘是“神马”

4、数据在统计意义上有哪些类型?

数据挖掘是“神马”

5、他们的含义是什么呢?

数据挖掘是“神马”

6、基本的探测指标有哪些?

数据挖掘是“神马”

7、数据挖掘的算法有哪些呢?

数据挖掘是“神马”

8、需要掌握的工具有哪些?

数据挖掘是“神马”

9、知道这些工具不知道如何在工作中用呀?有没有‘浮云’般的角度?

数据挖掘是“神马”

10、结果如何可视化的展现?

数据挖掘是“神马”

11、还有没有更人性化、智能化的展现?

数据挖掘是“神马”

12、上面这图看起来很给力,背后很复杂吧?

数据挖掘是“神马”

13、职业的发展道路如何?

数据挖掘是“神马”

14、我的性格适合吗?(有志者,事竟成)

数据挖掘是“神马”

15、都说这行很累?NO! 懂得生活。。。。

数据挖掘是“神马”

原文始发于微信公众号(PPV课数据科学社区):数据挖掘是“神马”

原创文章,作者:ppvke,如若转载,请注明出处:http://www.ppvke.com/archives/32136

联系我们

4000-51-9191

在线咨询:点击这里给我发消息

工作时间:周一至周五,9:30-18:30,节假日休息