数据分析的两个误区,你中招了吗

墨子
• 阅读 1046

数据分析的两个误区,你中招了吗

平时无论是进行用户调研、产品运营还是竞品分析,都少不了对于数据的分析,如果项目中出现某些分歧谁也无法说服谁时,很多时候也都是拿数据说话,可见在开发产品的时候,对数据的统计与分析十分重要。大家都说数据是客观的,但其实数据受背景环境、统计者、统计方法、分析者看法等多重因素影响,以致我们在统计和分析时却常常陷入误区,得不到正确的答案。下面简单说一下关于数据的两个常见误区。

误区一:把某一类型数据当做全部数据,导致分析结果错误

先说个小故事:二战时英国空军希望增加飞机的装甲厚度,但如果全部装甲加厚则会降低灵活性,所以最终决定只增加受攻击最多部位的装甲。后来工作人员经过对中弹飞机的统计,发现大部分飞机的机翼弹孔较多,所以决定增加机翼的装甲厚度。直到后来一个专家说:“可是机头中弹的那些飞机就没有飞回来。”

这个故事里本应是对全部飞机进行分析,但统计样本没有包含已经损毁的飞机,所以得出的结论只是根据部分数据,或者说是根据具有同样特征(受伤)的某一类数据推论出的,并不能代表全部类型的数据,所以得出的结果很可能是错误的。

再看一个例子:前一阵我为了分析人人网,想看看人人网现在的用户访问量是什么状态,于是选择了PV作为观测指标,通过alexa来看人人网的PV在过去一年中呈明显的下降态势,这也印证了我的预期,于是就以此为论据进行了分析。可是后来发现,alexa仅仅统计通过WEB的访问量,而用户移动端的登录并不在统计范围之内!这两年智能手机普及迅速,移动端登录也非常普遍,缺失这部分数据意味着前面统计的数据基本没有意义,因为WEB端访问量的下降有可能是用户访问人人网次数降低,同时也有可能是由PC端向移动端迁移,这个统计就不能作为论据出现了。

可以看到,我只统计了WEB端的访问情况,认为这就是人人网全部访问量,而忽略了移动端,从而推出了错误的结果。另一个问题就是由于我已经有预期(人人网访问量下降),那么我在为这个结论找寻相关的论据,当找到符合我结论的论据时很容易不去做更多判断就选择有利于自己的数据,这也是数据统计人员常见的问题。

用某一类型数据代替全部数据会误导我们做出错误的判断,在统计时一定要注意这点。这一方面需要意识,在统计、分析数据时要时刻想着还有没有其他的情况,还有没有我们没有想到的数据类型,这些数据是不是能代表全部类型,尝试站在更高的角度去解读这些数据,而不是拿到数据后立刻就盲目分析。另一方面需要知识的累积,比如你知道alexa是如何进行统计的,那么很轻易就会想到还要考虑移动端的情况。知识的累积有助于我们做出准确的判断,这些知识与经验都是从阅读或实践中得来的,平时多做,慢慢累积,时间久了自然会看得更全面。

数据分析的两个误区,你中招了吗

误区二: 鲜明事件让我们夸大了偶然因素

鲜明的事件更容易占据我们的视线,从而让我们高估事件发生的概率。

比如从年度统计中看到,某基金近两年的收益率达到100%,有某某明星操盘手等等,人们就会争相去购买该基金,同时也会让人们认为买基金就是可以赚钱的。而实际上,绝少有基金可以常年保持这样的收益率,近两年收益前五名的基金很可能在五年后收益率就排行倒数,而世面上大部分基金也无法跑赢大盘,不过人们在记忆中依然会认为买基金确实很赚钱,当年XXX两年益100%呢。两年收益达到100%只是偶然情况,但却由于事件太过鲜明而长久驻扎在人们的心智中。

类似的事还有很多。比如富士康N连跳,大家都觉得这么多人跳楼,富士康肯定太黑暗了,但大家却没有注意富士康员工大概有37万人,按12连跳的话自杀率不到十万分之四,而全国的平均自杀率为十万分之十五, N连跳自杀率远低于全国自杀率,可见富士康12连跳实际上是一个社会问题,而不仅仅是一个企业的问题,我们太过注重鲜明的事实却忽略了背后整体的概率。

前两天美国波士顿爆炸案死亡3人,微博上各种祈福,可是阿富汗、伊拉克等国家几乎每天都面临着这些问题,只是由于媒体不会整天报道那里的消息,而天天出现的袭击也麻痹了人们的神经,所以我们只会关注鲜明的波士顿爆炸,而对其他地区天天发生的事情无动于衷。另外比如你周围有人买股票赚了好多钱,可能你也会很想投身股市一试运气,而忽略了散户8赔1平1赚的整体概率。你看到了各种创业成功者的报道,认为自己也可以尝试创业,毕竟成功概率好像也不低。但你不知道那些不成功的人基本没有被报道的机会,而实际上创业成功的人可能不到1%。

说了这么多,其实就是太过鲜明的偶然事件会让我们忽略背后一直存在的整体概率。看到这种数据的时候,不要太过情绪化,你所看到的数据或事件可能只是个例,并不能代表大多数,可以去查查历史情况或平均情况,去找找沉默的用户或数据,切忌轻易就做出判断和决定。要理性看待这些偶然事件,既不盲目跟随,也不对此嗤之以鼻,在明确整体概率的情况下,剔除偶然因素,分析这些偶然事件背后是否存在着某些值得借鉴的地方,从而吸收到自己产品或项目中,以便使自己的产品或要处理的事情有可能成为市场中下一个“偶然事件”。

数据分析的两个误区,你中招了吗

广州思迈特软件有限公司致力于为企业客户提供一站式商业智能解决方案。

通过Smartbi产品为客户提供报表、数据可视化、数据挖掘等成熟功能;通过Smartbi应用商店为客户提供场景化、行业化数据分析应用。经过十余年的发展,已在金融、电信、政府、制造等行业获得2000多家领先客户认可,口碑良好。在全球财富500强的10家国内银行,有8家选用了Smartbi。

在大数据和大数据分析时代,它们对企业的影响有一个兴趣高涨。大数据分析是研究大量的数据的过程中寻找模式,相关性和其他有用的信息,可以帮助企业更好地适应变化,并做出更明智的决策。

那就要问数据分析软件有哪些?越来越多软件供应商推出可视化数据分析,为了应对当前企业业务的大数据现状,有哪些自助式的数据分析工具可供选择?

Smartbi是一款面向企业的在线商业智能产品。最重要的特点是配备百亿级社交数据库,搭载了分布式搜索、语义分析、数据可视化三大引擎系统的海量计算平台,实现数据处理“探索式分析”和“秒级响应”的两个核心功能。

即便是个人免费版,体验和功能仍然非常好;功能完善,集数据处理、特征工程、建模、文本挖掘为一体的机器学习平台;可视化视图展现、友好的客户感知页面;支持SAAS,私有化部署,有权限管理。

点赞
收藏
评论区
推荐文章
Irene181 Irene181
4年前
用户画像有什么用?怎样用?6个场景案例给你讲明白
导读:企业的精细化运营、数据驱动都是基于大数据分析来进行的。在大数据分析中,对用户行为进行分析挖掘又是一个重要的方向,通过对用户行为进行分析,企业可以了解用户从哪里来,进入平台后进行了哪些操作,什么情况下进行了下单付款,用户的留存、分布情况是怎样的等。在这些数据的指导下可以不断优化产品设计、运营模式从而促进转化率的提高和营收的增长。基于用户行为分
如何使用Python的Selenium库进行网页抓取和JSON解析
随着互联网的快速发展,网页抓取和数据解析在许多行业中变得越来越重要。无论是电子商务、金融、社交媒体还是市场调研,都需要从网页中获取数据并进行分析。Python的Selenium库作为一种自动化测试工具,已经成为许多开发者的首选,因为它提供了强大的功能和灵活
Stella981 Stella981
3年前
Google笔记
1、我真的确定用户是这样搜的吗?(词根都穷尽了没?)(蕾丝,露肩,上衣,婚纱。。。)2、竞争对手是谁?都有哪些?它有专门针对这批词去做的吗?还是无意中杀死对手。。。。3、竞品分析,比如亚马逊,流量最大来源是产品页,还是列表页?为什么?4.1、产品词,从整体上看,我们50万产品页,产品词都有排名了吗?没有,为什么?https:
Stella981 Stella981
3年前
SpringBoot整合Redis乱码原因及解决方案
问题描述:springboot使用springdataredis存储数据时乱码rediskey/value出现\\xAC\\xED\\x00\\x05t\\x00\\x05问题分析:查看RedisTemplate类!(https://oscimg.oschina.net/oscnet/0a85565fa
Easter79 Easter79
3年前
SpringBoot整合Redis乱码原因及解决方案
问题描述:springboot使用springdataredis存储数据时乱码rediskey/value出现\\xAC\\xED\\x00\\x05t\\x00\\x05问题分析:查看RedisTemplate类!(https://oscimg.oschina.net/oscnet/0a85565fa
Wesley13 Wesley13
3年前
APP数据分析,到底是在分析什么?
当下,逢运营必谈数据分析,APP运营更是如此。数据分析的用意本不在于数据本身,而是要打造一个数据反馈闭环。收集数据,设计基础数据指标,多维度交叉分析不同指标,以数据甄别问题,再反向作用产品,最终形成数据驱动产品设计的闭环。从运营小白到产品经理,提到APP数据分析,必谈DAU、MAU、留存率、频率、时长…..那么,究竟如何将这些数据分析和日常运营结合起来呢
Wesley13 Wesley13
3年前
APP数据分析总结:2个分析模型及6种数据展现形式
数据运营分析可帮助人们作出判断,以便采取适当行动。什么是数据分析?数据分析是指用适当的统计分析对收集来的大量数据进行分析,提取有用信息和形成结论而对数据加以详细研究和概括总结的过程。在实用中,数据分析可帮助人们作出判断,以便采取适当行动。数据分析的目的是什么?数据分析的目的是把隐没在一大批看来杂乱无章的数据中的信息集中、萃取和提炼出来,以找出
达达埋点迁移京东子午线实践 | 京东云技术团队
一、概述1.项目价值及成果使用集团的统一埋点采集能力和埋点平台,完成达达7条业务线共43个站点应用的埋点迁移,降低自研采集工具和平台的研发投入和机器成本,打通数据链路,创造更多的数据分析价值。具体降本增效价值如下:1.1数据分析价值:与京东流量数据打通,拉
拼多多商品详情数据在数据分析行业的作用性
在数据分析行业中,拼多多商品详情数据的作用性主要体现在以下几个方面:了解市场和用户需求:通过拼多多商品详情数据,企业可以了解到市场上什么产品受欢迎,用户对产品的反馈和评价如何,从而调整自己的销售策略,优化产品和服务。竞品分析:企业可以通过拼多多商品详情数据
墨子
墨子
Lv1
不管过多少年,我都拒绝不了和你相似的眉眼.
文章
3
粉丝
0
获赞
0