day39 比较

day39 7月8日 周日 阴

当我们买一个手机时,我们通过往往会多维度对比,如价格、功能、外观、品牌偏好等等来选择一个手机,这就是一个决策过程。

同样,当我们想做数据分析或决策,第一步找到数据有了抽样或者全量数据后,下一步要做的事就是对比数据,找到差异,第三步再分析差异找出因果关系或者相关性。

第一步的数据获取中,引入我们目前说的大数据来减少抽样带来的误差,大数据的特点是数据量大、维度多样性、价值偏低、处理难,在互联网行业中用户操作均会留下记录,通过一段时间的收集,一些大公司如BATJ结合全网可以收集足够分析的用户数据,或者良好的分层抽样数据。
在生活中很多时候没法做到全量数据,那么这时会用到随机取样、多维分层取样。

在第二步做数据对比的时候,在科学实验里会做实验组与对照组,一般通过控制单一变量,也有多变量试验同时进时,不过这时的实验组会比较多,在目前互联网行业中常规做的是控制单一变量来做数据统计,如单功能/页面灰度测试、abtest,我们可以通过纵向对比(如时间深度),横向对比(同一时间的不同维度)出不同的差异:新功能会不会比老功能更好用被接受,新设计的页面会不会更能引流提高转化?但是在很多互联网公司,我们上了很多新功能、新页面并没有对功能/页面的使用率、转化率/留存率进行统计。没有对比,不知道差异,就无法得到理性的改进方向证据。

第三步,当我们发现差异后,会思考、挖掘展生差异的原因,但也有可能是数据的偏见引起。
接下来讲几点数据偏见。

©著作权归作者所有,转载或内容合作请联系作者
【社区内容提示】社区部分内容疑似由AI辅助生成,浏览时请结合常识与多方信息审慎甄别。
平台声明:文章内容(如有图片或视频亦包括在内)由作者上传并发布,文章内容仅代表作者本人观点,简书系信息发布平台,仅提供信息存储服务。

相关阅读更多精彩内容

  • 关于Mongodb的全面总结 MongoDB的内部构造《MongoDB The Definitive Guide》...
    中v中阅读 32,406评论 2 89
  • “喂,人都死了还睡什么睡!”一声醇厚的声音响起,语气是那么的不耐烦。 “嘿嘿,牛头,要不咱不管她了,反正她只是今...
    独狐阅读 312评论 0 1
  • 气病是个神马病? 1:气虚:有气无力、四肢萎软、气短、自汗、容易疲倦、容易感冒、内脏脱垂等,还常见齿痕舌。方法:补...
    京珂大师姐阅读 2,736评论 0 0
  • 超新星爆发 人类长久以来都认为,头顶上的宇宙是亘古不变、完美无缺的。闪烁的恒星总是呆在老地方,行星则是永远按照固定...
    牛油果进化论阅读 1,128评论 0 6
  • 我参加过自控力读写营很多次,但这一次是我第一次加入运动营。七十天时间说长不长说短不短,虽然由于我的懒惰还是...
    JJL阅读 407评论 0 1

友情链接更多精彩内容