博客
关于我
强烈建议你试试无所不能的chatGPT,快点击我
《大数据分析原理与实践》一一第3章 关联分析模型
阅读量:6438 次
发布时间:2019-06-23

本文共 878 字,大约阅读时间需要 2 分钟。

第3章 关联分析模型

关联分析用于描述多个变量之间的关联。如果两个或多个变量之间存在一定的关联,那么其中一个变量的状态就能通过其他变量进行预测。关联分析的输入是数据集合,输出是数据集合中全部或者某些元素之间的关联关系。例如,房屋的位置和房价之间的关联关系或者气温和空调销量之间的关系。

关联分析主要包括如下分析内容:
(1)回归分析
回归分析是最灵活最常用的统计分析方法之一,它用于分析变量之间的数量变化规律,即一个因变量与一个或多个自变量之间的关系。特别适用于定量地描述和解释变量之间相互关系或者估测或预测因变量的值。例如,回归分析可以用于发现个人收入和性别、年龄、受教育程度、工作年限的关系,基于数据库中现有的个人收入、性别、年龄、受教育程度和工作年限构造回归模型,基于该模型可以根据输入的性别、年龄、受教育程度和工作年限预测个人收入。
(2)关联规则分析
关联规则分析用于发现存在于大量数据集中的关联性或相关性,从而描述了一个事物中某些属性同时出现的规律和模式。关联规则分析的一个典型例子是购物篮分析。该过程通过发现顾客放入其购物篮中的不同商品之间的联系,分析顾客的购买习惯。通过了解哪些商品频繁地被顾客同时购买,这种关联的发现可以帮助零售商制定营销策略。其他的应用还包括价目表设计、商品促销、商品的排放和基于购买模式的顾客划分。
(3)相关分析
相关分析是对总体中确实具有联系的指标进行分析。它是描述客观事物相互间关系的密切程度并用适当的统计指标表示出来的过程。例如,在经济学中,如果一段时期内出生率随经济水平上升而上升,这说明两指标间是正相关关系;而在另一时期,随着经济水平进一步发展,出现出生率下降的现象,两指标间就是负相关关系。
相关分析与回归分析在实际应用中有密切关系。然而在回归分析中,所关心的是一个随机变量Y对另一个(或一组)随机变量X的依赖关系的函数形式。而在相关分析中,所讨论的变量的地位一样,分析侧重于变量之间的种种相关特征。例如,以X、Y分别记为高中学生的数学与物理成绩,相关分析感兴趣的是二者的关系如何,而不在于由X去预测Y。

转载地址:http://gcuwo.baihongyu.com/

你可能感兴趣的文章
IT人必须学会的职场四原则
查看>>
Android之剪贴薄实现
查看>>
WPF数据模板和控件模板
查看>>
Sonix SN9P701 OCR点读笔二维码识别源码
查看>>
oracle 单引号 双引号 连接符
查看>>
[golang] implicit assignment of unexported field
查看>>
数据结构 练习 20-查找 算法
查看>>
hadoop集群虚拟机配置
查看>>
如何使用fileupload工具来实现文件上传
查看>>
EZ GUI Button和Checkbox创建
查看>>
指针[收藏]
查看>>
审批流程设计方案-介绍(一)
查看>>
JAVA进阶----主线程等待子线程各种方案比较(转)
查看>>
PowerDesigner(九)-模型文档编辑器(生成项目文档)(转)
查看>>
Python多进程编程
查看>>
使Eclipse下支持编写HTML/JS/CSS/JSP页面的自动提示。
查看>>
IIS_右键点击浏览网站没有反应
查看>>
Struts2的OGNL遍历数组、List、简单的Map
查看>>
POJ训练计划1035_Spell checker(串处理/暴力)
查看>>
Makefile 使用总结【转】
查看>>