数学建模社区-数学中国
标题:
数学建模各种分析方法
[打印本页]
作者:
佛自业障
时间:
2018-10-30 11:22
标题:
数学建模各种分析方法
数学建模各种分析方法
7 [+ ^) T$ X3 U7 [* A, C, l' a
1.因子分析(Factor Analysis)
# A) ?8 x g/ k9 H3 m8 {3 f
因子分析的基本目的就是用少数几个因子去描述许多指标或因素之间的联系,即将相关比较密切的几个变量归在同一类中,每一类变量就成为一个因子(之所以称其为因子,是因为它是不可观测的,即不是具体的变量),以较少的几个因子反映原资料的大部分信息。
) {: U+ ~3 j; n; V# X$ T3 j
运用这种研究技术,我们可以方便地找出影响消费者购买、消费以及满意度的主要因素是哪些,以及它们的影响力(权重)运用这种研究技术,我们还可以为市场细分做前期分析。
! A1 J& a+ W* n+ A. @) z1 m
% G8 {+ n+ u6 ~# e" i6 A5 V' K
2.主成分分析
& _# g/ u5 W+ s0 p, F* t
主成分分析主要是作为一种探索性的技术,在分析者进行多元数据分析之前,用主成分分析来分析数据,让自己对数据有一个大致的了解是非常重要的。主成分分析一般很少单独使用:a,了解数据。(screening the data),b,和cluster analysis一起使用,c,和判别分析一起使用,比如当变量很多,个案数不多,直接使用判别分析可能无解,这时候可以使用主成份发对变量简化。(reduce dimensionality)d,在多元回归中,主成分分析可以帮助判断是否存在共线性(条件指数),还可以用来处理共线性。
5 g$ P0 p6 }; o
6 M4 b2 q! `( [
主成分分析和因子分析的区别
o4 v% h. \/ K0 M
1、因子分析中是把变量表示成各因子的线性组合,而主成分分析中则是把主成分表示成个变量的线性组合。
( f! f; g# u5 ]7 ^) a, |/ @. I& u3 ?, k/ d
2、主成分分析的重点在于解释个变量的总方差,而因子分析则把重点放在解释各变量之间的协方差。
* c7 n/ l+ B; Q% ~, X U# q. x2 i
3、主成分分析中不需要有假设(assumptions),因子分析则需要一些假设。因子分析的假设包括:各个共同因子之间不相关,特殊因子(specific factor)之间也不相关,共同因子和特殊因子之间也不相关。
/ L" f+ k5 X7 @6 _/ p
4、主成分分析中,当给定的协方差矩阵或者相关矩阵的特征值是唯一的时候,的主成分一般是独特的;而因子分析中因子不是独特的,可以旋转得到不同的因子。
7 y% e6 Q8 E4 ]
5、在因子分析中,因子个数需要分析者指定(spss根据一定的条件自动设定,只要是特征值大于1的因子进入分析),而指定的因子数量不同而结果不同。在主成分分析中,成分的数量是一定的,一般有几个变量就有几个主成分。
% X1 i4 I/ k6 j. v2 n6 U
和主成分分析相比,由于因子分析可以使用旋转技术帮助解释因子,在解释方面更加有优势。大致说来,当需要寻找潜在的因子,并对这些因子进行解释的时候,更加倾向于使用因子分析,并且借助旋转技术帮助更好解释。而如果想把现有的变量变成少数几个新的变量(新的变量几乎带有原来所有变量的信息)来进入后续的分析,则可以使用主成分分析。当然,这中情况也可以使用因子得分做到。所以这中区分不是绝对的。
/ d8 L; F; I* C8 {0 u
- ]% l0 z6 k; x% E7 u# o
总得来说,主成分分析主要是作为一种探索性的技术,在分析者进行多元数据分析之前,用主成分分析来分析数据,让自己对数据有一个大致的了解是非常重要的。主成分分析一般很少单独使用:a,了解数据。(screening the data),b,和cluster analysis一起使用,c,和判别分析一起使用,比如当变量很多,个案数不多,直接使用判别分析可能无解,这时候可以使用主成份发对变量简化。(reduce dimensionality)d,在多元回归中,主成分分析可以帮助判断是否存在共线性(条件指数),还可以用来处理共线性。
9 J) f$ X {& J$ A5 R8 S
在算法上,主成分分析和因子分析很类似,不过,在因子分析中所采用的协方差矩阵的对角元素不在是变量的方差,而是和变量对应的共同度(变量方差中被各因子所解释的部分)。
9 M7 }; ~( J# t5 `; U# f
5 h9 u% ]- C' M7 R
3.聚类分析(Cluster Analysis)
& s+ m& s- ]4 Z& \" e8 s
聚类分析是直接比较各事物之间的性质,将性质相近的归为一类,将性质差别较大的归入不同的类的分析技术 。 在市场研究领域,聚类分析主要应用方面是帮助我们寻找目标消费群体,运用这项研究技术,我们可以划分出产品的细分市场,并且可以描述出各细分市场的人群特征,以便于客户可以有针对性的对目标消费群体施加影响,合理地开展工作。
/ l: p6 }: g" o$ U, W
4.判别分析(Discriminatory Analysis)
. [! @0 t- z* P& K& V0 e3 L, c
判别分析(Discriminatory Analysis)的任务是根据已掌握的1批分类明确的样品,建立较好的判别函数,使产生错判的事例最少,进而对给定的1个新样品,判断它来自哪个总体。 根据资料的性质,分为定性资料的判别分析和定量资料的判别分析;采用不同的判别准则,又有费歇、贝叶斯、距离等判别方法。
9 b8 P4 [# q' p& Z& ]% X
费歇(FISHER)判别思想是投影,使多维问题简化为一维问题来处理。选择一个适当的投影轴,使所有的样品点都投影到这个轴上得到一个投影值。对这个投影轴的方向的要求是:使每一类内的投影值所形成的类内离差尽可能小,而不同类间的投影值所形成的类间离差尽可能大。
# z2 Q$ C& G g% j4 y
贝叶斯(BAYES)判别思想是根据先验概率求出后验概率,并依据后验概率分布作出统计推断。所谓先验概率,就是用概率来描述人们事先对所研究的对象的认识的程度;所谓后验概率,就是根据具体资料、先验概率、特定的判别规则所计算出来的概率。它是对先验概率修正后的结果。
' O$ A/ G' B/ `) l
距离判别思想是根据各样品与各母体之间的距离远近作出判别。即根据资料建立关于各母体的距离判别函数式,将各样品数据逐一代入计算,得出各样品与各母体之间的距离值,判样品属于距离值最小的那个母体。
! D$ ?/ W& G8 B5 r* E. W6 \5 ~
3 k& f1 y+ X: e* S8 A0 t, s7 W
总得来说,主成分分析主要是作为一种探索性的技术,在分析者进行多元数据分析之前,用主成分分析来分析数据,让自己对数据有一个大致的了解是非常重要的。主成分分析一般很少单独使用:a,了解数据。(screening the data),b,和cluster analysis一起使用,c,和判别分析一起使用,比如当变量很多,个案数不多,直接使用判别分析可能无解,这时候可以使用主成份发对变量简化。(reduce dimensionality)d,在多元回归中,主成分分析可以帮助判断是否存在共线性(条件指数),还可以用来处理共线性。
2 h+ |! i9 }: g& ]4 M9 m7 `
在算法上,主成分分析和因子分析很类似,不过,在因子分析中所采用的协方差矩阵的对角元素不在是变量的方差,而是和变量对应的共同度(变量方差中被各因子所解释的部分)。
, C7 v# Y3 E0 V: E
# N: R2 o! @5 [; n! G
6 W4 @# j& r7 ~+ o$ m: d8 z) O
) O5 ?! }$ ?: \/ g8 y+ a( s* T
% A% q0 C9 R6 {+ R4 y+ W
7 F+ |/ q; ?8 a1 i$ J9 ~
% c+ o) d& t2 b; D. D2 n' O4 T/ O0 {
' l4 H; ]/ W x- {" j: W. c
3 ^( z6 y, M0 U) o
% r: X# d9 X& H
# L3 h, K& d6 c3 K- }! j- g7 O. B" X, r
5 N2 D' u- O+ v% {
欢迎光临 数学建模社区-数学中国 (http://www.madio.net/)
Powered by Discuz! X2.5