乐于分享
好东西不私藏

【统计分析软件SPSS】67、多重响应集交叉表分析

【统计分析软件SPSS】67、多重响应集交叉表分析

本系列文章(基于SPSS 27版本)配套数据可通过百度网盘获取:

链接:https://pan.baidu.com/s/1AGizNngKrzAVapWtNcc-VA?pwd=mnsj 提取码:mnsj
由于微信公众号已发布文章的内容及排版顺序无法二次编辑,为了方便大家后续查阅、检索,同时便于我对内容进行补充更新与完善,我已将所有已发布的推文,在个人网站上以结构化文档的形式重新整理、归档。欢迎前往查看:
https://www.mizhushare.com/docs/
01
应用场景

在SPSS中定义好多重响应集(Multiple Response Set)之后,它本身不是一个新变量,而是一种“变量集合规则”,因此不能像普通变量那样直接做分析,只能用于频数、交叉分析等描述性统计。

其中,多重响应集交叉表,指的是,将一道多选题(多重响应集)与另一分类变量进行交叉分析,用于比较不同群体在各选项上的选择比例差异。

02
操作步骤

数据为之前通过【demo.sav】(软件自带样本数据定义好的多重响应集。

【统计分析软件SPSS】65、多选题定义——多重响应集

例如,本次的分析目的是探究不同收入群体在「家庭电子设备拥有情况」上的差异。

点击顶部菜单栏的【分析多重响应→交叉表】,在打开的对话框中进行相应设置:
  • 主对话框:
  • 行:指定作为行变量的分类变量。通常选择分组变量。本次为「多重响应集OWN_DEVICE
  • 列:指定作为列变量的分类变量。通常选择因变量、结果变量。本次为年收入等级变量inccat
  • 层:指定层变量(控制变量)。用于考察在控制第三变量后,行变量与列变量的关系是否仍然存在。
  • 定义范围:用于设置分类变量(分类变量法的多重响应集、列变量)的有效选项。本次将列变量「inccat」的范围设为1-4」,表示包含改变了的所有分类范围。
  • 选项对话框:

该对话框用于控制交叉表输出的百分比类型、计算基准和缺失值处理方式。

  • 单元格百分比: 单元格计数总是会被显示。可以选择显示行百分比、列百分比和双向表(总计)百分比。

  • 百分比基于:有以下两种计算方式:

    ①、基于个案(受访者)来计算单元格百分比。如果勾选了「在响应集之间匹配变冷了」,则该选项不可用。

    ②、基于响应来计算单元格百分比。对于多重二分集,响应数等于所有个案中计数值的总数;对于多重分类集,响应数等于定义范围内的值数。

  • 缺失值:决定了在计算百分比时,如何对待那些未回答或无效的个案(即缺失值)。可以选择以下一项或两项:

    ①、当使用二分变量法定义多重响应集时,如果某个受访者在多个选项中都选择了0或1,但某些变量因各种原因出现系统缺失值,SPSS将根据该选项决定是否将该受访者从当前分析中排除。勾选的话,如果某一个变量(比如,购买服装)为缺失值,则整个个案在该变量的统计中被忽略。但由于是「成列」排除,所以其他非缺失变量仍可正常参与计数。比如有100人,其中5人没有填写「数码产品」这一项(该变量为缺失),那么在统计「数码产品」的选择率时,这5人不计入总数。但在统计「服装」时,这5人如果有数据则仍然计入。

    ②、当使用分类变量法定义多重响应集时,如果某个受访者在某一类别的选择中存在缺失值(例如只填了前两个选项,第三个为空),则在整个类别范围内排除该个案。假设有100人,每人最多选3项,但有10人只选了1项(后两项为缺失),若勾选该项,则这10人的所有选择都不计入任何因素的频次统计。勾选该选项虽能保证样本量一致,但样本损失可能较大,应谨慎使用。

03
输出结果

设置完成,点击确定,结果窗口将输出分析结果表格。其中:

  • 个案摘要表:

展示参与分析的有效个案数量(响应数,即所有选项至少有一项选择了1)和缺失个案数(所有选项都选择了0)。用于估数据完整性,确认有多少个案被纳入分析。

  • 交叉表:

对于多重二分集,输出表中显示的类别名称来自于组中基本变量定义的变量标签;如果未定义变量标签,则使用变量名作为标签。
对于多重分类集,类别标签来自于组中第一个变量的值标签;如果组中其他变量存在第一个变量缺失的类别,需为这些缺失的类别定义值标签。

需要注意的是,多重响应集的统计是「响应数,而非「样本

  • 「计数」行表示该收入组中选择拥有该设备(选择1=是)的人数;

  • 「占 $OWN_DEVICE 的百分比」行表示该收入组中该设备被选中的次数占整个多重响应集总有效响应总数(该选项被选择的数量,即选择1=是)的比例。