本文使用美国消费者数据公司 Numerator 的 15 万个家庭面板数据,分析了 2018-2024 年平均零售支出按收入分组的差异。研究发现,使用家庭自我报告收入时,中高收入家庭在 2021 年中期开始支出显著高于低收入家庭;而使用邮政编码收入作为代理变量时,这种差异消失。研究结果表明,邮政编码收入与自我报告收入之间存在 35% 至 75% 的差异,突出了邮政编码收入作为家庭收入代理变量的局限性。
研究首先将 Numerator 数据构建的月度平均零售支出与人口普查局发布的零售和食品服务销售报告 (MARTS) 进行比较,以验证支出指标的可靠性。结果显示,Numerator 数据与官方数据高度吻合。
接着,研究根据自我报告收入将家庭分为低收入(年收入 0-60K 美元)、中等收入(年收入 60K-100K 美元)和高收入(年收入 100K 美元以上)三个群体,分析了各组别的平均月度家庭零售支出。结果显示,在疫情前时期,所有收入群体的支出增长趋势相似。然而,从 2021 年中期开始,高收入家庭的支出与低收入和中等收入家庭的支出出现分化。高收入家庭持续强劲支出,而低收入和中等收入家庭支出落后。
为了验证这一发现,研究进一步分析了按教育水平和模拟情景进行的支出变化。结果显示,低教育水平家庭的支出在 2021 年中期至 2023 年中期出现回落,而中等和高教育水平家庭则表现出支出韧性。
随后,研究使用美国社区调查 (ACS) 报告的邮政编码收入中位数将家庭重新分类,并比较了基于自我报告收入和邮政编码收入的支出模式。结果显示,使用邮政编码收入作为代理变量时,2021 年中期开始的支出分化消失,似乎所有收入群体的支出在疫情后时期都相似。
研究还分析了低收入、中等收入和高收入家庭在低、中、高收入邮政编码中的分布情况,发现存在较大差异。例如,2024 年,只有 59% 的低收入家庭居住在低收入邮政编码地区,而其余家庭实际上是中等收入和高收入家庭。
研究结论是,使用邮政编码收入作为家庭收入的代理变量会掩盖消费者行为的异质性,并导致对疫情后时期消费者行为变化的错误结论。研究呼吁在使用邮政编码收入时保持谨慎,并强调使用具有微观层面信息的替代数据集以更准确地衡量消费者异质性的重要性。