描述性统计助手
地图帮2026-03-10
描述性统计助手
一键生成每列的完整统计概要:均值、中位数、标准差、偏度、峰度、四分位数、缺失率,全都算好,一张表看完。拿到数据想先知道"这些数字大概什么水平",用它。
准备至少一列数值数据
- 一份 Excel 或 CSV 文件,至少包含 1 列数值数据
四步拿到统计表
导入数据。打开数据魔方,点顶部「数据分析」标签页,进「描述性统计助手」卡片,导入数据文件。系统自动识别数值列。
选择统计列。在参数面板里勾选要统计的列,可以多选,系统批量算出每一列的统计值。「置信水平」参数默认 0.95(95%),不确定含义就保持默认。
查看结果。点「开始分析」,结果是一张统计表,每行是一列数据:
指标 说明(用人话) 数据量 一共多少行 有效值 多少行不是空的 缺失值 / 缺失率 多少行是空的,占百分之几 均值 所有数字加起来除以个数,平均水平 中位数 从小到大排在正中间的那个,比均值更能反映"正常水平",不会被极端值拉偏 众数 出现次数最多的那个值 标准差 数据波动大不大,越大越分散 方差 标准差的平方,意义差不多,只是量纲不同 最小值 / 最大值 极端值 25% / 50% / 75% 分位 数据从小到大排,各位置上的值(50% 分位就是中位数) 极差 最大值减最小值 变异系数 标准差除以均值,用来比较不同量级数据的波动程度。"销售额"标准差 100 万和"订单数"标准差 50 没法直接比,但变异系数可以 偏度 数据是否偏向一边。> 0 右边有长尾(少数大值拉高均值),< 0 左边有长尾 峰度 数据是否特别集中。越大数据越"尖",尾部越厚(极端值越多) 不用记住这些名词,重点关心三件事:
- 缺失率高不高:超过 30% 要留意
- 均值和中位数差多少:差距大说明有极端值
- 标准差大不大:太大说明数据很分散,分析结果可能不稳定
导出结果。点「导出」把统计表保存为 Excel,发给同事或贴进报告。
偏度和峰度看不懂可以直接忽略
这两个指标是给统计专业人士看的,不确定意义就跳过,不影响做判断。
确认统计表拿到手了
统计表里每列都有均值、中位数、标准差等指标,说明统计完成。
