热图 / 相关性热图
数据只在您的浏览器里处理:文件在本机读取和计算,不会上传到任何服务器,关闭页面即清除。免登录、免费使用。
每个格子是两个变量的相关系数:红色为正相关、蓝色为负相关,颜色越深越强;对角线恒为 1。
星号基于校正后的 P 值:* < 0.05,** < 0.01,*** < 0.001;同时检验很多对变量时请看校正 P,不要只看原始 P。
Pearson 衡量线性关系,对离群值敏感;Spearman 与 Kendall 基于秩,适合非正态或有离群值的数据。
聚类排序把相关模式相似的变量排在一起,便于发现变量模块;相关不等于因果,样本量小时系数波动很大。
P 值:Pearson 为精确 t 分布检验,Spearman 为 t 近似,Kendall 为 tau-b(与 scipy.stats 一致);成对删除缺失值;多重检验校正对每对变量只计一次(Benjamini & Hochberg 1995, J R Stat Soc B 57:289–300)。
最多 200 个变量;超过 25 个变量时只显示星号。