INFS6023 Case Study Discussion|挑一个字段上主视图之前,先数三个数
🗺️ 头十分钟最容易做歪的那个决定
4,178 行的欧洲水电站台账摊开,15 列字段名一眼就扫完了。储能容量听着最能说明一座水电站值多少钱,抽水功率听着最能把机组角色分开,那这两列很自然就被拖去当地图的颜色和气泡大小。图画出来了,工具一声不吭,图例、标题、配色都在,讲稿顺着图也就写下来了。
麻烦在后面。展示只有 10 分钟,接着至少 20 分钟现场问答,有人问一句「你这张图里到底有多少座机组,丢掉的又是哪些」,答案得当场现算,而图早就定稿了。画图的时候没有任何一个环节会告诉你这张图覆盖了多少座电站,所以这个数得自己在动手之前就拿到手里。
🔢 先数两个数,它们决定这一列去哪张图
第一个数是这一列实际填了多少格。同一份数据字典列了 15 个字段,可用程度差得很开:
- 全表满格的七列:
id、name、installed_capacity_MW、type、country_code、lat、lon - 一路往下掉:
dam_height_m44.42%、avg_annual_generation_GWh37.17%、volume_Mm327.93% - 掉到最底下:
storage_capacity_MWh18.21%、pumping_MW2.49%
同一张表里,最满的一列和最空的一列差了四十倍。
接下来数第二个:填了值的这些行,分量有多重。storage_capacity_MWh 只有 761 座电站填了,占机组数的 18.21%,可这 761 座握着全部装机容量的 47.38%。换个说法,这一列在数量上很空,在容量上却接近一半。覆盖率低和缺的都是小角色,这两件事各算各的,谁也代表不了谁。所以看到 18.21% 就把这一列划掉,或者看到 47.38% 就把它拉上主图,两种做法都漏掉了另一个数。
两个数摆到一起,这一列该去哪张图就清楚了 💡






