











在尝试做个更轻量、更方便的工具,想让更多人能用上空间分析的方法,解决生活工作中的各种问题 —— 比如说,选址数据分析:开咖啡馆或奶茶店,有没有什么基本的选址原则?是应该去热门商圈扎堆内卷,还是去鲜有同行的社区拓荒?
没思路的时候,可以先做做市场调研,看看现状分布有没有什么特征。就拿北京做例子,利用高德地图数据,看看能有什么发现。
先做了几张咖啡馆、茶馆的热力图(核密度估计),用了100×100米的网格、1500米带宽。
茶馆的统计稍微有点复杂,与咖啡馆并列的茶馆热力图采用了广义茶馆的口径,包括两部分数据:传统茶馆、茶楼、茶苑,和以奶茶店为主的新式茶饮店。因为部分咖啡店也买奶茶,所以汇总时减去了与咖啡店的交集部分。


看大数,北京市域范围内咖啡馆一共6238处,核密度峰值 48.8 处/公顷;广义茶馆有5337处,峰值 39.4 处/公顷。总体上,咖啡馆略胜一筹。
空间分布上,咖啡和茶馆的差别蛮大的,咖啡馆的聚集程度显然更高。为了方便比较两张图的色带划分采用了相同的划分方式,以每公顷10、20、30、40处作为分割点。
以长安街、中轴线作为横纵坐标,将北京城分为四个象限,咖啡馆分布呈现高度聚集的趋势。
把传统茶馆和奶茶店拆开来看,店铺总数量分别为 2303 和 3529处,因为去重的原因,广义茶馆总数比二者相加少 500 处左右。传统茶馆和奶茶店的核密度峰值分别为 17.0 和 23.1 处/公顷,可见奶茶店已超越传统茶馆成为新主流。


为了观察细分特征,分别做了传统茶馆和新式茶饮店的热力图,因二者在数量上与咖啡馆与广义茶馆没法比,故采用了不同的色带分段标尺,与前两张图不具可比性。
总之,观察热力图的直观感受是,在五环内这个尺度上,咖啡馆明显更扎堆儿;茶馆,尤其是奶茶店则更多在社区中心小聚集。或者,用打比方的方式来说,咖啡馆的聚集中心像高耸的群峰形成的连绵山脉, 茶馆的聚集则更像半高不高的众多小山峰组成的高原与丘陵。
从热力图得到的直观感受到底准不准?可以用专业的空间分析方法——“莫兰指数”来量化验证下。
为了计算莫兰指数,需要为五环内的区域按照1公里间距创建渔网,每个网格1平方公里,总共划分出5476个网格。然后统计出每个格网内的咖啡馆、广义茶馆数量,之后就可以计算指数了。
全局莫兰指数(global Moran’s I)在-1到+1之间,为负表示离散(均匀分布),为正表示聚集模式(扎堆),0表示随机分布(泊松)。若置信度大于99%,z得分需大于2.58,p值需小于0.01。
表1:北京五环内咖啡馆、广义茶馆分布 全局莫兰指数 汇总表
| statistic_i | expected_i | z_score | 渐进p值 | 样本量 | 丢弃样本 | |
|---|---|---|---|---|---|---|
| 咖啡馆 | 0.47528 | -0.00018 | 1840.86628 | 0 | 5476 | 0 |
| 广义茶馆 | 0.31690 | -0.00018 | 1227.65623 | 0 | 5476 | 0 |
计算结果,五环内咖啡馆的全局莫兰指数为 0.475,广义茶馆为 0.317,两者均为高度显著的正空间自相关(扎堆儿聚集)。同时差值达到了 0.158,意味着咖啡馆比茶馆的聚集强度高出了 50% 的相对量级,证明在五环捏这个尺度上,咖啡馆的空间黏性(抱团强度)远超茶饮业态。
全局莫兰指数看总体,局部莫兰指数(Local Moran’s I)则能够分辨出区域内的热区和冷区都在哪里。局部莫兰指数将每个网格划分为不同的类型,代表不同含义。
局部莫兰指数同时会计算每个网格的 z得分,是衡量结果可信度的重要依据。


局部莫兰指数结果进一步验证了直觉猜测,咖啡馆与广义茶馆有着不同的空间聚集特征:
表2:北京五环内咖啡馆、广义茶馆分布 局部莫兰指数分析 汇总表
| 图例 | 咖啡馆 | 广义茶馆 | 差异解读 | |
|---|---|---|---|---|
| HH 数量 | 红色 | 361 | 451 | 茶馆的热点版图更广(多出 90 个网格) |
| HL 数量 | 粉色 | 22 | 70 | 茶馆更擅长“单兵作战”(多出约50个孤单英雄) |
| LH 数量 | 浅蓝 | 126 | 105 | 咖啡馆存在更多“空白洼地” |
| LL 数量 | 深蓝 | 2092 | 1826 | 咖啡馆在五环内的渗透盲区更大 |
| Z 均值 (HH) | — | 5.5 | 4.3 | 咖啡馆的热点“热度”更极致 |
| Z 中值 (HH) | — | 4.1 | 3.7 | 同样支持咖啡馆头部强度更高 |
从数据回到日常,为什么咖啡馆会比茶馆更喜欢扎堆儿?
要回答这个问题,需要先回答人们为什么去咖啡馆或茶馆。咖啡或茶,如果仅仅为了这口液体,在家或办公室休息区几分钟就能搞定。之所以专门跑一趟,更多是因为其他的原因:
咖啡馆、传统茶馆、奶茶店三种业态,每种场所都有自己的独特氛围。咖啡馆和传统茶馆都有比较强的社交属性,尤其咖啡馆,可以完美适配上述三个需求。真正的传统茶馆,比如老舍先生笔下的那个《茶馆》,大概也可以适配各种场景,但目前数据中的茶苑、茶社、茶房大多一壶茶上百元,社交属性虽然还在,但已经收窄到高端局之类的小圈子了。至于奶茶店,大概是其中社交属性最弱的那个,大多数人只作为接头地点,偶尔等个人。这样看来,xx馆、xx店这样的习惯叫法,似乎巧妙的点出了不同场所在社交属性上的差别。
因此,咖啡馆更喜欢扎堆、奶茶店更青睐社区中心式的广覆盖,决定因素可能正是不同的商业模式和社交属性。作为强群体社交载体的咖啡馆,核心产品是“咖啡+社交空间”,选址上离不开良好的环境氛围;而社交属性相对较弱,更依赖外卖模式的奶茶店,核心产品是“让人上瘾的奶茶”,对周边环境没有太多要求,你点的奶茶很可能来自一个地下大排档或者夹在一排五金店中间的一个小铺面,这也没什么所谓,自然会有更多HL网格的孤勇者。
关于开篇的问题,基于五环内店铺数据的空间分析,又啰嗦了半天,终于能给出个基本原则了:
当然,这只是基于现状空间分布的分析,实际选址还要考虑租金、客群、竞争强度等因素。
想起很多年前,漫咖啡的选址策略就很“孤胆英雄”,公园门口、大学校区内,在甚至算不上商圈的地方开了很多。如今经历多轮大规模收缩后,活下来的大多还是商圈内的门店,也算是一个例证吧。
再回到我的出发点,你在生活中有什么涉及地点选择之类问题的困惑吗?也许空间分析方法能给出些有价值的建议。如果你也对轻量、低门槛的空间分析工具这个事儿感兴趣,欢迎留言。
此内容由惯性聚合(RSS阅读器)自动聚合整理,仅供阅读参考。 原文来自 — 版权归原作者所有。