数据质量

没有门牌编号系统的国家

对于在街道加门牌号地址格式中长大的人来说,这种格式感觉如此普遍,以至于很容易忘记它只是一种选择,而不是自然法则。相当多的国家和地区以不同的方式组织地址,任何假定世界上每个地址都符合“先街道后门牌号”模板的地理编码系统都会在这些地方失败,原因不是数据缺失,而是对地址形态的理解模型不适用于那个地方。

一些地区依赖街区加地块的系统,建筑物通过其所在的街区和该街区内的地块编号来标识,编号按建筑物的建造顺序分配,而不是沿街道依次编排。这意味着两栋相邻建筑的地块编号可能看起来毫不相关,因为编号反映的是历史而不是地理。另一些地方主要通过有名称的地标、城区或方位描述来标识位置,根本没有任何正式的编号方案,这在农村或非正式开发的地区尤为常见。

此外,替代编址系统也越来越普遍,它们通常基于网格或代码,专为没有传统街道地址的地方设计,为地图上的任意一点分配一个简短的字母数字或基于单词的代码,无论那里是否存在常规地址。这类系统在非正式居住区、偏远地区,或任何快速发展已经超过正式地址分配速度的地方尤其有用。

对于地理编码 API 来说,这意味着要把“没有有效的地址格式”视为一种真实且可预期的情况,而不是错误状态;也意味着逆地理编码需要合理地降级处理,返回可用的最接近的有意义描述,无论是所在地名称、地标还是更粗略的行政区域,而不是因为没有门牌号可报告就直接失败。

这也影响对置信度的理解。在没有正式门牌编号的地方,citydistrict 级别的精度并不代表数据质量差,它可能就是该位置真实存在的最精确结果。把这个结果与门牌编号密集的国家中 house 级别的结果相比并认为它较差,是在比较两种不同的实际情况,而不是同一事物的两种质量。

如果您面向全球用户开发,请用来自不使用常规编号的地方的地址来测试您的地址输入表单和验证逻辑,而不只是用您本国市场的格式。我们的逆地理编码端点会为一个坐标返回可用的最精确且如实的描述,在这些情况下,它可能合理地停留在所在地或地标级别,而不是编造一个并不存在的门牌号。