列与列的校验方式各不相同
| 列名 | 来源 | 校验方式 |
|---|---|---|
| 省 | 从原地址首段切出 | 用省级下拉框比对 |
| 市 | 第二段,直辖市留空 | 与省级联动的下拉框 |
| 区县 | 第三段 | 联动下拉框,允许区和县两种后缀 |
| 街道乡镇 | 区县之后到门牌之前的一节 | 名称核对,不用数字 |
| 详细地址 | 剩余部分原样保留 | 不做自动改写 |
| 邮编 | 单独一列 | 六位数字校验 |
| 行政区划代码 | 单独一列 | 与前三列交叉验证 |
五步走完,人工只需要处理少量条目
另存一份带日期的副本,后面所有改动都在副本上做,出问题能直接回到起点。
用固定分隔符先粗切,再人工修正切错的少数行,比逐行手填快得多。
省市区三段用下拉框限制取值,输入非法值会立刻变成醒目的错误标记。
两者各占一列,同时为空的行要单独挑出来看,这类条目往往是原始记录就不完整。
把校验失败的条目单独存一个表交人工,通过的直接入库,避免整表反复流转。
实际表格里反复出现的三种情况
分清楚了,返工量能降下来
记熟这几个数字,沟通时省很多解释
处理批量数据才会冒出来的问题
可以校验格式,但归属判断要分开做。企业的属地看登记机关,个人的看实际居住地,混在一起容易把开发区的条目判错。
暂时保留并标注已调整。历史数据还在用旧名,直接删会让旧条目全部变成无效值,反而不好处理。
建议拆到单独的备注列。括号里的内容多为楼层、园区名、联系人,混在标准地址行里会影响分级校验。
这是正常现象。邮编按投递范围划分,与行政边界并不严格重合,校验时不要用邮编去反推街道。
保留三份:原表、校验结果表、人工修正表。只交最终版会让后面的争议无从追溯。