- · 《治理研究》刊物宗旨[08/03]
- · 《治理研究》征稿要求[08/03]
- · 《治理研究》投稿方式[08/03]
- · 《治理研究》数据库收录[08/03]
- · 《治理研究》栏目设置[08/03]
电力客户基础服务信息治理研究与应用(2)
作者:网站采编关键词:
摘要:对于客户地址信息改造:①进行数模调整,在申请用电地址表中新增地标(BUILDING)1 个字段;批量客户分配信息表中新增地标(BUILDING)1 个字段;用电地
对于客户地址信息改造:①进行数模调整,在申请用电地址表中新增地标(BUILDING)1 个字段;批量客户分配信息表中新增地标(BUILDING)1 个字段;用电地址表中新增地标(BUILDING)1 个字段;②进行前端程序录入调整,业扩新装增容受理环节负责收集该信息,增加地标填写项,增加具体地址相关字段下拉选择;在新装、变更用电业务受理环节增加具体地址和地标的非空限制,保存在申请用电地址、批量客户分配信息表中,待归档后复制到用电地址表中;新增维护具体地址及地标功能;③增加校验规则,业扩新装增容受理环节地址完整性及规范性校验;变更用电业务受理地址完整性及规范性校验。
对于客户名称信息改造,增加新装增容受理环节客户名称规范性校验以及完整性校验,增加变更用电受理环节客户名称规范性校验以及完整性校验,增加维护联系信息环节客户名称规范性校验以及完整性校验。
3 应用实现
本节以标准地址库建设应用为例,分析客户服务基础信息应用实现。
3.1 地址库建设准备工作
首先,根据国家统计局发布《统计用区划代码》和《统计用城乡划分代码》确定代码层级。根据《统计用区划代码》,将第一层为省级码段,由左起1、2 位表示;第二层为地级码段,由左起3、4位表示;第三层为县级码段,由左起5、6 位表示;第四层为乡级码段,由左起7~9 位表示;第五层为村级码段,由左起10~12 位表示,如图1 所示。
图1 统计用区划代码
根据《统计用城乡划分代码》由12 位统计用区划代码和3 位城乡分类代码表示,其中第13~15 位所表示的城乡分类为:111表示主城区;112 表示城乡接合区;121 表示镇中心区;122 表示镇乡接合区;123 表示特殊区域;210 表示乡中心区;220 表示村庄。在判别城乡时,第13 位为1 表示城镇,第13 位为2 表示乡村。由此可以从《统计用城乡划分代码》中观察到哪些村级单位属于城镇,哪些村级单位属于乡村。
图2 统计用城乡划分代码
随后,准备国家统计局地址标准代码来填充层级内响应空格。统计用区划代码和城乡划分代码说明:统计用区划代码和城乡划分代码所涉及的数据,是国家统计局开展统计调查所涉及的区划范围,未包括我国台湾省、香港特别行政区、澳门特别行政区。
最后,进行地名地址库初始化。利用国家统计局统计用区划代码,使用面向对象的地址建模思路初始生成,建立和维护标准库地址库。
3.2 客户用电地址清洗
从省营销业务系统中抽取客户档案、历史 联络数据,通过数据清洗,建立符合标准的客户联系地址库。
首先将地址字段进行特征字分词处理形成国家字段、省字段、市字段、区县字段、街道镇乡村字段、道路字段,通过标准库准备好的地址层级码段进行字段匹配得到0、1 地址表示,随后通过设定好的规则解析完成原始地址分字段处理。
解析过程分为结构化处理和补全处理。其中结构化处理是将地址记录处理成多个层次分明、独立的地址段,提供各地址段的单独修改和跟踪。补全处理是对结构化地址缺少部分的补充,有“系统自动补全+人工核查发布”和“人工批量补全”两种方式。系统自动对地址的规范性处理过程的流程:①对原始地址经过中文分词处理后将地址切割成标准段落;②根据标准地址将切割后的地址段组合成层级关系的地址树;③根据标准地名上下级关系对缺少部分进行补充。
3.3 人工处理
首先进行入库审核。经过数据清洗后,对最终入库的标准地址进行最后审核和确认的环节,而这也是最后检查确认的重要步骤。通过审核界面中的地址树,可以轻松地完成从上到下的地址遍历,方便审核工作。
其次进行地址采录修正。对于经过数据清洗后,根据算法和分析处理,以及自动补缺处理后,仍然无法通过地址入库编码的地址记录,且使用8 段分拆法无法放进的内容进行人工采录和修正工作,修正时可按抄表段进行分段导出,以便人工修正。
[1] 倪云珂,赵定玮,周益.基础信息的标准化和规范化在智能电网建设中的作用[J].湖北农机化,2020(14):11-12.
[2] 鲍政宇.电力信息通信在建设智能电网中的基础作用[J].数字通信世界,2017(4):118-119.
1 系统现状营销业务应用系统虽已运行多年,问题数据依然存在。以客户基础信息为主的营销基础数据不准确、不完整,导致营销系统中统计出来的信息失准,不能正确反映现场的实际情况,影响到下一步工作开展,进而无法正常开展营销业务日常管理工作,日积月累,最终影响公司的各类经营管理指标。客户服务基础信息包括客户用电地址信息、客户名称、证件信息和联系方式。然而在营销业务应用系统当前的基础服务数据中一个用电用户对应一条用户信息,且信息都是以一个完整字符串的形式来存储,没有一个统一的信息规范,也没有规范信息。信息规范的缺失导致操作人员的录入随意性大大增加。在录入地址等基础信息时会使用大量的描述性词语,这不但会在理解上产生偏差,而且在系统进行信息查询时,也无法达到理想的效果。2 建设思路2.1 国网数据治理需求分析根据要求营销业务应用系统的客户信息中需要包含“具体地址”“地标”两个数据项。具体地址按照镇(乡、村、街道)、街(路、巷、弄、条、里、胡同)、号楼(栋、幢)、门牌号进行规范。因此,可在原有数据库申请用电地址、批量客户分配信息和用电地址表中新增地标(BUILDING)1 个字段。同时,新增具体地址代码对照表,规范镇(乡、村、街道)、街(路、巷、弄、条、里、胡同)、号楼(栋、幢)、门牌号等数据录入,以CODE 形式集存在用电地址表的相关字段中。根据要求营销业务应用系统需要进一步规范固定电话号码和移动电话号码,固定电话号码格式包括区号及电话号码,中间以“-”号进行分隔,例:区号-固定电话号码,0951-X。移动电话号码格式必须首位为1 且为11 位纯数字。因此,将原有联系信息填写固定电话选项改为“文本框”+“-”+“文本框”的形式,用户手动填写电话区号及固定电话号码,系统将区号、“-”符号与固定电话号拼写在一起,形成“区号-固定电话号码”的联系方式。并设定检验规则:电话号码必须为纯数字,固话区号3~4 位,首位为0;移动电话号码11 位,首位?问题数据校验开展①建立自动检验系统。由系统根据相关规范制定校验规则,自动校验客户服务基础信息,生成可自动校正的不符合数据清单,提交营销部相关人员审核确认后,自动校验更正不规范信息;②进行人工核查校正。各部门人员按照信息收集工作流程和作业步骤,根据户名、联系方式、用电地址、客户城乡标识、低压客户所属配变信息校验规则收集、核对、完善、修改不规范客户信息,对于校验不通过清单信息通过人工辅助核查流程完善客户基础信息。具体地,对于客户名称数据校验。首先按照户号、供电单位、户名、抄表段导出客户信息,在系统外完成清洗后进行自动类型识别,形成正确客户名称清单,形成错误类型为“不是汉字半角”核查清单,形成“出现非汉字文字字符核查”清单。随后对以上列出清单进行人工核查生成正确的客户名称清单并回写生产库。针对客户联系方式,首先按照户号、供电单位、户名、抄表段、联系人、联系电话导出客户信息,在系统外完成清洗后进行自动类型识别,形成正确客户联系方式清单,形成错误类型为“移动电话号码位数不为11 位及首位不为1”核查清单,形成“非3 或4 位区号”+“7 或8 位电话号码”核查清单,形成“同一电话栏同时存在一个以上电话号码的”核查清单,形成“存在除阿拉伯数字以外的其他字符,第5 位扣除‘-’”核查清单。随后对以上列出清单进行人工核查生成正确的客户名称清单并回写生产库。针对客户用电地址,按地市/抄表段以EXCEL 的方式导出,使用地址特征字分词工具分析分解元数据形成国家字段、省字段、市字段、区县字段、街道镇乡村字段、道路字段、社区字段和其他字段,随后利用算法进行自动清洗和补全处理。经过以上地址表示、地址解析以及地址还原后生成符合普查需要的规范地?客户服务信息系统改造工作客户服务基础信息系统改造过程中,为控制通过营销系统新装、客户资料变更等业务引起新客户基础服务信息的差错,在做存量数据治理时,需同步完成营销系统的改造工作,控制好业务源头,保证新增、变更数据的数据标准。针对客户地址、联系信息、客户名称、证件信息、城乡类别均需进行数模调整、前端录入调整、增加校验规则工作。对于客户地址信息改造:①进行数模调整,在申请用电地址表中新增地标(BUILDING)1 个字段;批量客户分配信息表中新增地标(BUILDING)1 个字段;用电地址表中新增地标(BUILDING)1 个字段;②进行前端程序录入调整,业扩新装增容受理环节负责收集该信息,增加地标填写项,增加具体地址相关字段下拉选择;在新装、变更用电业务受理环节增加具体地址和地标的非空限制,保存在申请用电地址、批量客户分配信息表中,待归档后复制到用电地址表中;新增维护具体地址及地标功能;③增加校验规则,业扩新装增容受理环节地址完整性及规范性校验;变更用电业务受理地址完整性及规范性校验。对于客户名称信息改造,增加新装增容受理环节客户名称规范性校验以及完整性校验,增加变更用电受理环节客户名称规范性校验以及完整性校验,增加维护联系信息环节客户名称规范性校验以及完整性校验。3 应用实现本节以标准地址库建设应用为例,分析客户服务基础信息应用实现 地址库建设准备工作首先,根据国家统计局发布《统计用区划代码》和《统计用城乡划分代码》确定代码层级。根据《统计用区划代码》,将第一层为省级码段,由左起1、2 位表示;第二层为地级码段,由左起3、4位表示;第三层为县级码段,由左起5、6 位表示;第四层为乡级码段,由左起7~9 位表示;第五层为村级码段,由左起10~12 位表示,如图1 所示。图1 统计用区划代码根据《统计用城乡划分代码》由12 位统计用区划代码和3 位城乡分类代码表示,其中第13~15 位所表示的城乡分类为:111表示主城区;112 表示城乡接合区;121 表示镇中心区;122 表示镇乡接合区;123 表示特殊区域;210 表示乡中心区;220 表示村庄。在判别城乡时,第13 位为1 表示城镇,第13 位为2 表示乡村。由此可以从《统计用城乡划分代码》中观察到哪些村级单位属于城镇,哪些村级单位属于乡村。图2 统计用城乡划分代码随后,准备国家统计局地址标准代码来填充层级内响应空格。统计用区划代码和城乡划分代码说明:统计用区划代码和城乡划分代码所涉及的数据,是国家统计局开展统计调查所涉及的区划范围,未包括我国台湾省、香港特别行政区、澳门特别行政区。最后,进行地名地址库初始化。利用国家统计局统计用区划代码,使用面向对象的地址建模思路初始生成,建立和维护标准库地址库 客户用电地址清洗从省营销业务系统中抽取客户档案、历史 联络数据,通过数据清洗,建立符合标准的客户联系地址库。首先将地址字段进行特征字分词处理形成国家字段、省字段、市字段、区县字段、街道镇乡村字段、道路字段,通过标准库准备好的地址层级码段进行字段匹配得到0、1 地址表示,随后通过设定好的规则解析完成原始地址分字段处理。解析过程分为结构化处理和补全处理。其中结构化处理是将地址记录处理成多个层次分明、独立的地址段,提供各地址段的单独修改和跟踪。补全处理是对结构化地址缺少部分的补充,有“系统自动补全+人工核查发布”和“人工批量补全”两种方式。系统自动对地址的规范性处理过程的流程:①对原始地址经过中文分词处理后将地址切割成标准段落;②根据标准地址将切割后的地址段组合成层级关系的地址树;③根据标准地名上下级关系对缺少部分进行补充 人工处理首先进行入库审核。经过数据清洗后,对最终入库的标准地址进行最后审核和确认的环节,而这也是最后检查确认的重要步骤。通过审核界面中的地址树,可以轻松地完成从上到下的地址遍历,方便审核工作。其次进行地址采录修正。对于经过数据清洗后,根据算法和分析处理,以及自动补缺处理后,仍然无法通过地址入库编码的地址记录,且使用8 段分拆法无法放进的内容进行人工采录和修正工作,修正时可按抄表段进行分段导出,以便人工修正。参考文献[1] 倪云珂,赵定玮,周益.基础信息的标准化和规范化在智能电网建设中的作用[J].湖北农机化,2020(14):11-12.[2] 鲍政宇.电力信息通信在建设智能电网中的基础作用[J].数字通信世界,2017(4):118-119.
文章来源:《治理研究》 网址: http://www.zlyjzz.cn/qikandaodu/2021/0126/993.html