关于银行业智能化运维建设思考
时间:2019-04-18 14:08

  根据银监会编制的《中国银行业信息科技“十三五”发展规划监管指导意见》,其中“第九章 第三节 提高运维自动化水平,打造智能化运维体系”中明确提出对运维自动化智能化的指导意见:

  提高基础资源和应用部署的自动化水平,实现快速交付、动态调整、弹性部署,降低人工操作风险,自动化部署比例不低于75%。

  实现应用层面交易全流程、全节点监控全覆盖,结合应用系统交易特性及相关数据的分析对比,提升交易过程监控的智能化水平。强化容量管理,做好相关资源的动态规划,预防非计划性、突发性的容量瓶颈问题发生。

  强化运维、开发、安全、风险管理的信息共享和一体化协作,提升多方联动能力。加强运维大数据分析,利用运维大数据加强业务风险防控,探索利用运维大数据推动业务流程优化并支持业务创新。”

  在运维建设较前的银行业及互联网企业的建设经验中,平台化和智能化已成为运维体系发展的大趋势。以阿里经验为例,将运维发展分为五个阶段,分别为L1-脚本运维、L2-工具化运维、L3-平台化运维、L4-数据化运维、L5-智能运维。随着运维管理手段的推陈出新,逐渐地提升“系统”在执行和决策环节中的比重,从而不断降低人工参与度,如下图:

  在工具化运维阶段,传统运维建设模式基本以烟囱式为主,每个烟囱只为了解决单一的运维场景,如应用发布、系统监控、数据提取等。

  随着新技术不断在信息化建设中应用,带来了操作单元海量化、版本更新频繁化、监控粒度细致化等问题,烟囱式的建设模式已经难以满足运维发展的要求。

  随之而来,各个企业开始向着平台化、一体化的方向发展。如腾讯公司的思路是采用SOA和PaaS的技术架构模式,在PaaS内将各能力封装成各类原子平台并自动化,如配置平台(CMDB)、作业平台、容器平台、数据平台(AI)等,而后通过任务引擎将分散在个原子平台的功能,根据不同的场景重新连接成“串”或者“树状分支结构”实现全自动化、智能化。

  目前大多数银行的数据中心经过多年建设,尚处于从“工具化”向“平台化”过渡阶段,已经建立较为全面的IT架构基础平台,监控与流程均有一定的建设。如统一配置管理(HP UCMDB、Remady CMDB)、监控系统(Zabbix、HP OVO)、流程管理(BMC Remedy)、自动化控制(HP SA、BMC Bladelogic)等。

  而IT运维管理建设多采用产品采购模式,但随着积累的运维工具数量持续累加,繁杂的烟囱式应用使运维效率难以继续提升,其主要体现在以下几个方面:

  随着云计算、微服务在企业信息化建设中的大量应用,IT运维岗位正在从资源管理向应用运维、从运维保障向业务运营、从低价值劳动向高附加值服务转型发展。

  一定要充分利用数据,这里的数据指的是运维数据,如性能监控数据、运行日志数据、变更操作记录等等,尽可能的接入更多的种类的数据。

  利用这些数据,通过大数据和机器学习的技术,实现业务系统精准建设、系统资源精准配置、风险隐患精准控制,最终促进降本增效的目标。

  由于目前银行中运维管理建设还采用传统分散建设,各种烟囱式的系统之间数据存在数据重复、数据割裂、数据不准等问题,为运维数据化建设带来了极大的困难,具体体现在如下几个方面:

  为了解决分散的烟囱模式给运维管理建设过程中的问题,尽快实现平台化和数据化的目标,急需通过顶层设计,实现有效整合,建立一体化的综合管理平台,实现数据集中存储,统一分析,集中展示,高效处置。

  参考腾讯、阿里顶级互联网公司的建设经验,建设“平台层”来整合各烟囱式运维应用的功能和数据,从而构建一体化运维综合管理平台。基于一体化的运维平台建设遵循原则如下:

  运维管理建设是一个长期的过程,不能追求一蹴而就,需要分阶段稳步实现。参考运维技术的发展过程以及先进单位或互联网公司,演进路径大致如下:

  平台化:利用PaaS技术实现平台层,建设一体化平台的基础框架。并在平台层中将现已有的运维管理系统集成起来,从而实现一体化平台的基础框架。初期在平台层之上开发3~5个运维管理工具,作为整合型运维管理工具的试点场景,并持续不断的组装工具以满足运维管理的方方面面。

  数据化:在能力层内建设运维大数据能力,将散落在各运维管理系统的数据归集起来,形成运维数据仓库。继而在实际的运维管理工作中,探索数据挖掘场景,利用大数据计算和分析能力辅助管理决策,实现初阶AIOPS场景。

  智能化:正式将人工智能(AI)应用于运维管理中的工作场景中,利用上一阶段积累的数据样本和决策模型,通过机器学习手段解决提升“AI”在管理决策中的占比,实现根因定位、容量预测等高阶AIOPS场景。

  然而运维大数据技术经过近年的快速发展,相关技术的应用已经基本成熟,根据银行业的现实状况,可以在首期项目中就实现“运维大数据的归集”和“大数据应用场景的探索”,从而形成“两步走”的建设思路:

  “如何利用智能化手段提升运维管理”的研究浪潮已经掀起,部分互联网和银行已经进行了部分尝试并取得了一些效果。顺应时代发展趋势,展开智能化探索,才能主动赢得运维管理的未来。

  如果您想先简单了解蓝鲸研发运营一体化平台,或者企业规模较小但想用更为先进的自动化运维管理方式进行IT运维管理,推荐您先试用蓝鲸社区版。

  嘉为集团—— 成立于2001年,由嘉为科技、嘉为云帆、嘉为教育组成,于广州、深圳、北京、上海设有分公司,融IT服务和培训咨询于一体,为客户提供研运一体化解决方案、信息系统解决方案、运维支持、软件研发及培训教育服务。历经19年的发展和积累,嘉为已成为备受客户赞誉的行业翘楚。

  嘉为蓝鲸—— 嘉为科技十几载企业IT服务经验累积、基于腾讯蓝鲸智云技术体系打造的研发运营一体化解决方案,能够满足企业复杂多变的IT需求和场景,帮助客户落地真正自主可控的研发运营一体化平台,逐步实现自动化、数据化以及智能化的IT运营。返回搜狐,查看更多