摘要
本发明提供一种适用于分布式数据库的自动化运维方法及系统,所述方法包括:在分布式数据库各计算节点部署监测探针,实时采集各节点数据指标,动态计算各节点倾斜度;通过决策树引擎,构建倾斜特征库,基于决策树判断倾斜类型;根据自动诊断模块提供的信息,自动处置模块具备动态调优策略,根据数据倾斜方式对数据进行处置策略选择和策略匹配,在根据自动诊断模块提供的诊断数据,自动处置模块发起处置流程进行自动处置,处置结果回传至决策树引擎,进行机器学习。本发明在大规模并行计算中通过实时监测,自动诊断和动态调优等方式提前发现问题并通过自动化处置解决数据倾斜问题。