【故障公告】再次出现数据库 CPU 居高不下的问题以及找到了最可能的原因

日期：2021-06-01 栏目：程序人生浏览：次

非常非常抱歉，今天上午的故障又一次给大家带来麻烦了，再次恳请大家的谅解。

在昨天升级阿里云 RDS SQL Server 实例的配置后（详见昨天的博文），万万没有想到，今天上午更高配置的阿里云 RDS 实例依然出现了 CPU 居高不下的问题。

在数据库 CPU 高的情况下，有时对访问速度影响不大，有时巨慢无边，在今天上午的故障期间，我们通过2次主备切换才恢复了正常。

下午，我们我们调整了服务器的部署，用了更多服务器进行混合部署（docker-compose与docker swarm），情况有了明显改善。

【故障公告】再次出现数据库 CPU 居高不下的问题以及找到了最可能的原因

但是，15:15 开始数据库 CPU 又飚了上去，但访问速度没有受到明显影响，一致坚持到 16:50 左右，在扛不住的时候，我们再次通过主备切换恢复了正常。

这次恢复正常后，我们才突然想到，数据库每天一大早会跑一个整理索引碎片的任务，是不是升级后这个任务不能正常执行了？打开 SSMS 一看，果然是。

昨天因为升级 SQL Server 后重建备库，整理索引碎片任务失败了。

Date 9/5/2019 06:30:00 Log Job History (Reorganize Index) Step ID 1 Server SD39184A Job Name Reorganize Index Step Name Reorganize Index Duration 00:00:00 Sql Severity 14 Sql Message ID 927 Message Executed as user: xxx. Database 'xxx' cannot be opened. It is in the middle of a restore. [SQLSTATE 42000] (Error 927). The step failed.

转载注明出处：https://www.heiqu.com/wpfdpy.html

【故障公告】再次出现数据库 CPU 居高不下的问题以及找到了最可能的原因

相关推荐