从"能用"到"卡"通常有迹可循。本文给出一套从客户端到数据库的分层排查方法,以及最常见的五个性能瓶颈。
系统上线只是开始,运维决定能用多久。本文给出备份策略、监控指标、应急预案的实用建议。
该跑的报表没生成、该同步的数据没同步。本文按触发、调度、执行、结果四个环节排查定时任务问题。
数据一直增长,系统会越来越慢。本文说明哪些数据可以归档、归档方式与保留策略的制定方法。
系统显示的时间比实际差几小时,或者跨天统计出错。本文说明时区、服务器时间、业务日历三类问题。
备份失败往往到需要恢复时才发现。本文说明备份失败的常见原因、验证方法,以及一套可靠的备份策略。