MySQL 主从复制与高可用、Redis 集群搭建、数据备份恢复、性能调优与慢查询治理
某电商平台数据库为单机 MySQL 5.7,一次主库硬件故障导致宕机 4 小时,直接损失超百万。需搭建高可用架构,实现自动故障切换,RTO < 30 秒。
搭建 1 主 2 从 + MHA(Master High Availability)Manager 架构。MHA 监控主库状态,故障时自动选最优从库提升为主库,VIP 自动漂移。同时配置半同步复制减少数据丢失风险。
某社交 APP 缓存层原来使用单机 Redis(32GB 内存),随着用户增长,内存即将写满且单机 QPS 已达瓶颈(8 万 QPS)。需要搭建 Redis Cluster 实现水平扩容。
搭建 6 节点 Redis Cluster(3 主 3 从),每节点 16GB 内存,总容量 48GB。数据按 16384 个 Slot 均匀分布。后续业务增长时在线添加节点、迁移 Slot,无需停服。
某订单系统的订单列表查询接口响应时间从 200ms 逐渐恶化到 8s,监控显示数据库 CPU 长期 >85%。慢查询日志显示一个关联 4 张表的查询扫描了 200 万行。
开启 slow_query_log 定位慢 SQL → 使用 EXPLAIN 分析执行计划 → 发现缺失复合索引导致全表扫描 → 创建覆盖索引 → 优化 SQL 避免 SELECT * → 响应时间降至 80ms。