最新下载
热门教程
- 1
- 2
- 3
- 4
- 5
- 6
- 7
- 8
- 9
- 10
如何分析MySQL因redo log容量满引发的Write stall挂起现象?
时间:2026-09-03 20:51:49 编辑:袖梨 来源:一聚教程网
直接看SHOW ENGINE INNODB STATUSG的LOG段,对比Log sequence number与Last checkpoint at差值是否长期超innodb_redo_log_capacity(8.0.30+)或innodb_log_file_size×innodb_log_files_in_group(旧版)的70%,且pending log writes持续非零,即可确认redo log容量不足导致Write stall。
怎么看是不是redo log容量满导致的Write stall
直接看 SHOW ENGINE INNODB STATUSG 输出里的 LOG 段,重点盯三个值:Log sequence number、Log flushed up to、Last checkpoint at。用前两者差值算出「当前已用日志量」,再和 innodb_redo_log_capacity(8.0.30+)或 innodb_log_file_size × innodb_log_files_in_group(旧版)比——如果差值长期 > 70% 容量,且 pending log writes 持续非零,基本就是 redo log 跑不过 checkpoint,InnoDB 主动 stalling 写入了。
别被错误码误导:ERROR 1114 (HY000): The table is full 几乎从不来自 redo log 满,而是 tmpdir 满、ibdata1 无 autoextend 或长事务占 undo;真正由 redo log 压力引发的挂起,往往没报错,只有慢、卡、SHOW PROCESSLIST 卡住、写操作超时。
为什么改大 innodb_redo_log_capacity 后 MySQL 启不动
最常见原因是旧 ib_logfile* 文件没删干净,或者配置没生效。InnoDB 启动时会严格校验:文件大小必须和 innodb_redo_log_capacity 完全匹配,哪怕剩一个 ib_logfile0,也会报 InnoDB: Error: log file ib_logfile0 is of different size 并退出。
- 确认已执行
SET GLOBAL innodb_fast_shutdown = 0,再用SHUTDOWN命令关库(不是systemctl stop),确保 checkpoint 写完、脏页刷净 - 关库后检查进程是否彻底退出:
ps aux | grep mysqld应无残留;再确认datadir下所有ib_logfile*文件已被删除(路径用SELECT @@datadir查) - 配置必须加在
[mysqld]段下,不能写进[client];数值单位是字节,比如innodb_redo_log_capacity = 1073741824表示 1GB - 启动前检查 MySQL 用户对
datadir有写权限,否则无法生成新日志文件
扩容后要不要调其他参数
要,但只动两个关键项。redo log 变大后,checkpoint 频率天然下降,若不配套调整,可能拖慢崩溃恢复速度,或让 buffer pool 脏页堆积过多,间接影响性能。
innodb_max_dirty_pages_pct 建议从默认 75 降到 50–60,加快脏页刷出节奏;innodb_io_capacity 和 innodb_io_capacity_max 需按实际磁盘 IOPS 调整(如 NVMe 盘可设为 2000/4000),否则 page cleaner 跟不上写入节奏,照样卡 checkpoint。
别碰 innodb_flush_log_at_trx_commit 来“缓解压力”——它解决的是持久性与性能权衡,不是容量问题。设成 0 或 2 只会让数据更不安全,不减少 redo log 的实际占用压力。
磁盘空间够,但 redo log 还是写不进去
这是最容易忽略的点:redo log 默认放在 datadir 下(如 /var/lib/mysql/),而很多人只监控 /var 分区剩余空间,却没注意 datadir 实际挂载点可能是单独的逻辑卷或目录。用 df --output=source,target,pcent $(mysql -Nse "SELECT @@datadir") | tail -n1 精准查对应挂载点使用率,阈值建议设 85%,别等 95% 才报警——因为 redo log 是循环覆盖,文件大小不变,inotifywait 监听文件变化完全无效,只能靠定时 df 抽样。
另外,ib_logfile* 本身不能清理、不能轮转、不能 logrotate,能安全删的只有 slow_query_log_file 和 general_log_file(删前先 SET GLOBAL slow_query_log = OFF)。误删 ib_logfile 会导致启动失败,报错类似 InnoDB: The log sequence number in ibdata files does not match。