跳过正文

文章

记一次 Oracle RAC 节点反复重启:从告警日志到 vmcore 定位 CPU 硬件故障

一次 Oracle RAC 节点反复重启故障复盘:从 alert 日志确认数据库不是重启源头,从 Linux 审计排除人工 reboot,从 kdump 和 vmcore-dmesg 定位 Fatal Machine Check,再结合 BMC/XCC 事件确认 CPU1/Socket1 硬件故障。

达梦数据库 TRUNCATE / DROP 后数据真的没了吗?一次数据文件残留实验验证

一次达梦数据库 TRUNCATE / DROP 数据文件残留实验:从 SQL 层面、数据字典、数据文件物理扫描和 10002 trace 多个角度验证数据是否真的被清理,并使用 dmdul 离线抽取工具成功恢复 TRUNCATE 后的测试数据。

记一次由 SQL 执行计划异常引发的高 CPU 与 cache buffers chains 竞争故障处理

一次 Oracle SQL 执行计划异常故障复盘:多个 w3wp.exe 会话集中执行 SQL_ID 4ja6bgs1su89c,child 21 选择低选择性 DEALID 索引,导致约 29.7 亿逻辑读、CPU 接近 100%、latch free 与 cache buffers chains 竞争。最终通过固定好计划、清理坏游标、创建复合索引并收集统计信息恢复稳定。

Oracle ADG 同步状态与延迟巡检 SQL SOP

一篇 Oracle ADG 巡检与故障判断 SOP,系统整理备库侧与主库侧常用 SQL,包含 v$database、v$managed_standby、v$dataguard_stats、v$archive_gap、v$archived_log、v$archive_dest_status 等视图的检查方法,并给出 archive gap、MRP 未启动、主库传输异常、应用慢和 RMAN 增量推进备库的处理流程。