一篇 Oracle 19c RAC 到单实例 ADG 的完整部署实战:从 FORCE LOGGING、双 thread SRL、静态监听和网络认证开始,通过 RMAN Active Duplicate 构建文件系统备库,再配置 ASYNC Redo Apply、Active Data Guard,并补充安全的归档清理脚本。
·49491 字·233 分钟
一次达梦 DM8 内存与排序空间故障实战:表面是 -20011 缓冲区不足和 -544 排序空间不足,实际排查发现主机和 BUFFER 并未耗尽,真正值得关注的是报表过程中的大排序、动态 SQL、DBMS_OUTPUT、字面量拼接、重复执行和无必要去重。
从执行计划三元组、access/filter、CSCN2、SSEK2、BLKUP2 等基础开始,结合 EXPLAIN、AUTOTRACE 和 ET,用多组 DM8 实测案例分析扫描、回表、聚合、连接、排序和集合运算。
一次 Oracle 11g RAC 故障复盘:表面是连接数耗尽,实际根因是高并发 UPDATE 触发行级 Trigger,Trigger 双重循环中的 DELETE 对近 300 万行表反复全表扫描,拖长事务持锁时间,最终放大 TX 行锁并耗尽 Session。
一次 Oracle RAC RMAN 与 NetBackup 联合故障处理:从 Status 6 追到 datafile 264 固定块 I/O 读取失败,迁移故障 extent 后生成救援 Level 0 backupset,将数据文件恢复到新的 ASM 文件,并完成物理、逻辑及 SBT 单文件备份验证。
一次达梦 DBLINK 异构数据库实战:从 Oracle OCI、MySQL ODBC、PostgreSQL psqlODBC 到 DM LINK 查询验证,解决 glibc、驱动兼容、字符集和数据类型问题,并用于迁移后的快速数据核对。
dmtop 是一个面向达梦 DM8 的轻量实时性能诊断工具,用一个终端界面串联操作系统指标、数据库负载、Linux TID、数据库 SID、当前 SQL、执行计划和锁阻塞链,帮助 DBA 更快完成故障现场定位。
一次 Oracle RAC 节点反复重启故障复盘:从 alert 日志确认数据库不是重启源头,从 Linux 审计排除人工 reboot,从 kdump 和 vmcore-dmesg 定位 Fatal Machine Check,再结合 BMC/XCC 事件确认 CPU1/Socket1 硬件故障。
一次达梦数据库 TRUNCATE / DROP 数据文件残留实验:从 SQL 层面、数据字典、数据文件物理扫描和 10002 trace 多个角度验证数据是否真的被清理,并使用 dmdul 离线抽取工具成功恢复 TRUNCATE 后的测试数据。
一次 Oracle SQL 执行计划异常故障复盘:多个 w3wp.exe 会话集中执行 SQL_ID 4ja6bgs1su89c,child 21 选择低选择性 DEALID 索引,导致约 29.7 亿逻辑读、CPU 接近 100%、latch free 与 cache buffers chains 竞争。最终通过固定好计划、清理坏游标、创建复合索引并收集统计信息恢复稳定。