惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

爱范儿
爱范儿
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
WordPress大学
WordPress大学
Y
Y Combinator Blog
I
InfoQ
美团技术团队
罗磊的独立博客
B
Blog RSS Feed
GbyAI
GbyAI
小众软件
小众软件
IT之家
IT之家
Engineering at Meta
Engineering at Meta
Blog — PlanetScale
Blog — PlanetScale
V
V2EX
Last Week in AI
Last Week in AI
酷 壳 – CoolShell
酷 壳 – CoolShell
Jina AI
Jina AI
MyScale Blog
MyScale Blog
博客园 - 聂微东
Microsoft Security Blog
Microsoft Security Blog
博客园 - 【当耐特】
Apple Machine Learning Research
Apple Machine Learning Research
The GitHub Blog
The GitHub Blog
T
The Blog of Author Tim Ferriss

博客园 - 石云华

gpnptool手动修改GPnP-Profile信息,解决GI集群因心跳配置异常而无法启动的问题 hugePage配置不当,浪费太多物理内存,内存不足导致集群重启 terminating the instance due to error 472,故障原因分析 Exadata存储节点的RPM数据库损坏 duplicate方式搭建DataGuard时,报ORA-19563: header validation failed for file错误 Oracle 19.25 RAC 业务 IP 平滑变更实操 EM13c监控Exadata,提示Agent Unreachable Exadata环境中的CVE-2026-31431漏洞说明 /var/log/message日志中的“megaraid_sas 0000:65:00.0: Application firmware crash dump mode set success”信息 DBCA后,只能启动一个实例,都是rp_filter惹的祸 分析Exadata写入慢的性能故障 Exadata更换Infiniband交换机 数据库集群中的bond1接口出现网络丢包 EM13告警:Metric evaluation error start - oracle.sysman.emSDK.agent.fetchlet.exception.FetchletException: Permission denied(publickey,password) Exadata,更换完思科交换机后,与上联交换机无法通信 Exadata更换计算节点的硬盘 Exalogic虚拟机的网络无法启动,提示Device has different MAC address than expected 单个ASM磁盘free空间为0,导致rebalance时提示“ASM磁盘组空间耗尽(ORA-15041)” Exadata的思科交换机,重启后进入到了rommon模式 SYSAUX表空间中的SYS.EXP_HEAD$表,占用大量空间 回收站存在大量对象,导致Insert into...select语句夯住 用dg broker执行switchover时,报0RA-01017 增量备份恢复的方式修改缺失归档的DataGuard 未设置min_free_kbytes参数,导致操作系统进行页缓存回收时,整个操作系统夯住 Exadata数据库性能异常,备份进程卡住 MySQL 5.7版本,搭建一个两主一从的多源主从复制环境 恢复某个数据文件不适当,导致DataGuard无法open数据库 Exadata计算节点的内存出现故障,导致CPU耗尽 Bug 34885986 - Flashback log file was not reused even if db_flashback_retention_target is passed
PX并行进程产生大量的trace日志,导致文件系统撑爆
石云华 · 2026-01-08 · via 博客园 - 石云华

1、故障概述

    客户的一套ORACLE数据库,版本为19.23,由于PX并行进程产生大量的trace日志,导致文件系统被撑爆。本文主要分析为什么会产生如此大的trace日志文件,并给出相应的解决方案。

2、故障分析

    2.1 文件系统被撑爆时,客户检查了该文件系统的空间占用情况,发现是ORACLE数据库的trace文件占用空间最大。

ef2c27356b5ba5455f9be9459adc2fb7

 排在最前面的那些trace文件都是PX并行进程所产生。

    2.2 查看px并行进程所产生的trace文件内容。几乎全是如下类似的重复内容。

2025-11-29 03:10:40.825*:PX_Messaging:kxfp.c@5364:kxfprienq():
Sending to server=2.50 qref=0x5205a34d8 msg=0xcdcd1e4f8 len=16368 st=2
mty=6 (DTA) enq#=55(KXFQ ROUND ROBIN TQ) flg=0x2 state=10011
qref=0x5205a34d8 qrser=769987074 qrseq=5 mty=55 fmh=1
2025-11-29 03:10:40.826*:PX_Messaging:kxfp.c@5364:kxfprienq():
Sending to server=2.51 qref=0x61c30c6d0 msg=0xcd99170f0 len=16368 st=2
mty=6 (DTA) enq#=55(KXFQ ROUND ROBIN TQ) flg=0x2 state=10011
qref=0x61c30c6d0 qrser=769987074 qrseq=10 mty=55 fmh=1
2025-11-29 03:10:40.827*:PX_Messaging:kxfp.c@5364:kxfprienq():
Sending to server=2.52 qref=0x3c01a4a60 msg=0xcd7523040 len=16368 st=2
mty=6 (DTA) enq#=55(KXFQ ROUND ROBIN TQ) flg=0x2 state=10011
qref=0x3c01a4a60 qrser=769987074 qrseq=8 mty=55 fmh=1
2025-11-29 03:10:40.828*:PX_Messaging:kxfp.c@5364:kxfprienq():
Sending to server=2.53 qref=0x52059cd18 msg=0xcd8382fd0 len=16362 st=2
mty=6 (DTA) enq#=55(KXFQ ROUND ROBIN TQ) flg=0x2 state=10011
qref=0x52059cd18 qrser=769987074 qrseq=7 mty=55 fmh=1
2025-11-29 03:10:40.830*:PX_Messaging:kxfp.c@5364:kxfprienq():
Sending to server=2.53 qref=0x52059cd18 msg=0xcdf95ff48 len=16368 st=2
mty=6 (DTA) enq#=55(KXFQ ROUND ROBIN TQ) flg=0x2 state=10011
qref=0x52059cd18 qrser=769987074 qrseq=8 mty=55 fmh=1

    2.3看到trace文件中全是这种信息,基本上可以诊断是某个BUG所致了。果然找到After 19.18 Jan RU Patching, Large amount of PX related trace files are generated.(KB127087)这篇文章。所文章所述,具体的BUG为(33369166),安装相应的补丁即可解决。

3、解决方案

安装补丁33369166。

如果近期没有安装补丁的计划,也可以手动清空这些trace文件,释放空间。