RAC二节点启动异常

来源:这里教程网 时间:2026-03-03 17:28:56 作者:

#背景: Linux6.8 双节点RAC 11.2.0.4 该库是使用DG从一个单节点的库迁移过来的,之前是备库,现在是单节点的库已经不用了,这套库改为主库。 该库有个历史遗留问题,两个节点使用的不是一个参数文件,本次操作是修改参数文件,并让两个节点同时使用该参数文件。 重启2节点时,2节点启动异常。 #问题现象: 重启2节点,在alter open的时候hang住,后来发现在mount的过程就已经存在问题,在trc文件中可看到相关日志。 节点2_alert: Completed: ALTER DATABASE MOUNT /* db agent *//* {2:51433:61354} */ ALTER DATABASE OPEN /* db agent *//* {2:51433:61354} */ Picked broadcast on commit scheme to generate SCNs         <------------到这就hang住了,一晚上都没动 节点2_trc: kjzdattdlm: Can not attach to DLM (LMON up=[TRUE], DB mounted=[FALSE]). 节点1_alert: Mon Feb 14 23:59:25 2022 Increasing number of real time LMS from 0 to 5 Mon Feb 14 23:59:39 2022 RMS0 (ospid: 94527) waits for event 'gc domain validation' for 0 secs. Tue Feb 15 00:03:12 2022 minact-scn: master found reconf/inst-rec before recscn scan old-inc#:42 new-inc#:42 其它日志文件(包括系统messages)中没发现具体提示信息。 #解决: 重启了节点1,节点2再启动就恢复正常。 #分析: 从现象上看,应该是双节点建的通信进程出现异常,并且告警日志中有很多process满的提示; 节点1在重启前,由于process已满,就杀掉了所有远程连接,但是该实例出现了一些异常,用户无法登录(除了sys),表无法查询(只有v$的视图可访问),业务都无法连接; 重启后一切都恢复了,节点2也正常启动了,怀疑是节点通信进程之前就hang住了,本次kill远程连接后,节点1的一些数据库进程也hang住了。 #注释: 本文主要记录改问题现象,另外还有一个问题需要记录一下: startup nomount pfile='/home/oracle/cluster_pfile.out'; create spfile='+DATADG/ORADATA/spfileodsdb_st.ora' from pfile='/home/oracle/cluster_pfile.out'; 该sql需要指定路径,尤其pfile路径; pfile不指定路径,spfile会变成空; spfile不指定,会创建本地dbs下; spfile只指定+DATADG,会创建一个新的spifle...文件(spfileodsdb_st.ora是个链接文件)。

相关推荐