一次现场故障处理的总结.docVIP

  • 9
  • 0
  • 约7.48千字
  • 约 8页
  • 2019-08-11 发布于江西
  • 举报
一次实际现场故障处理的总结 2011年7月27日,北京西便门邮政一台安装红旗DC5sp4的服务器在早上运行时ORACLE报错,不能读一个表,导致ORACLE不能正常运行,然后直接影响这台服务器的正常运行。其管理员查看系统内存占用过大,要求红旗公司派下现场给予处理。 经我们现场检查,发现其ORACLE运行时内存共占用54GB左右,而其总的物理内存为64GB。然而待服务器重启后,还未启动ORACLE,内存就被ORACLE用户的进程占用了49GB左右。现场初步判断应该是ORACLE配置的问题。建议让ORACLE公司派人来检查一下问题。我们同时收集了该服务器运行信息回公司分析。第二天给予明确回复。 28日,对昨天下现场工作进行分析总结。 通过这第一次下现场,从中学到不少实用技巧,发现售后服务工作需要有比较全面的知识和技术,才能对故障现象进行深入准确地分析,发现问题,并提出解决或建议方案。 首先,检查系统运行状态主要用到的命令有如下四个: 一、ps命令 ps -ef 显示所有进程,并用ASCII字符显示树状结构,表达程序间的相互关系。 ps -ef | wc -l 统计当前共有多少个进程在运行。 ps -ef | grep oracle 查看与oracle有关的所有进程信息。 具体命令解释如下: 1)ps a 显示现行终端机下的所有程序,包括其他用户的程序。 2)p

文档评论(0)

1亿VIP精品文档

相关文档