⚠️ 那条起因日志是什么级别
还是这四行。最上面那条"开始导出月度报表",正是这次故障的起因——它占住数据库连接不放,把连接池耗光了。 但它的日志级别是什么?(也就是时间后面那一列) xiaoming@youci:/var/log/order$ gr
这个起因带出了多少次 500
数一数最终返回给客户端的失败: 这个数字是多少? xiaoming@youci:/var/log/order$ grep -c HTTP_500 app.log 8
时间线按什么排
把故障日志整理成时间线,排序依据是【0】。
时间线上最该标出哪一条
一条时间线上最该被标出来的是【0】。
"后续影响"指的是什么
故障报告里说的"后续影响",指的是【0】。
报告只写"10 点服务出错"够不够
故障报告里只写一句"10 点服务出错了",问题在于【0】。
时间线第一格:最早的警告
先取第一条 WARN 的时间: 是几点几分几秒? xiaoming@youci:/var/log/order$ grep -m1 WARN app.log | awk '{print $2}' 10:00:05
时间线第二格:第一次真的出错
再取第一条 ERROR 的时间: 是几点几分几秒? xiaoming@youci:/var/log/order$ grep -m1 ERROR app.log | awk '{print $2}' 10:00:17
时间线第三格:占住的连接被放开
再取报表导出结束、连接被释放的时间: 是几点几分几秒? xiaoming@youci:/var/log/order$ grep 连接已释放 app.log | awk '{print $2}' 10:01:40
时间线收尾:最后一次报错
最后取最后一条 ERROR 的时间: 是几点几分几秒? (把它和上一题比一比:连接一放开,错误就停了。) xiaoming@youci:/var/log/order$ grep ERROR app.log | tail -1 | awk &