从最终错误开始
遇到请求超时,先找到错误记录,再沿请求标识恢复整个过程。可以下载演示日志,在 LogDog 分析器 中按下面的顺序操作。
regex
ERROR|WARN
输入表达式后执行搜索,并使用“只显示搜索”查看匹配记录。示例中的 WARN 表示上游调用变慢,ERROR 表示之后发生超时。日志中的描述是观测结果,不能独立证明数据库、网络或服务本身就是根因。
用请求标识补齐上下文
将表达式换成具体请求标识:
regex
request=req-1042
依次核对请求进入、缓存状态、上游耗时、超时和最终响应。若标识包含正则特殊字符,应先了解表达式含义,或使用适当的转义,避免误匹配。
点击匹配结果会定位到完整日志中的原始位置。查看同一时刻附近的其他记录,有助于区分单次请求问题与整体服务异常。
保留可复核的证据
标记关键行,记录时间范围、请求标识以及日志来源。在完整日志视图选择连续上下文并导出,避免只保留最后一行错误而遗漏前置条件。
两条搜索结果相邻,不代表它们在原始文件中相邻。若直接在结果视图选择并导出,得到的是结果列表,而不是两条记录之间的全部原始日志。
多服务日志需要额外核对
跨服务排查前,确认机器时钟、时区、时间格式和请求标识是否一致。顺序靠近只能提供线索,不能替代因果关系。存在重试时,也要区分同一请求的不同尝试。