雪崩问题面试题及详细答案(实战向).docxVIP

  • 1
  • 0
  • 约4.23千字
  • 约 6页
  • 2026-09-19 发布于河北
  • 举报

雪崩问题面试题及详细答案(实战向).docx

雪崩问题面试题及详细答案(实战向)

一、基础认知类(入门必问)

1、什么是服务雪崩?用项目实战经验通俗说明

参考答案:

服务雪崩是微服务架构中典型的连锁故障问题。简单来说,就是系统中某一个下游服务出现故障、响应变慢或者超时,导致上游大量请求堆积、线程被卡死,进而拖垮上游服务,接着继续向上传导,最终导致整个链路、甚至整个系统全部瘫痪,就像积雪层层崩塌一样,属于逐级放大的故障。

举个实战场景:用户下单服务需要调用库存服务、支付服务、物流服务。如果库存服务突然卡顿、超时,下单服务的请求线程会一直等待库存响应,无法释放。短时间内大量请求涌入,下单服务的线程池被占满,新的下单请求全部阻塞、报错。此时不仅库存服务不可用,原本正常的下单服务也彻底瘫痪,依赖下单服务的首页、活动、退款等所有关联业务全部崩掉,这就是典型的服务雪崩。

2、服务雪崩的核心产生原因有哪些?

参考答案:

结合线上故障复盘,核心原因主要分为4类,都是实际项目中最常见的问题:

1)下游服务不稳定:下游服务代码bug、数据库慢查询、机器宕机、网络波动、CPU/内存打满,导致接口响应超时、报错率飙升。

2)无超时、重试机制:上游调用下游没有设置超时时间,请求失败后还会无限重试,进一步放大下游压力,让故障持续恶化。

3)线程资源耗尽:下游卡顿导致上游请求线程持续阻塞,线程池被占满,无法处理新请求,服务直接卡死。

4)流量无防护:突发

文档评论(0)

1亿VIP精品文档

相关文档