服务治理核心:Sentinel 限流熔断降级——生产级配置实战
引言 大促零点,商品详情页开始变慢。排查发现不是详情服务自己的问题——它依赖的评价服务有个慢 SQL,每个请求卡 3 秒。详情服务用默认的 Tomcat 200 线程池,请求一个接一个堵在评价服务调用上,200 个线程 30 秒内全部占满,详情服务整个挂掉;网关又把流量继续往这个已经挂掉的实例转,雪崩从评价服务蔓延到详情页,再到下单链路。 雪崩的本质是"故障传导没有刹车":下游慢 → 上游线程被占满 → 上游也慢 → 更上游继续堆。Sentinel 就是这个刹车——在调用入口实时统计 QPS、响应时间、异常比例,超过阈值立刻拦截或熔断,不让故障穿透到下一跳。这篇文章从三种核心能力的原理讲起,完成 Spring Cloud Alibaba 集成、控制台规则、@SentinelResource 兜底、Nacos 持久化的完整落地,最后给生产级规则配置清单。 一、三种核心能力:限流、熔断、降级的关系 很多人把这三个词混着用,它们其实是三个独立环节: ┌─────────────────────────────────────┐ 请求进来 ─────→ │ ① 限流:流量超过阈值,直接拒绝(....