消息队列吞掉半台服务器后,我才看懂死信队列 报警群半夜炸了,监控显示 JVM 内存直接打满。我盯着 Grafana 上那条垂直拉升的曲线,脑子里只有一个念头:明明加了限流,怎么还是扛不住。后来翻日志才发现,真正搞垮服务的根本不是流量洪峰,而是我们亲手埋下的一个“安全网”。 真正拖垮系统的不是突发流量,而是被忽略的异常处理逻辑。业务跑在 Kafka 上,消费者按批次拉取消息,单机轻松扛住日常峰值。一切看起来都很完美,直到某次上游系统升级,吐出 2024-05-20 #Kafka #架构踩坑 #消息中间件