RabbitMQ 生产端可靠投递(confirm、return、重试)

这篇解决生产端"消息到底到没到"的问题:如何做到可确认、可补偿、可追踪

先说结论

可靠投递要做到三件事:

  1. 开启 publisher confirm,确认消息有没有到 Broker
  2. 开启 return,确认路由失败的消息能回来
  3. 发送失败要重试,但必须有上限 + 退避

一、两种"失败"要分清

  1. 发送失败:消息没到 Broker(比如网络抖动)
  2. 路由失败:消息到了交换机,但找不到队列

这两个失败场景的处理方式完全不同。


二、confirm 机制(消息是否到 Broker)

1) 开启确认机制

yaml 复制代码
spring:
  rabbitmq:
    publisher-confirm-type: correlated

2) 发送时带 correlationId

java 复制代码
CorrelationData correlationData = new CorrelationData(UUID.randomUUID().toString());
rabbitTemplate.convertAndSend(exchange, routingKey, message, correlationData);

3) 监听确认回调

java 复制代码
rabbitTemplate.setConfirmCallback((correlationData, ack, cause) -> {
    if (ack) {
        // 记录成功
    } else {
        // 发送失败,进入重试或落库
    }
});

三、return 机制(消息是否路由到队列)

1) 开启 return

yaml 复制代码
spring:
  rabbitmq:
    publisher-returns: true
    template:
      mandatory: true

2) 监听 return

java 复制代码
rabbitTemplate.setReturnsCallback(returned -> {
    // returned.getMessage()
    // returned.getReplyText()
    // returned.getExchange()
    // returned.getRoutingKey()
    // 路由失败,需人工处理或补偿
});

如果 confirm 成功但 return 触发,说明消息到了交换机却没队列接收。


四、重试策略(别无限重发)

推荐最简单可用的策略:

  • 1s
  • 5s
  • 30s
  • 2min
  • 10min
  • 超过 5 次进入失败队列

伪代码:

java 复制代码
if (retryCount > 5) {
    // 记录失败,告警
} else {
    // 延迟重试发送
}

五、一个完整可用的发送器

java 复制代码
@Component
public class ReliableProducer {

    @Resource
    private RabbitTemplate rabbitTemplate;
    @Resource
    private MessageSendLogService sendLogService;

    public void send(String exchange, String routingKey, Object payload) {
        String msgId = UUID.randomUUID().toString();
        CorrelationData cd = new CorrelationData(msgId);

        // 先落库(状态=发送中)
        sendLogService.saveSending(msgId, payload);

        rabbitTemplate.convertAndSend(exchange, routingKey, payload, cd);
    }

    @PostConstruct
    public void initCallbacks() {
        rabbitTemplate.setConfirmCallback((cd, ack, cause) -> {
            if (ack) {
                sendLogService.markSuccess(cd.getId());
            } else {
                sendLogService.markFail(cd.getId(), cause);
            }
        });

        rabbitTemplate.setReturnsCallback(ret -> {
            sendLogService.markRouteFail(
                ret.getMessage().getMessageProperties().getMessageId(),
                ret.getReplyText()
            );
        });
    }
}

六、推荐的工程化落地

  1. 消息落库 :发送前写一条 message_log
  2. 确认回调更新状态
  3. 失败消息进入补偿任务
  4. 监控指标:发送失败率、路由失败率、补偿成功率

这样你才知道"有没有丢",也才有"补救路径"。


最后总结

生产端可靠投递不是"一个开关",而是一套闭环:

  1. confirm 保证到 Broker
  2. return 保证到 Queue
  3. 失败可重试、可补偿、可追踪

做到这些,消息才真的"可靠"。

相关推荐
肠畔码农29 分钟前
深入分布式事务内核:从 2PC/XA 到 Seata AT 模式的架构演进与权衡
分布式·架构
ai小陈1 小时前
PyTorch多GPU分布式训练实战:从单卡脚本迁移到DDP
服务器·人工智能·pytorch·分布式·深度学习·ai·gpu算力
伟大的大威2 小时前
三台 DGX Spark 部署 DeepSeek V4 Flash NVFP4:从零到可用教程
大数据·分布式·spark
阿里云云原生2 小时前
企业级实时数据平台建设:利用存算分离 Kafka 实现低成本、高可靠入湖
分布式·阿里云·云原生·kafka
国科安芯3 小时前
星载CANFD总线通信网络中抗辐射微控制器MCU的失效机理与容错设计研究
网络·人工智能·分布式·单片机·嵌入式硬件·架构·抗辐射加固
zcmodeltech3 小时前
污水处理设备沙盘模型控制系统设计与实现:多单元协同联动方案
网络·分布式·stm32·单片机·嵌入式硬件·交互
roman_日积跬步-终至千里4 小时前
Spark 资源配置与 Shuffle 故障排查生产手册
大数据·分布式·spark
roman_日积跬步-终至千里4 小时前
常驻 Spark 引擎的稳定性风险:从一次 Linkis 任务失败说起
大数据·分布式·spark
JAVA面经实录9174 小时前
Kafka面试题标准答案(面试背诵版)
分布式·面试·kafka
hh9505 小时前
Agent Plan x DeepSeek Harness:分布式Agent集群调度与负载均衡
运维·分布式·负载均衡·adg·agent plan·adg成都社区