Redis服务端必须配置tcp-keepalive=60和timeout=600,以防止Pub/Sub空闲连接被静默关闭;客户端需按Lettuce、Redisson或Jedis差异启用心跳,同时校验DNS与节点状态。
默认配置下,Redis 会静默关闭空闲连接——timeout 默认是 300 秒(5 分钟),而 Pub/Sub 连接几乎不发命令,纯等消息,必然被踢。光靠客户端重连救不了命。
必须在 redis.conf 中显式设置:
tcp-keepalive 60:启用内核 TCP 心跳,每 60 秒发一次 ACK 探测,能快速发现 NAT、云 LB 或防火墙中途断连timeout 600:把服务端空闲断连阈值拉到 10 分钟,给客户端留出心跳探测与重连窗口这两项必须写入配置文件并执行 CONFIG REWRITE 或重启生效,否则重启即丢。注意:tcp-keepalive 0 表示禁用,不能省略。
客户端设了 autoReconnect=true 不等于连接不会僵死。不同客户端的心跳机制完全不同,且多数不默认开启:
spring.redis.lettuce.keep-alive=true 仅控制普通命令连接;StatefulRedisPubSubConnection 需手动监听 onException 后调 connection.ping()
setHeartbeatInterval(15000)(15 秒),同时确保 setSubscriptionConnectionPoolSize(20),避免单连接排队阻塞订阅线程jedis.ping(),且必须复用当前 PubSub 所绑定的那个 Jedis 实例,不能从连接池随便取一个客户端连的是域名(如 redis-prod.cluster.example.com),DNS 缓存过久或云 Redis VIP 漂移后,旧连接可能还连着已下线节点——PING 成功但 PUBLISH 失败,错误表现为 READONLY You can't write against a read only replica 或无响应。
应对方式:
-Dsun.net.inetaddr.ttl=60,强制 DNS 缓存 60 秒刷新dnsMonitoringInterval,建议保持默认 5000ms 或调至 3000msINFO replication 或 CLUSTER NODES,校验当前连接是否仍指向有效 master 节点Redis 的 Pub/Sub 是纯内存转发,不持久化、不确认、不重试。订阅者掉线期间的消息直接丢弃,上线后收不到任何补偿。
如果业务需要消息不丢,要么:
Stream + XREADGROUP,支持消费者组、ACK 和消息重播LIST,再发 PUBLISH 通知;订阅端收到通知后主动拉取最新状态真正稳定的 Pub/Sub 不是靠“不断重连”,而是让连接在空闲时持续被探测、被确认、被刷新。任何一个环节缺位,都会在高并发或云网络环境下暴露为偶发性收不到消息。
小米路由器3G怎么恢复出厂设置(小米路由器3G该如何恢复出厂设置)
小米路由器3g和4a千兆版哪个好(小米路由器3g和4a千兆版对比区别)
Sensor Tower:ChatGPT全球份额跌破50%,Gemini与Claude加速追赶
OpenAI提速狂飙16倍!GPT-5.6多智能体V2上线,741轮怪物对话1秒打开
“十五五”时期 煤矿危险繁重岗位将由机器人替代
waytouniverse/ppt-generator:从 Markdown 大纲生成风格统一的 PPT 图片