SSE 多实例部署的跨节点路由与断线补发
SSE 连接只存在于接受它的那台机器上,浏览器断线后会带着 Last-Event-ID 自动重连;部署成多实例后,推送要跨节点找到连接,重连落到另一台机器时要从共享历史补发,中间代理的缓冲和空闲超时也要处理。
SSE 连接只存在于接受它的那台机器上,浏览器断线后会带着 Last-Event-ID 自动重连;部署成多实例后,推送要跨节点找到连接,重连落到另一台机器时要从共享历史补发,中间代理的缓冲和空闲超时也要处理。
生产环境单节点 OpenSearch 的 Dashboards 对所有用户返回 401:按 _id 排序分页留下的 12.3 GiB fielddata 占着没有上限的缓存,几个跨月聚合又把堆推过了 parent 断路器上限。文中整理了时间线、原因和防护建议。
按峰值每秒 6 万到 7 万条、每天约 2.4 TB 主分片数据推算日志集群:Kafka 缓冲、节点角色分离、写入调优和 data stream 滚动;热数据在 14 台本地 NVMe 节点上保留 7 天,快照在 S3 保留约 30 天。
多站点电商的商品数据要同时处理站点间的本地化与合规差异、品类属性差异、跨洋读延迟和大促读压力。这套 PIM / MDM 架构用两层商品模型、类目属性规则、中心打版加事件分发到大区只读副本、版本号幂等写入与对账、多级缓存来逐个解决。
三个非生产环境 14 天共 47.5 GB 的日志里,一个接口的完整响应体估算占了约 23 GB。按文件后缀、字段抽样、mapping 开销和查询模式四步找出空间去向,并估算源头截断、zstd、去掉长文本 .keyword 和不存位置信息各能省多少。