<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>分区重分配 on PlumePHP</title><link>https://plumephp.com/tags/%E5%88%86%E5%8C%BA%E9%87%8D%E5%88%86%E9%85%8D/</link><description>Recent content in 分区重分配 on PlumePHP</description><generator>Hugo</generator><language>zh-CN</language><lastBuildDate>Mon, 17 Aug 2026 10:00:00 +0800</lastBuildDate><atom:link href="https://plumephp.com/tags/%E5%88%86%E5%8C%BA%E9%87%8D%E5%88%86%E9%85%8D/index.xml" rel="self" type="application/rss+xml"/><item><title>Kafka 运维监控与故障恢复：JMX 指标、Lag 监控与分区重分配</title><link>https://plumephp.com/kafka-monitoring-operations/</link><pubDate>Mon, 17 Aug 2026 10:00:00 +0800</pubDate><guid>https://plumephp.com/kafka-monitoring-operations/</guid><description>&lt;p&gt;Kafka 生产集群的稳定运行离不开完善的监控体系与规范的运维流程。一个未经监控的 Kafka 集群如同在黑暗中驾驶，分区复制延迟、消费者堆积、Broker 状态异常等问题随时可能引发服务故障。本篇文章系统地梳理了 Kafka 运维的核心维度，涵盖 JMX 关键指标解读、Consumer Lag 实时监控、分区重分配操作、Broker 扩缩容、数据恢复策略以及 Prometheus + Grafana 监控方案，帮助运维人员建立可观测、可预警、可恢复的生产级 Kafka 运维体系。&lt;/p&gt;</description></item></channel></rss>