fix/monitoring-scrape-targets
main
TooManyScrapeErrors 持续触发,现场 18 个目标中有两个采集失败:k3s kubelet /metrics 响应约 16.1 MiB,超过默认 16 MiB;旧 Docker cAdvisor :8080/metrics 返回 nginx 404,宿主机未运行该 exporter。
仅为 VMNodeScrape/kubelet 设置 max_scrape_size=32MiB,保留其他任务的默认限制。移除未部署的 Docker cAdvisor 目标;保留已有 node-exporter 和 Kubernetes /metrics/cadvisor,不屏蔽告警、不额外部署 exporter。
验证:Kustomize 渲染、git diff --check、现场 CRD 参数确认及 server dry-run 通过。合并后核对采集目标健康、失败计数停止增长,并等待五分钟告警回看窗口消退。
源码 README 同步按 wiki 约定暂缓;部署验收后更新 homelab-wiki 的 Grafana 运维页。
No dependencies set.
The note is not visible to the blocked user.
TooManyScrapeErrors 持续触发,现场 18 个目标中有两个采集失败:k3s kubelet /metrics 响应约 16.1 MiB,超过默认 16 MiB;旧 Docker cAdvisor :8080/metrics 返回 nginx 404,宿主机未运行该 exporter。
仅为 VMNodeScrape/kubelet 设置 max_scrape_size=32MiB,保留其他任务的默认限制。移除未部署的 Docker cAdvisor 目标;保留已有 node-exporter 和 Kubernetes /metrics/cadvisor,不屏蔽告警、不额外部署 exporter。
验证:Kustomize 渲染、git diff --check、现场 CRD 参数确认及 server dry-run 通过。合并后核对采集目标健康、失败计数停止增长,并等待五分钟告警回看窗口消退。
源码 README 同步按 wiki 约定暂缓;部署验收后更新 homelab-wiki 的 Grafana 运维页。