monitoring: fuera los restos de polymarket y la datasource Alertmanager

El dashboard «ChemaVX Homelab Overview» tenía 4 paneles Infinity apuntando a
api.polymarket-bot.svc.cluster.local:8000, decomisado el 2026-07-17, más dos
stat de servicios cuyos namespaces ya no existen (polymarket-bot, open-webui)
que se veían como un 0 sospechoso en vez de como ausencia. 24 -> 17 paneles, y
la rejilla de servicios reempaquetada (arrastraba huecos de borrados viejos).

La datasource Alertmanager apuntaba a un servicio inexistente (alertmanager
está desactivado a propósito) y devolvía 500. Dos sorpresas: no la apaga
alertmanager.enabled, sino grafana.sidecar.datasources.alertmanager.enabled; y
quitarla del provisioning NO la borra de grafana.db — hace falta una directiva
deleteDatasources de un solo uso. Igual para la Infinity, creada por UI.

Auditando el Deployment contra el render aparecieron dos campos puestos a mano
que el chart no genera y que sólo seguían vivos por el three-way merge de Helm,
el mismo agujero que 0501aab: GF_INSTALL_PLUGINS (ya sin uso, retirado junto al
plugin de 48 MB) y TELEGRAM_BOT_TOKEN/CHAT_ID, que sí son críticos — el contact
point usa ${TELEGRAM_BOT_TOKEN}, así que reconstruir el release desde cero
habría dejado las alertas mudas. Declarados ya en values.

Verificado: render == desplegado salvo defaults del API server; Grafana
reiniciada y arrancando sin errores, 1 datasource, 25 dashboards, 5 reglas y el
contact point de Telegram con token resuelto.

Co-Authored-By: Claude Opus 4.8 <noreply@anthropic.com>
This commit is contained in:
2026-07-22 08:02:48 +00:00
co-authored by Claude Opus 4.8
parent f5bcb76738
commit 28f16314d8
4 changed files with 55 additions and 642 deletions
@@ -1,11 +1,6 @@
apiVersion: v1
data:
datasource.yaml: "apiVersion: 1\ndatasources:\n- name: \"Prometheus\"\n type: prometheus\n\
\ uid: prometheus\n url: http://kube-prometheus-stack-prometheus.monitoring:9090/\n\
\ access: proxy\n isDefault: true\n jsonData:\n httpMethod: POST\n timeInterval:\
\ 30s\n- name: \"Alertmanager\"\n type: alertmanager\n uid: alertmanager\n \
\ url: http://kube-prometheus-stack-alertmanager.monitoring:9093/\n access: proxy\n\
\ jsonData:\n handleGrafanaManagedAlerts: false\n implementation: prometheus"
datasource.yaml: "apiVersion: 1\ndatasources:\n- name: \"Prometheus\"\n type: prometheus\n uid: prometheus\n url: http://kube-prometheus-stack-prometheus.monitoring:9090/\n access: proxy\n isDefault: true\n jsonData:\n httpMethod: POST\n timeInterval: 30s"
kind: ConfigMap
metadata:
annotations:
@@ -23,4 +18,3 @@ metadata:
release: kube-prometheus-stack
name: kube-prometheus-stack-grafana-datasource
namespace: monitoring