Saltar al contenido principal

← Resumen

Métricas de OmniSCP

Las métricas se exponen en el listener de Prometheus (prometheus_metrics_port, por defecto 9568) en /metrics. Los valores de etiquetas de resultado en las métricas de proxy son: success (2xx/3xx), client_error (4xx), server_error (5xx), error (conexión/tiempo de espera).

Métricas de proxy

Métrica: omni_scp_proxy_requests_count
Tipo: Contador
Descripción: Conteo del resultado del proxy por solicitud.
Etiquetas: target_nf_type, result

Métrica: omni_scp_proxy_requests_duration_ms
Tipo: Resumen
Descripción: Duración del proxy por solicitud en milisegundos.
Etiquetas: target_nf_type

Métrica: omni_scp_proxy_requests_total
Tipo: Contador
Descripción: Total de solicitudes proxy por tipo de NF objetivo y resultado.
Etiquetas: target_nf_type, result

Métrica: omni_scp_proxy_request_duration_ms
Tipo: Histograma (distribución)
Descripción: Duración de la solicitud proxy. Cubos: 1, 5, 10, 25, 50, 100, 250, 500, 1000 ms.
Etiquetas: target_nf_type

El SCP es un proxy de reenvío sin estado y no mantiene estado por asociación, por lo que no expone ninguna métrica de "asociaciones activas". La actividad en vivo se observa a través del contador de solicitudes proxy anterior (tasa, ratio de errores) y las cifras de salud del balanceador de carga en la API de OAM.

# Tasa de solicitudes proxy por tipo de NF objetivo
sum by (target_nf_type) (rate(omni_scp_proxy_requests_total[5m]))

# Ratio de errores del servidor entre todos los productores
sum(rate(omni_scp_proxy_requests_total{result="server_error"}[5m]))
/ sum(rate(omni_scp_proxy_requests_total[5m]))

# Latencia p95 del proxy por tipo de NF
histogram_quantile(0.95, sum by (le, target_nf_type) (rate(omni_scp_proxy_request_duration_ms_bucket[5m])))

Métricas de caché de descubrimiento

Métrica: omni_scp_discovery_cache_hits
Tipo: Contador
Descripción: Aciertos en la caché de descubrimiento, por servicio.
Etiquetas: target_nf_type, service_name

Métrica: omni_scp_discovery_cache_misses
Tipo: Contador
Descripción: Fallos en la caché de descubrimiento, por servicio.
Etiquetas: target_nf_type, service_name

Métrica: omni_scp_cache_hits_total
Tipo: Contador
Descripción: Aciertos agregados en la caché de descubrimiento.
Etiquetas: ninguna

Métrica: omni_scp_cache_misses_total
Tipo: Contador
Descripción: Fallos agregados en la caché de descubrimiento.
Etiquetas: ninguna

# Ratio general de aciertos en la caché (objetivo > 0.9 en una topología estable)
sum(rate(omni_scp_cache_hits_total[5m]))
/ (sum(rate(omni_scp_cache_hits_total[5m])) + sum(rate(omni_scp_cache_misses_total[5m])))

# Tasa de fallos por servicio (valores altos significan redescubrimiento frecuente de NRF)
sum by (target_nf_type, service_name) (rate(omni_scp_discovery_cache_misses[5m]))

Métrica de registro de NRF

Métrica: omni_scp_nrf_registration_status
Tipo: Gauge
Descripción: Estado de registro del SCP con el NRF (1 = registrado, 0 = no registrado).
Etiquetas: nf_type

# Alerta si el SCP pierde su registro en el NRF
min(omni_scp_nrf_registration_status) < 1

Métricas de BEAM VM

El runtime también exporta gauges de host/VM: beam_memory_total, beam_memory_processes, beam_memory_processes_used, beam_memory_system, beam_memory_atom, beam_memory_atom_used, beam_memory_binary, beam_memory_code, beam_memory_ets (todos en bytes), y beam_processes_count, beam_ports_count, beam_atom_count, beam_vm_uptime (segundos). Estos son útiles para el monitoreo de capacidad y fugas del proceso SCP en sí.

Los nombres de las métricas anteriores utilizan la normalización de punto a guion bajo de Prometheus; las series de histograma exponen los sufijos habituales _bucket, _sum y _count.