Para quien está de guardia
Son las 3:47 y su base de datos está bien.
Usted está durmiendo.
PulseDB vio el problema hace una hora, dejó el ticket escrito con la evidencia y las recomendaciones, y decidió que esto podía esperar al café de la mañana.
ORCLPRD1 · tablespace USERS
Está al 87 % y viene creciendo 1,4 GB por día desde el martes. Al ritmo actual se llena el jueves 12 por la tarde. No hay riesgo esta noche.
Nada se había caído todavía
Un monitor clásico habría esperado a que el tablespace llegara al 95 % para encender una luz roja. Para entonces usted ya está despierto y con prisa.
PulseDB mira otra cosa: la pendiente. Compara el crecimiento de los últimos catorce días, ve que users_04.dbf quedó en tamaño fijo desde una migración, calcula cuándo se acaba el espacio, y decide que eso merece un aviso hoy y no el jueves a las seis de la tarde.
El umbral
«Tablespace USERS al 95 %». Un número, sin contexto, cuando ya casi no hay margen. Usted abre una sesión, investiga con sueño, y actúa a las apuradas.
La tendencia
«Al 87 %, creciendo 1,4 GB por día desde el martes, se llena el jueves 12». Con la causa probable, las tres opciones y el tiempo que toma cada una.
El aviso que no lo despierta
La mitad del valor de un sistema de alertas está en lo que decide no mandarle. PulseDB clasifica cada hallazgo por severidad y respeta sus horas de descanso, con una excepción que usted define y que nunca se negocia.
- InformativoSe queda en el tablero. No suena, no llega correo, no interrumpe nada.
- AdvertenciaQueda en el tablero y el correo sale en horario hábil. Si nadie responde, insiste cada dos horas, sin dramatismo. Nunca por WhatsApp.
- GraveTablero, correo y WhatsApp a los cinco minutos, a cualquier hora, y de nuevo cada media hora. Si en cuatro horas nadie responde, escala a su respaldo de guardia.
- CríticoNo espera al horario hábil. Tablero, correo y WhatsApp al instante, y de nuevo cada cinco minutos, sin tope, hasta que alguien lo reconozca. Solo lo calla una ventana de mantenimiento que usted haya declarado.
Y si esa noche hubieran fallado veinte cosas a la vez, habría recibido un mensaje, no veinte: PulseDB agrupa por base, deduplica lo repetido, y cuando la instancia entera se cae no le manda los veinte síntomas, le manda la caída.
Todo lo que necesita, en el primer párrafo
El ticket no es una notificación con un enlace. Es el trabajo de investigación ya hecho, con la evidencia congelada en el momento de la detección, para que siga siendo verificable cuando usted lo abra cinco horas después.
Causa probable · confianza 0,86
El datafile users_04.dbf quedó en tamaño fijo tras la migración del 14 de mayo. El crecimiento diario de la tabla MOV_CAJA aumentó 40 % desde el cierre de mes y ya no cabe en el margen restante.
Evidencia usada
dba_data_files · dba_free_space · serie de 14 días de TBS_USED_PCT · el cambio de parámetro registrado el 14 de mayo · el incidente #0761 de febrero, que fue lo mismo en otro tablespace.
Qué puede hacer
- Habilitar autoextend en users_04.dbf con maxsize de 32 GB.
- Añadir un datafile nuevo de 32 GB si prefiere no tocar el existente.
- Archivar MOV_CAJA anterior a 2024, que son 41 GB recuperables.
Usted decide. Siempre.
Esto no es una promesa comercial, es una restricción de diseño. El código de los agentes no contiene ninguna herramienta capaz de escribir en sus bases. No es que esté desactivada: no existe.
Lo que PulseDB no hace, nunca
- No ejecuta un ALTER sobre sus objetos, no mata sesiones, no reinicia nada, no toca un parámetro. Le dice qué haría y espera. (La única escritura es la del modo diagnóstico, que activa usted: desbloquear y volver a bloquear su propia cuenta.)
- No instala ningún agente en su servidor de base de datos. Entra por ORDS en Oracle y con un rol de solo lectura en PostgreSQL.
- No lee los datos de sus tablas. Solo el diccionario y las estadísticas. Y antes de que un texto salga hacia el modelo de lenguaje, los literales de las consultas se reemplazan por variables.
- No consume su instancia. Se impone un tope de 36 segundos de DB time por hora (el 1 % de una CPU), mide su propio consumo y le avisa si lo supera.
- No usa AWR ni ASH por su cuenta. Verifica su licenciamiento de Diagnostics Pack y, si no lo tiene, bloquea esas consultas y se lo explica.
Se acuerda de todo por usted
Cuando usted cierra el ticket, PulseDB compara el estado del momento de la apertura con el actual, deduce qué cambió, y le propone el texto de la acción correctiva para que usted lo confirme o lo corrija. Nunca lo escribe solo.
Si el mismo problema aparece tres veces en noventa días, deja de tratarlo como un incidente y lo trata como una lección: escribe qué señales lo anticiparon y propone una comprobación nueva para detectarlo antes la próxima vez. Esa comprobación no se ejecuta hasta que un administrador la aprueba, y pasa veinticuatro horas en cuarentena contra el laboratorio antes de tocar producción.
Al cabo de un año el sistema conoce sus bases mejor que cualquier plantilla genérica, porque lo que sabe se lo enseñó usted.
El plan que nadie alcanza a escribir
Dos veces al año, por cada base y por cada recurso, PulseDB proyecta doce meses hacia adelante con los datos que ya tiene guardados y le dice cuándo se le acaba el espacio, la memoria o las sesiones. Las cifras las calcula el código; el modelo solo las redacta.
Es el documento que su jefe le pide cada cierre de año y que usted nunca tiene tiempo de armar. Queda guardado, con fecha, y se puede imprimir.