Monitorear un VPS: métricas, alertas y estadísticas del sitio
Monitorear un servidor son tres capas: las métricas del sistema —CPU, memoria, disco, red—, la comprobación de que los servicios responden desde afuera, y las estadísticas del sitio. Para lo primero alcanzan top, free y df a mano, o una herramienta de métricas continuas. Para lo segundo hace falta un monitor externo: si vive en el mismo servidor, se cae con él. Los VPS y servidores cloud de VPS Argentina ya vienen con supervisión y página de estado.
Las tres capas
| Capa | Responde a | Herramientas |
|---|---|---|
| Métricas del sistema | ¿Cuánto consume y desde cuándo? | top, htop, free, df, iostat, o Netdata para verlo en el tiempo |
| Comprobación externa | ¿Responde el sitio, el correo, el DNS? | Un monitor fuera del servidor: Uptime Kuma, un servicio de terceros, o el nuestro |
| Estadísticas del sitio | ¿Cuánta gente entra y a qué? | Los logs del servidor y una herramienta de analítica en el sitio |
La capa que más se olvida es la segunda, y es la única que avisa cuando el servidor deja de responder del todo.
Mirar rápido
uptime
free -h
df -h
ss -tulpn | head -20La carga que muestra uptime se lee contra la cantidad de núcleos: en un servidor de 4 núcleos, una carga de 4 significa que está justo al límite. Si la carga es alta y la memoria está libre, el cuello suele ser disco o base de datos; si la memoria está al límite, el servidor quedó chico.
Métricas en el tiempo
Los comandos de arriba muestran el momento. Para responder "¿desde cuándo?" hace falta guardar la serie. Netdata es la forma más rápida de tener eso en un VPS: se instala en minutos y muestra CPU, memoria, disco, red y servicios con un segundo de resolución.
apt install -y netdataDejalo escuchando solo en la red interna o detrás de una carpeta protegida con contraseña: expuesto a internet, muestra información del servidor a cualquiera.
Que alguien se entere
- Una comprobación externa cada minuto contra el sitio, el correo y el DNS.
- Aviso por más de un canal: el correo no sirve si lo que se cayó es el correo.
- Alertas sobre umbrales que anticipan: disco al 85%, memoria al 90% sostenida, certificado que vence en menos de diez días.
- Un resumen diario de los logs, que es lo que muestra lo que no llega a ser una caída.
Estadísticas del sitio
DirectAdmin genera estadísticas de cada dominio a partir de los logs del servidor. Muestran qué se pidió, cuántas veces y desde dónde.
Webalizer y AWStats, que es lo que nombran los artículos viejos, cuentan pedidos al servidor: ahí entran robots, monitores y descargas. Para medir visitas reales conviene además una herramienta de analítica en el sitio. Las dos miradas sirven, pero no dan el mismo número y no hay que compararlas.
Lo que ya tenés con nosotros
Los nodos, la red, el hosting y el DNS se comprueban cada 60 segundos desde un sistema de monitoreo que vive fuera de la infraestructura que vigila, y el resultado está publicado en la página de estado del servicio. Además, el agente de IA reinicia servicios caídos y avisa al equipo ante consumos anómalos.
Eso cubre la plataforma. Lo que corre adentro de tu VPS —tu aplicación, tu base— lo monitoreás vos.
Preguntas frecuentes
¿Alcanza con mirar el panel?
Para el estado del momento, sí. Para saber si algo viene empeorando hace falta guardar la serie, y para enterarte cuando el servidor no responde hace falta un monitor externo.
¿Por qué el monitor tiene que estar afuera?
Porque uno que vive en el servidor se cae con él y deja de avisar justo cuando hace falta. El nuestro está fuera de la infraestructura que vigila, por eso mismo.
¿Netdata consume mucho?
Bastante poco para lo que da, aunque en un VPS de 1 GB se nota. Ahí conviene limitar la retención de datos o usar solo comprobaciones externas.
¿Qué carga es normal?
Depende de los núcleos: una carga igual a la cantidad de núcleos es el límite razonable. Lo que importa no es el número puntual sino que se sostenga.
¿Me avisan si se cae mi VPS?
La plataforma está monitoreada y el agente actúa sobre los servicios que ve. Los incidentes con impacto se publican en la página de estado y se avisan por correo a los clientes afectados.
Seguí leyendo
Qué hacer cuando un servicio se cae: estado, logs y reinicio
El orden para diagnosticar con systemctl y journalctl, qué mirar antes de reiniciar y las tres causas que explican casi todas las caídas.
Estadísticas, espacio y ancho de banda: qué consume tu sitio
Leé el resumen de la cuenta, entendé qué cuenta como transferencia, encontrá qué se comió el disco y sepan cuándo el plan quedó chico.
Discos y particiones en Linux: LVM, más de 2 TB y unidades externas
Agregar un disco a un VPS, ampliar un volumen LVM sin reiniciar, usar GPT para discos grandes y montar unidades NTFS o USB en un servidor.