Monitoring
Monitoring ti řekne, že se něco děje, dřív než ti to napíšou uživatelé.
Grafy v Convoyi
V detailu VPS najdeš průběh CPU, RAM, disku a síťového provozu. Historie je krátká — na dlouhodobé sledování si nasaď vlastní monitoring přímo na VPS.
| Metrika | Na co dát pozor |
|---|---|
| CPU | trvalé 100 % = úzké hrdlo |
| RAM | blízko limitu = riziko OOM killeru |
| Disk | nad 90 % = služby začnou selhávat |
| Síť | neobvyklý odchozí provoz = kompromitace |
Plný disk je nejčastější příčina záhadných výpadků. Databáze i logy přestanou zapisovat, ale server běží dál — chyba se objeví až v aplikaci.
Výstrahy
Otevři záložku Monitoring
Přidej pravidlo
Například CPU nad 90 % po dobu 10 minut.
Zvol kanál
E-mail, Discord webhook nebo obojí.
Diagnostika z příkazové řádky
# Prehled procesu a zateze
htop
# Zatez systemu (1, 5, 15 minut)
uptime
# Vyuziti disku
df -h
ncdu /
# Kdo zere pamet
ps aux --sort=-%mem | head -10
# Sitovy provoz
ss -tunapHodnota load average vyšší než počet jader znamená, že procesy čekají ve
frontě. Na 4jádrovém VPS je load 4.0 plné vytížení.
Nedostatek místa
# Co zabira misto
sudo ncdu /
# Vycisti logy
sudo journalctl --vacuum-time=7d
# Vycisti balickovou cache
sudo apt cleanNemaž soubory v /var/log ručně za běhu služby. Proces drží deskriptor
otevřený a místo se neuvolní. Použij truncate -s 0 soubor nebo restartuj
službu.
Externí monitoring dostupnosti
Convoy sleduje zdroje, ne dostupnost tvé aplikace. Pro kontrolu HTTP odpovědi použij externí službu (UptimeRobot, Better Stack) nebo vlastní kontrolu.
# Jednoducha kontrola v cronu
*/5 * * * * curl -fsS https://mujweb.cz/health || systemctl restart mujwebAutomatický restart služby při chybě zamaskuje příčinu. Používej ho jako dočasnou berličku, ne jako řešení.
Tipy
- Nastav výstrahu na disk dřív než na cokoli jiného.
- Sleduj odchozí provoz. Náhlý nárůst znamená buď útok, nebo že server slouží jako jeho zdroj.
Poznámka
Statistiky v Convoyi měří hypervizor, ne systém uvnitř. Malé rozdíly oproti
htop jsou normální.