Monitoring and Troubleshooting AWS
John Q. Martin
Principal Consultant

Jako v nemocnici: recepce → oddělení → specialista
Nahoře – přehled pro management
Uprostřed – stav služeb
Dole – podrobná diagnostika

Tyto čtyři signály pokrývají naprostou většinu problémů, na které narazíš.

Začni s RED a pro hlubší diagnostiku přidej saturaci.

["AWS/ApplicationELB",
"RequestCount",
{"stat": "Sum"}]
"metrics": [
["AWS/Lambda", "Errors",
{"stat":"Sum","id":"errors"}],
[".", "Invocations",
{"stat":"Sum","id":"invocations"}],
[{"expression":
"(errors/invocations)*100",
"label":"Error Rate %"}]
]
["AWS/ApplicationELB",
"TargetResponseTime",
{"stat": "p50"}],
["AWS/ApplicationELB",
"TargetResponseTime",
{"stat": "p95"}],
["AWS/ApplicationELB",
"TargetResponseTime",
{"stat": "p99"}]
Dotaz na poslední chyby:
fields @timestamp, @message
| filter @message like /ERROR/
| sort @timestamp desc
| limit 20
Počet chyb podle typu:
filter @message like /ERROR/
| stats count(*) as errors
by errorType
| sort errors desc


Jako triage na urgenci: stabilizuj → diagnostikuj → léč → ověř

Analýza: Zdroje přetíženy nárazovým nárůstem provozu

Analýza: Databáze je úzké místo – pomalé dotazy vyčerpávají connection pool

Malý problém ve službě A se rozšířil celým řetězcem závislostí

Monitoring and Troubleshooting AWS