Monitoring en troubleshooting van AWS
John Q. Martin
Principal Consultant

.Net als in een ziekenhuis: balie → afdeling → specialist_
Boven - Managementsamenvatting
Midden - Servicegezondheid
Onder - Gedetailleerde diagnostiek

Als je deze vier dekt, vang je het overgrote deel van de problemen op.

Gebruik RED als startpunt en voeg verzadiging toe voor diepere diagnose.

["AWS/ApplicationELB",
"RequestCount",
{"stat": "Sum"}]
"metrics": [
["AWS/Lambda", "Errors",
{"stat":"Sum","id":"errors"}],
[".", "Invocations",
{"stat":"Sum","id":"invocations"}],
[{"expression":
"(errors/invocations)*100",
"label":"Error Rate %"}]
]
["AWS/ApplicationELB",
"TargetResponseTime",
{"stat": "p50"}],
["AWS/ApplicationELB",
"TargetResponseTime",
{"stat": "p95"}],
["AWS/ApplicationELB",
"TargetResponseTime",
{"stat": "p99"}]
Recente fouten-query:
fields @timestamp, @message
| filter @message like /ERROR/
| sort @timestamp desc
| limit 20
Fouttellingen per type:
filter @message like /ERROR/
| stats count(*) as errors
by errorType
| sort errors desc


.Net als SEH-triage: stabiliseren → diagnosticeren → behandelen → verifiëren_

Analyse: Resources worden overspoeld door verkeerspiek

Analyse: Database is het knelpunt; trage queries putten de connectionpool uit

Een klein probleem in Service A is door de afhankelijkheidsketen gecascadeerd

Monitoring en troubleshooting van AWS