Supervision et dépannage sur AWS
John Q. Martin
Principal Consultant
Généré automatiquement à partir de vos traces : aucune config manuelle

D'un coup d'œil : vert = à l'heure · ambre = en retard · rouge = à l'arrêt

Quand vous ouvrez une carte, allez directement à tout ce qui n'est pas vert.
Cliquez sur un nœud pour voir : distribution des temps de réponse, répartition des statuts HTTP, types d'erreurs.

API Gateway (50ms)
-> OrderService (50ms)
-> PaymentService (100ms)
-> External API (200ms)
Total : 400ms
External API = 50 % de la latence totale
Comparer un chemin alternatif :
OrderService -> DynamoDB
Total : 120ms (rapide)


Query 1 (10-30ms)
-> Query 2 (30-50ms)
-> Query 3 (50-70ms)
-> Query 4 (70-90ms)

Get user list (10-20ms)
Get user 1 details (20-30ms)
Get user 2 details (30-40ms)
... ×100 requêtes séquentielles
Correctif : regrouper les requêtes, eager loading
Correctif : regrouper les requêtes, files de messages, mise en cache

Correctif : concurrence provisionnée, optimiser l'initialisation
Service A [Error]
-> Service B [Timeout 5s]
-> Service C [Timeout 5s]
-> Database [Timeout 5s]
Blocs de délais identiques empilés dans la hiérarchie de la trace
Correctif : délais d'attente, coupe‑circuits, solutions de secours

Comparer des groupes :
response_time > 1000ms, trier par durée
# Alarme de forte latence
aws cloudwatch put-metric-alarm \
--alarm-name HighLatency \
--metric-name ResponseTime \
--namespace AWS/XRay \
--statistic Average \
--period 300 \
--threshold 1000 \
--comparison-operator GreaterThanThreshold
# Alarme de forte erreur cumulée
aws cloudwatch put-metric-alarm \
--alarm-name HighErrorCount \
--metric-name ErrorCount \
--namespace AWS/XRay \
--statistic Sum \
--period 300 \
--threshold 50 \
--comparison-operator GreaterThanThreshold
Supervision et dépannage sur AWS