Aller au contenu principal
Gestion des Erreurs• 6 min de lecture

Alertes et monitoring des flows WhatsApp : détecter les problèmes en temps réel

Un flow WhatsApp en production doit être surveillé en permanence. Découvrez comment mettre en place un système d'alertes efficace pour détecter les anomalies, réagir rapidement et maintenir une communication irréprochable.

Quand un flow WhatsApp tombe en panne silencieusement — aucun message d'erreur apparent, mais les clients ne reçoivent plus rien — les conséquences peuvent être graves : opportunités commerciales perdues, clients sans information, réputation entachée. Un système de monitoring et d'alertes bien configuré est la différence entre une panne détectée en 5 minutes et une panne découverte 3 jours plus tard.

Pourquoi les flows WhatsApp nécessitent un monitoring actif

Contrairement à une simple campagne ponctuelle, un flow WhatsApp en production est un système vivant qui tourne 24h/24. Il peut tomber en panne pour une multitude de raisons que vous ne contrôlez pas directement.

Les causes de panne les plus fréquentes :

  • Token d'API expiré ou révoqué (compte Meta Business modifié, rotation de sécurité)
  • Template suspendu par Meta suite à des signalements
  • Dépassement des limites de messaging tier
  • Changement d'un schema de données dans une app tierce (webhook qui envoie un champ renommé)
  • Panne de l'API Meta (rare mais arrive)
  • Changement de propriétaire du numéro WhatsApp Business
  • Problème de crédit ou de facturation chez le BSP

La caractéristique perverse de beaucoup de ces pannes est leur silence : aucune alerte dans l'interface, les messages semblent partir mais ne sont jamais livrés, ou le flow s'exécute sans envoyer aucun message.

Pour comprendre les types d'erreurs et leurs codes, notre guide sur l'API WhatsApp Business est une référence utile. Pour les solutions d'automatisation qui encapsulent la gestion d'erreurs, notre article sur les flows d'automatisation WhatsApp complète ce monitoring.

Construire un système d'alertes multicouches

Un monitoring robuste ne repose pas sur un seul outil mais sur plusieurs niveaux de détection complémentaires.

Niveau 1 — Alertes natives Whakup La plateforme Whakup dispose d'un système d'alertes intégré. Configurez des notifications pour :

  • Taux de livraison d'une campagne/flow tombant sous 85 %
  • Taux d'erreur dépassant 5 % sur les 15 dernières minutes
  • Volume d'envois tombant à zéro (flow actif mais silencieux)
  • Note de qualité du numéro passant en "Medium" ou "Low"

Ces alertes peuvent être envoyées par email, par Slack, ou... par WhatsApp à une ligne interne de l'équipe technique.

Niveau 2 — Monitoring des webhooks entrants Si vos flows sont déclenchés par des webhooks, surveillez que ces webhooks sont bien reçus. Utilisez un outil comme UptimeRobot ou un simple script cron qui vérifie périodiquement que des webhooks sont bien reçus. Une absence de webhook pendant une heure sur un flow normalement actif en continu est un signal d'alarme.

Niveau 3 — Tests synthétiques Mettez en place un "canary contact" — un numéro de téléphone interne de test — qui est intentionnellement inclus dans les flux de production. Si ce numéro ne reçoit plus les messages attendus, une alerte est déclenchée. C'est le test le plus fiable car il simule exactement l'expérience d'un vrai contact.

Niveau 4 — Alertes dans vos outils d'automatisation Si vous utilisez Make, Zapier ou n8n, configurez des gestionnaires d'erreurs globaux. Dans Make, les routes d'erreur peuvent envoyer une notification Slack ou WhatsApp en cas d'échec d'un scénario. Dans n8n, les "Error Workflows" sont déclenchés automatiquement en cas de problème.

Tableau de bord de monitoring : les métriques à surveiller

Un bon tableau de bord de monitoring WhatsApp doit afficher en temps réel les indicateurs suivants.

Métriques de volume :

  • Nombre de messages envoyés dans les dernières 15 minutes, 1 heure, 24 heures
  • Comparaison avec la période précédente (alerte si -50 % inexpliqué)
  • Nombre de flows actifs vs flows en pause/erreur

Métriques de qualité :

  • Taux de livraison global et par flow
  • Taux d'erreur par code d'erreur (identifier les codes récurrents)
  • Note de qualité du numéro (High / Medium / Low)
  • Évolution de la note de qualité sur 7 jours

Métriques de latence :

  • Délai moyen entre déclenchement d'un flow et envoi du premier message
  • Délai maximum observé dans les 24 dernières heures
  • Files d'attente en cours

Métriques métier :

  • Taux de réponse sur les flows conversationnels
  • Taux de conversion sur les flows commerciaux
  • Nombre d'opt-outs dans les dernières 24h

Procédure de réponse aux incidents

Quand une alerte se déclenche, avoir une procédure d'escalade claire réduit le temps de résolution.

  1. Alerte reçue : identifier immédiatement le flow/campagne concerné et les contacts impactés
  2. Triage : s'agit-il d'une panne totale ou partielle ? Temporaire ou persistante ?
  3. Action immédiate : mettre en pause les flows impactés pour éviter d'accumuler les erreurs
  4. Diagnostic : consulter les logs d'erreur Whakup, vérifier le statut de l'API Meta, vérifier les tokens et credentials
  5. Résolution : corriger la cause racine identifiée
  6. Vérification : activer un envoi test avant de remettre le flow en production
  7. Post-mortem : documenter l'incident, sa durée, son impact, et les mesures préventives mises en place

FAQ

Comment recevoir des alertes WhatsApp depuis Whakup sur un numéro interne ? Créez un numéro WhatsApp interne dédié aux alertes techniques. Configurez Whakup pour envoyer des notifications sur ce numéro via un flow dédié "monitoring" qui utilise l'API en direct. Vous pouvez également utiliser un groupe WhatsApp interne pour notifier toute l'équipe technique simultanément.

Quelle est la fréquence idéale pour vérifier les métriques de monitoring ? Les métriques critiques (erreurs, volume) doivent être vérifiées en quasi-temps-réel (toutes les 5-15 minutes via des alertes automatiques). Les métriques qualitatives (taux de réponse, note de qualité) peuvent être revues quotidiennement dans un rapport automatisé.

Comment différencier une vraie panne d'une simple baisse d'activité normale ? Comparez toujours avec la période équivalente de la semaine précédente. Une baisse de 40 % le dimanche matin est normale si vous êtes B2B. La même baisse un mardi à 10h est suspecte. Configurez vos alertes avec une baseline dynamique qui tient compte des patterns hebdomadaires.

Les pannes de l'API Meta sont-elles fréquentes ? Non, l'infrastructure Meta est très robuste. Les pannes majeures (comme celle d'octobre 2021) sont rares — peut-être une fois tous les 2-3 ans. Des micro-pannes ou ralentissements (moins de 30 minutes) sont plus fréquents mais rarement critiques. Vérifiez le tableau de statut officiel de Meta : developers.facebook.com/status.

Faut-il monitorer les flows 24h/24 même si on envoie uniquement en journée ? Oui. Les flows peuvent avoir des composants qui s'exécutent la nuit (délais dans les séquences, traitements asynchrones). Un problème de token expiré détecté à 3h du matin évite une panne au réveil de vos équipes.


Mettez votre infrastructure WhatsApp sous surveillance. Créez votre compte Whakup et configurez vos premières alertes de monitoring pour ne plus jamais manquer un incident.

#monitoring#alertes#flows#production#observabilité
Pablo Lenormand
Pablo LenormandCo-fondateur & CPO

Co-fondateur et Chief Product Officer de Whakup, Pablo conçoit les fonctionnalités qui permettent aux marques africaines de maximiser leur impact sur WhatsApp.

🚀

Prêt à passer à l'action ?

Essayez Whakup gratuitement pendant 15 jours. Aucune carte bancaire requise.

Démarrer l'essai gratuit