Gestion de flotte IoT : superviser 200 routeurs industriels sans équipe dédiée

· 7 minutes de lecture
7 min read
Lucas Moreau
Ingénieur Réseau OT/IT

Quand votre parc IoT dépasse les 50 sites, la gestion manuelle devient impossible. Voici comment architected une supervision de flotte qui scale — avec deux techniciens, pas vingt.

Le problème à 200 routeurs

À 10 routeurs, on gère manuellement. On sait quel site a quel équipement, on maintient une feuille Excel des configurations, on fait des visites terrain régulières.

À 200 routeurs, c'est une autre histoire :

  • Configuration : 200 configurations différentes, chacune avec des spécificités site
  • Déploiement : un nouveau site tous les 2–3 jours au pic d'activité
  • Surveillance : impossible de surveiller 200 tableaux de bord manuellement
  • Incidents : les coupures arrivent la nuit, les week-ends
  • Mises à jour : coordonner des mises à jour firmware sur 200 équipements sans créer de coupures

Notre client Faure Industries (intégrateur industriel, 200 sites clients) a résolu ce problème. Voici leur approche.

Architecture de gestion en 4 piliers

1. Zero-Touch Provisioning — zéro config manuelle

Le ZTP élimine la configuration manuelle site par site. Voici le processus :

Résultat : un technicien non-qualifié réseau peut déployer un site complet en moins de 5 minutes — juste brancher l'alimentation.

2. Profils de déploiement — la configuration centralisée

Faure Industries a créé 8 profils de déploiement couvrant 95% de leurs configurations :

# Profil "Station-Pompage-Standard"
name: Station-Pompage-Standard
vpn: openvpn
modbus:
baud_rate: 9600
slaves:
- slave_id: 1
polling: 30s
registers: [pump_status, pressure, flow, level]
mqtt:
broker: mqtt.eziwan.com
topic_prefix: "eau/{site_id}/pompe"
alerts:
- type: device_offline
delay: 5min
channel: [email, sms]
- type: modbus_value_out_of_range
tag: pressure
min: 0.5
max: 8.0
channel: [email]

Quand un nouveau site correspond à ce profil, il suffit de l'assigner au token ZTP. Toute la configuration est déployée automatiquement.

3. Surveillance proactive — anticiper les pannes

La surveillance réactive (alerte quand ça tombe) ne suffit pas à 200 routeurs. Faure Industries utilise la surveillance prédictive :

Indicateurs d'alerte précoce

Signal RSRP LTE :
> -80 dBm → Excellent (vert)
-80 à -95 → Bon (vert pâle)
-95 à -105 → Dégradé (orange) → alerte préventive
< -105 → Critique (rouge) → intervention

Les alertes préventives permettent d'anticiper :

  • Programmer une vérification de l'antenne avant la panne
  • Contacter l'opérateur pour signaler une dégradation de couverture
  • Planifier l'ajout d'une antenne externe lors du prochain passage

Dashboard de santé de flotte

SIM2 actives (failover) : 4 routeurs · Dernière coupure > 24 h : 0 routeur.

4. Maintenance sans déplacement

La plupart des incidents se résolvent à distance :

IncidentRésolution à distanceTaux
Routeur plantéReboot OTA via dashboard85%
Config incorrecteRedéploiement profil via dashboard90%
Firmware obsolèteMise à jour OTA par lot100%
Esclave Modbus ne répond plusTest depuis dashboard + logs70%

Seuls les incidents matériels (alimentation HS, antenne arrachée, câble RS485 débranché) nécessitent un déplacement physique.

Intégration avec les outils de supervision existants

La valeur d'une plateforme de gestion de flotte se mesure à sa capacité à s'intégrer avec l'écosystème existant de l'intégrateur ou du client final.

Webhooks et API REST

Eziwan expose une API REST complète et des webhooks pour chaque événement de flotte :

# Exemple : lister les équipements offline via API REST
curl -H "Authorization: Bearer $EZIWAN_TOKEN" \
https://api.eziwan.com/v2/devices?status=offline&site_id=*

# Réponse JSON
{
"devices": [
{
"id": "gw-lyon-04",
"site": "Lyon-Industrie-Nord",
"status": "offline",
"last_seen": "2025-07-01T14:32:11Z",
"offline_duration_min": 47,
"sim_active": null,
"rsrp_last": -108
}
],
"total_offline": 3,
"total_devices": 200
}

Webhooks disponibles : device.offline, device.online, failover.triggered, failover.resolved, signal.degraded, firmware.update.completed, certificate.expiring.

Intégration Grafana / InfluxDB / Prometheus

Pour les équipes qui supervisent déjà leur infrastructure avec Grafana :

# Exemple de datasource Eziwan dans Grafana
datasource:
type: prometheus
url: https://api.eziwan.com/metrics
auth:
type: bearer
token: ${EZIWAN_TOKEN}

# Métriques disponibles
# eziwan_device_rsrp{device_id, site_id, operator}
# eziwan_device_status{device_id, site_id} # 0=offline, 1=degraded, 2=online
# eziwan_failover_count{device_id, sim_slot}
# eziwan_modbus_errors_total{device_id, slave_id}
# eziwan_mqtt_messages_total{device_id, topic}

Un dashboard Grafana standard importé depuis la communauté Eziwan affiche en 5 minutes : la carte géographique des sites (online/offline/dégradé), l'histogramme des événements de failover, les tendances de signal RSRP sur 30 jours.

Intégration ITSM (ServiceNow, Jira Service Management)

Pour les organisations qui gèrent leurs incidents via un outil ITSM :

// Webhook Eziwan → ServiceNow
{
"event": "device.offline",
"device_id": "gw-lyon-04",
"site": "Lyon-Industrie-Nord",
"offline_since": "2025-07-01T14:32:11Z",
"recommended_action": "Check LTE coverage and power supply"
}

Ce webhook peut alimenter automatiquement un ticket de niveau P2 dans ServiceNow ou une issue dans Jira SM — l'ingénieur de garde est prévenu sans intervention manuelle.

Métriques opérationnelles Faure Industries

Après 18 mois d'exploitation (200 sites) :

MétriqueValeur
Temps moyen de déploiement par site4,5 min (hors expédition)
Disponibilité collecte99,4%
Incidents résolus à distance83%
Techniciens dédiés à la gestion de flotte1,5 ETP
Sites gérés par ETP130

FAQ

Peut-on gérer des routeurs de marques différentes depuis une même console Eziwan ? La gestion de flotte centralisée Eziwan est native pour les gateways Eziwan. Pour les équipements tiers (Teltonika, Cradlepoint, Sierra Wireless), une intégration partielle est possible via l'API REST Eziwan ou les protocoles NETCONF/YANG — contactez notre équipe pour les cas d'usage spécifiques.

Comment détecter rapidement qu'un site est hors ligne sur une flotte de 200 sites ? Le dashboard Eziwan affiche en temps réel le statut de chaque site (ONLINE / OFFLINE / DÉGRADÉ) avec horodatage de la dernière communication. Des alertes configurable (email, SMS, webhook) se déclenchent si un site ne se manifeste pas depuis N minutes. Pour 200 sites, la vue flotte (tableau ou carte géographique) permet d'identifier immédiatement les sites en anomalie.

La mise à jour firmware OTA interrompt-elle la collecte des données ? Sur les gateways Eziwan, la mise à jour OTA est conçue pour minimiser l'interruption : le firmware est téléchargé en arrière-plan, et le redémarrage est programmé pendant une plage de maintenance configurée (ex : 2h00-4h00 du matin). Le store-and-forward garantit qu'aucune donnée collectée avant le redémarrage n'est perdue.


Pour aller plus loin


Conclusion

La gestion d'une flotte IoT industrielle à grande échelle n'est pas un problème de ressources humaines — c'est un problème d'architecture. Avec ZTP, profils centralisés, alertes prédictives et maintenance OTA, deux personnes gèrent 200 sites aussi facilement que 20.

La clé : éliminer les tâches manuelles répétitives avec des outils intelligents, et se concentrer sur les interventions à vraie valeur ajoutée.

Explorer la documentation ZTP → · Voir nos cas d'usage →


Ressources complémentaires