Diagnostic & exploitation d'un edge Linux Debian
Administrer et dépanner un edge device Debian installé dans l'armoire d'une cellule d'automatisme — SSH, systemd, journaux, NTP, Docker, sauvegarde — depuis le laptop d'ingénierie. On part de l'accès, on inspecte l'état, on remet le service en route et on sécurise la reprise. 9 chapitres en français, sorties de commandes réelles commentées, figures et exercices de labo à solutions repliables.
Comment lire ce cours ? Les chapitres se suivent de l'accès à la résilience : on se
connecte (SSH), on lit l'état du système (systemd, journaux, temps/NTP), on exploite le service
conteneurisé (Docker, déploiement), puis on protège et on remet en route (sauvegarde, méthodologie de
reprise). Les encarts « 💡 Intuition », « ⚠️ Piège », « 🖥️ Sur l'edge », « 💻 Depuis le laptop »,
« 🔧 Côté OT / automate » et « 🛡️ Prudence OT » balisent le texte. Chaque chapitre finit par des
exercices de labo avec solution repliable. Aucun prérequis Linux avancé : on introduit
chaque commande.
Le décor est le même que le cours Diagnostic réseau OT/IT, vu cette fois depuis l'edge lui-même. Deux acteurs tout au long du cours :
- L'edge Debian — un petit PC industriel (
edge-cell12, Debian 12) câblé dans l'armoire, sur le réseau machine192.168.0.0/24. Il fait passerelle : il lit l'automate S7-1500 en OPC-UA et remonte les données ; il sert aussi d'horloge NTP à la cellule. Le service applicatif tourne en conteneurs Docker. - Le laptop d'ingénierie — ton poste, d'où tu ouvres une session
sshvers l'edge. Tu n'as (presque) jamais de clavier sur l'edge : tout se fait à distance.
Partie A — Le terrain & l'accès
- 01Contexte edge & poste d'ingénierieà quoi sert un edge device dans une cellule, l'architecture (S7-1500, OPC-UA, historian/MQTT), Debian &
systemdcomme socle, se connecter la première fois, prendre ses repères (hostnamectl,uptime,df) - 02SSH — gérer & sécuriser l'accèsclés vs mot de passe,
~/.ssh/config, rebond par jump host, tunnels (-L) vers le web du CPU, durcissement desshd, et diagnostiquer une connexion qui échoue avecssh -v
Partie B — État & santé du système
- 03systemd — état des services & remise en route
systemctl status/list-units, unités & dépendances, lire un service failed,restart/enable,systemd-analyze, écrire une unité pour le service edge - 04Journaux avec
journalctljournal systemd, filtrer par unité/priorité/temps (-u,-p,-b,--since), suivre en direct (-f), persistance & rotation, corréler un incident dans le temps - 05Temps & NTP (chrony)pourquoi le temps compte en OT, l'edge comme serveur NTP de la cellule,
chronyc tracking/sources/clients, dérive &makestep, diagnostiquer un client (S7-1500, switch) qui ne se synchronise pas
Partie C — Le service edge en conteneur
- 06Docker sur l'edge — état & diagnostic
docker ps,logs,inspect,stats, healthcheck, réseaux & volumes, comprendre pourquoi un conteneur redémarre en boucle (restart loop) - 07Déploiement Docker
docker compose, images & tags (jamaislatest), registry &pull, mise à jour propre, restart policies, rollback sur incident, service edge piloté par systemd
Partie D — Résilience & synthèse
- 08Sauvegarde & restaurationquoi sauvegarder (config, volumes Docker, compose, unités),
tar/rsync, tirer une sauvegarde sur le laptop, automatiser avec un timer systemd, et surtout tester la restauration - 09Remise en route de bout en bout & méthodologiearbre de décision « le service edge ne répond plus », cas complet du laptop jusqu'au conteneur relancé, runbook & checklist réutilisable, ce qu'on écrit avant de raccrocher
L'edge est souvent le seul point d'entrée numérique d'une cellule en marche. Un
reboot
hâtif, un docker system prune trop large ou un sshd mal reconfiguré peuvent te
couper l'accès à distance — ou couper la remontée de données d'une ligne en production. Les encarts
« Prudence OT » signalent ces gestes à ne pas faire à l'aveugle ; travaille sur un banc de
test avant de toucher au terrain.