Ich sitze gerade in der Certified Schulung und es kam das Thema, dass bei einem fehlgeschlagenen Update die UTM z.B. aufgrund eines Kernel Panics hängen bleibt. Passiert das an einem Sonntag, kann es das Wochenende versauen und manche Kunden trauen sich nicht, solche Geräte anzufassen.
Hier wäre ein HW-Watchdog eine Lösung. Regelmäßig gibt das System Signale an eine dedizierte Einheit, ähnlich wie ein Lokführer es tut. Bleibt dieses Signal aus, wird die Hardware resettet. Gerade im Updatefall kann dies nützlich sein. So kann das System relativ schnell einen known working Zustand wieder erreichen. Diese Funktionalität gibt's in ähnlicher Form auch bei systemd für Dienste. Wir haben viele gute Erfahrungen mit diesen Systemen machen können.
Vielen Dank für deinen Wunsch! Das ist ein sehr guter Vorschlag, den wir auf jeden Fall im Blick behalten. Aktuell können wir keinen festen Umsetzungszeitraum nennen, halten dich aber über den Status in der Wunschbox auf dem Laufenden.