February 23, 20251 yr Hi zusammen, seit ca. 6 Wochen fährt mein Server gegen Freitagabend/Samstagmorgen eigenständig runter. Es lässt sich nicht auf eine exakte Zeit festlegen, es ist mehr oder weniger +/- 12 Stunden. Der Server wurde auch zwischenzeitlich immer mal wieder neu gestartet, sodass es auszuschließen ist, dass der Server nach einer gewissen Laufzeit ausgeht. Leistungsspitzen oder Stromausfälle kann ich auch ausschließen, da der Serverschrank an einer USV hängt (nicht direkt per USB mit dem Server verbunden) Ich habe keine Ahnung wieso, kann auch nichts in den Logs erkennen, habe kein derartiges User Script gesetzt, habe auch nichts in den BIOS Einstellungen gesetzt. Zum ersten Mal ist das im Urlaub passiert, es war also keiner zuhause. Ich hoffe ihr habt ein paar gute Ideen Danke schon mal
February 24, 20251 yr Community Expert Fährt er denn sauber runter oder geht abrupt aus? Wenn er sauber herunterfährt, dann kann es ja nur ein Befehl sein. Sicher, dass du kein entsprechendes Plugin installiert hast zB das S3 Sleep Plugin? Ansonsten lass den Server mal im Safemode laufen, so dass er ohne Plugins läuft. Ansonsten hätte ich im Dateisystem nach Dateien gesucht, die das Kommando enthalten: grep -rI -e poweroff -e shutdown -e halt /etc /boot | grep -vP ":[[:space:]]*(#|-)" Mein Ergebnis mal zum Vergleich: /etc/slim.conf:halt_cmd /sbin/shutdown -h now /etc/slim.conf:reboot_cmd /sbin/shutdown -r now /etc/slim.conf:shutdown_msg The system is shutting down... /etc/apcupsd/apccontrol:SHUTDOWN=/sbin/shutdown /etc/apcupsd/apccontrol: printf "Continuing with shutdown." | ${WALL} /etc/apcupsd/apccontrol: echo "Battery power exhausted on UPS ${2}. Doing shutdown." | ${WALL} /etc/apcupsd/apccontrol: echo "Battery time limit exceeded on UPS ${2}. Doing shutdown." | ${WALL} /etc/apcupsd/apccontrol: echo "Remaining battery charge below limit on UPS ${2}. Doing shutdown." | ${WALL} /etc/apcupsd/apccontrol: echo "Remaining battery runtime below limit on UPS ${2}. Doing shutdown." | ${WALL} /etc/apcupsd/apccontrol: doshutdown) /etc/apcupsd/apccontrol: ${SHUTDOWN} -h now "apcupsd UPS ${2} initiated shutdown" /etc/inittab:ca::ctrlaltdel:/sbin/shutdown -t5 -r now /etc/rpc:walld 100008 rwall shutdown /etc/modprobe.d/kvm.conf:options kvm ignore_msrs=1 halt_poll_ns=0 /etc/bash_completion.d/docker: COMPREPLY=( $( compgen -W "accepted running shutdown" -- "${cur##*=}" ) ) /etc/bash_completion.d/docker: COMPREPLY=( $( compgen -W "accepted running shutdown" -- "${cur##*=}" ) ) /etc/bash_completion.d/docker: COMPREPLY=( $( compgen -W "accepted running shutdown" -- "${cur##*=}" ) ) /etc/rc.d/rc.6:echo "Running shutdown script $0:" /etc/rc.d/rc.6: shutdown_command="halt" /etc/rc.d/rc.6: shutdown_command=reboot /etc/rc.d/rc.6:if [ -x /etc/rc.d/rc.local_shutdown ]; then /etc/rc.d/rc.6: /etc/rc.d/rc.local_shutdown stop /etc/rc.d/rc.6:[[ -r $CFG ]] && COPY=$(/bin/grep -Pom1 '^syslog_shutdown="\K[^"]+' $CFG) /etc/rc.d/rc.6:$shutdown_command -w /etc/rc.d/rc.6: echo "Clean shutdown" /etc/rc.d/rc.6: echo "Unclean shutdown - Cannot stop md/unraid driver" /etc/rc.d/rc.6:if [ "$shutdown_command" = "reboot" ]; then /etc/rc.d/rc.6: /sbin/poweroff /etc/rc.d/rc.K:if [ -x /etc/rc.d/rc.local_shutdown ]; then /etc/rc.d/rc.K: /etc/rc.d/rc.local_shutdown stop /etc/X11/app-defaults/XSm:*shutdownButton.label: Shutdown /etc/X11/app-defaults/XSm:*shutdownSave.label: With Checkpoint /etc/X11/app-defaults/XSm:*shutdownDontSave.label: Immediately /boot/config/domain.cfg:HOSTSHUTDOWN="shutdown" /boot/config/disk.cfg:shutdownTimeout="90" Also taucht bei dir ein Skript oder ähnliches auf, wo das Kommando drin stecken könnte?
February 24, 20251 yr Author Der letzte Shutdown war am Abend vom 21.02., aber ich weiß nicht ganz genau wann, ich hab es einfach irgendwann gemerkt weil paar Dienste nicht erreichbar waren. Die letzten Zeilen im Log waren: Feb 21 17:54:55 NAS emhttpd: read SMART /dev/sdd Feb 21 17:55:10 NAS emhttpd: read SMART /dev/sdb Feb 21 17:55:10 NAS emhttpd: read SMART /dev/sdc Feb 21 18:01:56 NAS emhttpd: read SMART /dev/sdf Feb 21 18:02:01 NAS emhttpd: read SMART /dev/sde Feb 21 18:57:57 NAS emhttpd: spinning down /dev/sdd Feb 21 18:58:40 NAS emhttpd: spinning down /dev/sdb Feb 21 18:58:40 NAS emhttpd: spinning down /dev/sdc Feb 21 19:02:02 NAS emhttpd: spinning down /dev/sdf Feb 21 19:03:12 NAS emhttpd: spinning down /dev/sde Um 20:16 Uhr kann ich in Homeassistant (läuft auf dem Server) den letzten Datenpunkt sehen vom Stromverbrauch, daher gehe ich davon aus, dass da der Shutdown war. Da sich nichts im Log erkennen lässt, sieht es auch nicht nach einem geplanten Shutdown per Befehl aus. S3 Sleep Plugin hatte ich lange installiert, aber vor ca 1,5 Wochen wegen einem anderen Problem deinstalliert. Ist es also vermutlich auch nicht. Wenn ich deinen Befehl ausführe kommt das folgende dabei raus: /etc/X11/app-defaults/XSm:*shutdownButton.label: Shutdown /etc/X11/app-defaults/XSm:*shutdownSave.label: With Checkpoint /etc/X11/app-defaults/XSm:*shutdownDontSave.label: Immediately /etc/bash_completion.d/docker: COMPREPLY=( $( compgen -W "accepted running shutdown" -- "${cur##*=}" ) ) /etc/bash_completion.d/docker: COMPREPLY=( $( compgen -W "accepted running shutdown" -- "${cur##*=}" ) ) /etc/bash_completion.d/docker: COMPREPLY=( $( compgen -W "accepted running shutdown" -- "${cur##*=}" ) ) /etc/modprobe.d/kvm.conf:options kvm ignore_msrs=1 halt_poll_ns=0 /etc/rpc:walld 100008 rwall shutdown /etc/inittab:ca::ctrlaltdel:/sbin/shutdown -t5 -r now /etc/apcupsd/apccontrol:SHUTDOWN=/sbin/shutdown /etc/apcupsd/apccontrol: printf "Continuing with shutdown." | ${WALL} /etc/apcupsd/apccontrol: echo "Battery power exhausted on UPS ${2}. Doing shutdown." | ${WALL} /etc/apcupsd/apccontrol: echo "Battery time limit exceeded on UPS ${2}. Doing shutdown." | ${WALL} /etc/apcupsd/apccontrol: echo "Remaining battery charge below limit on UPS ${2}. Doing shutdown." | ${WALL} /etc/apcupsd/apccontrol: echo "Remaining battery runtime below limit on UPS ${2}. Doing shutdown." | ${WALL} /etc/apcupsd/apccontrol: doshutdown) /etc/apcupsd/apccontrol: ${SHUTDOWN} -h now "apcupsd UPS ${2} initiated shutdown" /etc/php-fpm.d/www.conf:; shutdown functions are being called (registered via register_shutdown_function). /etc/libvirt/qemu/Ubuntu.xml: <on_poweroff>destroy</on_poweroff> /etc/libvirt/qemu/Homeassistant.xml: <on_poweroff>destroy</on_poweroff> /etc/libvirt/qemu/Windows 11.xml: <on_poweroff>destroy</on_poweroff> /etc/slim.conf:halt_cmd /sbin/shutdown -h now /etc/slim.conf:reboot_cmd /sbin/shutdown -r now /etc/slim.conf:shutdown_msg The system is shutting down... /boot/config/disk.cfg:shutdownTimeout="90" /boot/config/plugins-removed/parity.check.tuning.plg: (stops unclean shutdown warnings happening until array started). /boot/config/plugins-removed/parity.check.tuning.plg: the array without doing it via a shutdown or reboot. /boot/config/plugins/dynamix.system.buttons.plg:Dynamix System Buttons - Single click system reboot and system shutdown /boot/config/plugins/user.scripts/scripts/Autoconvert Folder to Dataset/script:vm_forceshutdown_wait="90" # how long to wait for vm to shutdown without force stopping it /boot/config/plugins/user.scripts/scripts/Autoconvert Folder to Dataset/script: virsh shutdown "$vm" /boot/config/plugins/user.scripts/scripts/Autoconvert Folder to Dataset/script: if (( current_time - start_time >= $vm_forceshutdown_wait )); then /boot/config/plugins/user.scripts/scripts/Autoconvert Folder to Dataset/script: echo "VM $vm has not shut down after $vm_forceshutdown_wait seconds. Forcing shutdown now." /boot/config/plugins/dockerMan/templates-user/my-macinabox.xml: <Config Name="CPUARGS" Target="CPUARGS" Default="Skylake-Server,vendor=GenuineIntel,+hypervisor,+invtsc,kvm=on,+fma,+avx,+avx2,+aes,+ssse3,+sse4_2,+popcnt,+sse4a,+bmi1,+bmi2|Penryn,kvm=on,vendor=GenuineIntel,+kvm_pv_unhalt,+kvm_pv_eoi,+hypervisor,+invtsc,+pcid,+ssse3,+sse4.2,+popcnt,+avx,+avx2,+aes,+fma,+fma4,+bmi1,+bmi2,+xsave,+xsaveopt,+rdrand,check|Penryn,vendor=GenuineIntel,+hypervisor,+invtsc,kvm=on,+fma,+avx,+avx2,+aes,+ssse3,+sse4_2,+popcnt,+sse4a,+bmi1,+bmi2|host,vendor=GenuineIntel,+hypervisor,+invtsc,kvm=on,+fma,+avx,+avx2,+aes,+ssse3,+sse4_2,+popcnt,+sse4a,+bmi1,+bmi2" Mode="" Description=" CPU args for VM" Type="Variable" Display="always" Required="true" Mask="false">Skylake-Server,vendor=GenuineIntel,+hypervisor,+invtsc,kvm=on,+fma,+avx,+avx2,+aes,+ssse3,+sse4_2,+popcnt,+sse4a,+bmi1,+bmi2</Config> /boot/config/plugins/open.files.plg:prevent a clean shutdown of the array and lets you kill those /boot/config/domain.cfg:HOSTSHUTDOWN="shutdown" /boot/config/rsyslog.cfg:syslog_shutdown="" /boot/logs/syslog:Feb 21 20:34:28 NAS emhttpd: unclean shutdown detected /boot/logs/syslog-previous:Feb 18 11:20:59 NAS emhttpd: unclean shutdown detected Aber da steht ja auch der letzte "unclean shutdown" drin mit 20:34 Uhr am Freitag.
February 25, 20251 yr On 2/23/2025 at 8:32 PM, independence said: Ich hoffe ihr habt ein paar gute Ideen um mal das Thema "Strom" besser einschätzen zu können. Ist im BIOS aktiviert dass der Rechner nach Stromausfall wieder angeht ? (on power loss > start, last state, ...) wenn Nein, aktiviere das mal, wenn es Stromaussetzer wären würde der Rechner von alleine wieder angehen, muss man natürlich beobachten. Wenn das bereits aktiviert ist ... bleibt ja nur gesteuerter Shutdown, woher auch immer ...
February 25, 20251 yr Author Werde ich heute mal checken und dann auch so setzen (falls nicht passiert). Was mich da aber auch wundert ist, dass kein anderes Gerät im Serverschrank ausgeht (Router, Modem, APs über PoE, RaspiPi, Switch, usw) -> daher würde ich generell nen Stromausfall ausschließen, da ja auch eine USV vorgeschaltet ist. Zudem treten die Probleme erst seit kurzem auf und das Setup lief vorher unverändert 6 Monate ohne diesen Fehler. Kann natürlich auch ein Hardwaredefekt sein, natürlich nicht auszuschileßen.
February 25, 20251 yr Sitzt nur der Server an der USV? Wie ist die USV denn mit dem Server verbunden, also wie würde die USV bei Stromausfall den Server gesichert herunterfahren? Schon mal probiert, ob das Problem ohne USV auch stattfindet? Auf der Arbeit hatte ich auch mal eine USV, welche nach einem Softwareupdate immer zum Wochenende den vorgeschalteten Server herunter gefahren hat. Daher die USV auch mal kontrollieren.
February 25, 20251 yr Author Hi @BastiKA84, das hab ich versucht im ersten Post zu beschreiben. Hinter der USV hängt der komplette Schrank und es ist keine direkte Verbindung (in dem Fall wäre es USB) zwischen USV und Server vorhanden. Der USV Deamon in Unraid ist daher auch deaktiviert und es findet kein geplantes Herunterfahren statt bei einem Stromausfall. Die USV erfüllt in dem Szenario bei mir also nur den Zweck, dass Lastspitzen und Stromausfälle bis zu 10 Min abgefedert werden (dann ist der Saft der USV leer). Grüße
March 7, 20251 yr Author Hat sich nun alles etwas verzögert aber ich habe Anfang der Woche die komplette Hardware 1:1 ausgetauscht um Probleme am Netzteil oder was auch immer auszuschließen. Vor paar Minuten ist der Server wieder ohne Eingriff heruntergefahren - die Hardware ist es also nicht. Und das Syslog zeigt wieder überhaupt nichts an zwischen 20 und 21 Uhr und ich bin mir recht sicher das der Shutdown zwischen 20:50 und 21:00 Uhr war.
March 7, 20251 yr 14 minutes ago, independence said: Hat sich nun alles etwas verzögert aber ich habe Anfang der Woche die komplette Hardware 1:1 ausgetauscht um Probleme am Netzteil oder was auch immer auszuschließen. Vor paar Minuten ist der Server wieder ohne Eingriff heruntergefahren - die Hardware ist es also nicht. Und das Syslog zeigt wieder überhaupt nichts an zwischen 20 und 21 Uhr und ich bin mir recht sicher das der Shutdown zwischen 20:50 und 21:00 Uhr war. Prüfe mal die Taster am Gehgäuse, ob die alle "normal" arbeiten und nicht hängen. Ich hattge mal vor Jahren sowas in meinem PC - der ging einfach willkührlich aus. Da war der PowerButton der Schuldige.
March 7, 20251 yr Author Ich hab den kompletten Server ausgetauscht und nach wie vor tritt das Problem ausschließlich wöchentlich am Freitagabend auf. Ich glaube sowas wie den Taster am Gehäuse können wir recht sicher ausschließen.
March 8, 20251 yr 9 hours ago, independence said: Ich hab den kompletten Server ausgetauscht und nach wie vor tritt das Problem ausschließlich wöchentlich am Freitagabend auf. Ich glaube sowas wie den Taster am Gehäuse können wir recht sicher ausschließen. ich sag jetzt auch mal ja dazu ... bleiben nur 2 Themen 1/ irgendetwas triggert ja das herunterfahren, plugin, externes tool, script, ... 2/ Strom, hast du jetzt mal ohne USV getestet, sprich, Server an der USV vorbei angeschlossen ? es gibt in UNRaid per se keine "Energiespar Einstellung" dass der Server herunter gefahren wird oder ähnliches ...
March 8, 20251 yr 12 hours ago, independence said: Ich hab den kompletten Server ausgetauscht und nach wie vor tritt das Problem ausschließlich wöchentlich am Freitagabend auf. Ich glaube sowas wie den Taster am Gehäuse können wir recht sicher ausschließen. Ist es vielleicht die Putzfrau die eine Steckdose braucht? Ne Spaß nur spaß. Starte den Rechner doch einfach mal mit einem Linux vom USB Stick und lass ihn stehen. Fährt er auch dann runter weißt du das es nur Hardware oder BIOS sein kann. Bleibt er an ist es UNRAID. Du kannst ja die Zeit einkreisen. Dann stell doch sicher das sich keiner dem Server nähern kann und das wirklich kein Stromausfall zu der Zeit ist. USV hin oder her. Nicht das die da irgendwas triggert im Stromnetz.
March 25, 20251 yr Author Solution So, ich konnte das Problem identifizieren. Am Serverschrank hängt noch ein Shelly Plus S (auf Tasmota geflashed) um den Verbrauch zu messen. Dieser hängt auch in Homeassistant und übertragt die Verbräuche dorthin. Warum auch immer schaltet sich der Plug S für einen Bruchteil einer Sekunde aus und wieder an. Hat also tatsächlich nichts mit Unraid zu tun (sehr gut). Daher kann das Thema hier geschlossen werden.
March 25, 20251 yr Also lag ich mit meiner Putzfrau gar nicht ganz so falsch. Nur das es nicht die Putzfrau sondern der Shelly war.
March 28, 20251 yr On 3/25/2025 at 10:52 AM, independence said: So, ich konnte das Problem identifizieren. Am Serverschrank hängt noch ein Shelly Plus S (auf Tasmota geflashed) um den Verbrauch zu messen. Dieser hängt auch in Homeassistant und übertragt die Verbräuche dorthin. Warum auch immer schaltet sich der Plug S für einen Bruchteil einer Sekunde aus und wieder an. Hat also tatsächlich nichts mit Unraid zu tun (sehr gut). Daher kann das Thema hier geschlossen werden. Das ist ja spannend. Ich habe das gleiche Problem, und auch einen Shelly davor hängen (normale firmware). Wie genau hast du denn den Shelly als Ursache ausgemacht? Mein System geht alle 3-6 Wochen auch plötzlich aus und läuft nach einem Parity Check wieder wochenlang ohne Probleme. Ich wollte gerade das Netzteil tauschen als ich von dem Shelly las. Danke
March 28, 20251 yr Author Ich war abends zufällig in dem Raum und hab das Klacken vom Shelly gehört. Dann hab ich mir das im Log von Homeassistant angeschaut und dann mal reproduziert. Aber wieso das passiert weiß ich nach wie vor nicht. Wollte den Shelly von Tasmota dann auf Original zurückflashen und hab das Teil gebrickt. Finde dann die ursache also eh nicht mehr raus.
March 31, 20251 yr Ich verwende 4 Shellys und einer davon zeigt das gleiche Symptom. Sehr ärgerlich, wenn da was Wichtiges hinten dran hängt. Ich habe ihn dann mal zurückgesetzt, Firmware neu drauf aber das hat nichts geändert. Ich verwende ihn nur mehr für kurzzeitige Stromverbrauchsmessungen etc -faxxe
March 31, 20251 yr Author Ein ähnliches Verhalten hab ich bislang noch nicht mit einem Shelly/Nous oder ähnliches bemerkt, aber nicht bei jedem hängt auch ein Gerät dahinter, wo es wirklich kritisch ist, wenn der Strom für 1 Sekunde weg ist. Auf jeden Fall sehr schlecht, denn das macht den Einsatz natürlich unmöglich.
March 31, 20251 yr Community Expert 1 hour ago, independence said: ...aber nicht bei jedem hängt auch ein Gerät dahinter, wo es wirklich kritisch ist, wenn der Strom für 1 Sekunde weg ist. Auf jeden Fall sehr schlecht, denn das macht den Einsatz natürlich unmöglich. ... wenn man nicht sowieso eine USV zwischen der Shelly und dem unraid System hat.
April 28, 20251 yr Guten Abend, ich habe ja ein Ähnliches Problem. Plötzlich geht der Server aus, kein runterfahren, kein Eintrag im log, einfach AUS. Teilweise nach 4 Wochen, manchmal nach 2 Wochen. Ich hatte die Hoffnung mit dem Shelly, aber er ist auch nicht mehr drin - dennoch heute Mittag ging der Rechner aus. An der USV kein Signal dass der Strom weg war … Das Teil ist wie folg konfiguriert: ASUS Prime H770 D4 Intel i5 12400 H0 Stepping RAM 32GB (2x16GB) 2xSamsung 970 EVO, 4 SATA Seagate Exos 18 Corsair RM750 2021 + 14mm Lüfter headless (kein Monitor / keine Tastatur), hdd spindown Ich weiß gar nicht so richtig wo ich suchen soll, ich überlege als nächstes das Netzteil zu tauschen, aber der Fehler braucht eine Weile bis er Auftritt. ich bin dankbar fur jeden Hinweis !
April 28, 20251 yr Author Schließe den Server mal noch ohne die USV direkt an den Strom an. Bei mir war zusätzlich auch noch der Akku vom der USV tot - zeigte zwar was an, aber beim Stromausfall konnte der Akku nichts mehr puffern.
Join the conversation
You can post now and register later. If you have an account, sign in now to post with your account.
Note: Your post will require moderator approval before it will be visible.