Ja, das geht, aber schau dir vorher mal ceph osd tree an. Es kommt drauf an, wie die Host-Buckets im CRUSH heißen. Wenn die bei 01-03 auch mit FQDN drinstehen, wandern die OSDs beim Start nach dem Hostname-Wechsel in einen neuen Bucket...
Das "check that pvestatd runs there" ist irreführend. Schau dir mal die Namen in der Fehlermeldung an: da stehen FQDNs (prod-pve01.emt.local), und das Skript vergleicht Ceph-Daemons über den Hostnamen aus den Metadaten mit den PVE-Node-Namen...
Ich lehne mich mal aus dem Fenster.
Die Community kann nicht prüfen, ob es sich bei der Anfrage um eine legal lizenzierte Software handelt, oder ob hier einfach nur Hilfe beim umgehen von Lizenzierungen auf "nette" Art angefragt wird.
Der...
Die Meldung liest sich für mich eher nach Lizenzdatei als nach reiner CPU-Kennung, da wird ja eine Key-Datei gegen einen Fingerprint geprüft. Wenn in dem Fingerprint mehr steckt als die SMBIOS-UUID, bringt dir das UUID-Setzen allein nichts. Zwei...
Was viele Lizenz-Tools als "CPU UUID" abfragen, ist die SMBIOS-System-UUID (das was wmic csproduct get uuid ausgibt). Die kannst du in PVE einfach mitgeben. Bei ausgeschalteter VM:
qm set <vmid> --smbios1...
Dass pvestatd hängt, ist entscheidend. Der Daemon klappert der Reihe nach alle konfigurierten Storages ab, und wenn eines davon zäh ist oder gar nicht antwortet, bleibt er genau da stehen. Dann wird der Node im Cluster grau, Tasks rennen in...
Dann kannst du die e1000e-Spur eigentlich abhaken: Offloads sind aus, und ein echter Unit Hang würde vorher Detected Hardware Unit Hang ins Log schreiben. Bei dir hört das Log einfach mittendrin auf, das ist was anderes.
Aber prüf vorher noch...
Die Fehlertexte sind im Screenshot abgeschnitten, die Ursache steht da drin. Klick mal nen roten Job an und poste die Meldung bzw. pvesr status plus das Task-Log. "command 'zfs snapshot ...' failed" kann von "dataset already exists" bis Timeout...
Gut, dann steht der Weg zumindest. Damit ist der nächste Freeze der eigentliche Test: wenn der Heartbeat mittendrin abreißt und danach nichts mehr kommt, hast du einen harten Hänger ohne Oops. Ein e1000-Hang würde vorher normal noch Zeilen...
@Query, dass netconsole nichts gezeigt hat bedeutet, dass nichts angekommen ist. Prüf mal ob der Weg überhaupt steht: auf dem Zielrechner nc -u -l 6666 laufen lassen und auf dem Host echo "test" > /dev/kmsg absetzen. Kommt das nicht an, war die...
Danke. Damit ließ sich beides klären.
1. Die Bedingung aus dem Patch ist bei uns erfüllt
ntfsinfo -i 0 -v auf dem gemappten Device zeigt bei der $MFT eine $ATTRIBUTE_LIST mit zwei $BITMAP-Einträgen:
Attribute type: 0xb0 Starting VCN: 0...
Das ist ein lupenreiner Reproducer mit Gegenbeweis, schade wenn das im Thread untergeht. Mach dafür einen Bug auf https://bugzilla.proxmox.com auf. Der Kernel im proxmox-backup-restore-image hängt an einer eigenen, gepinnten Version und wandert...
Dann zieh ich meinen 2^31-Verdacht zurück, dein Reproducer widerlegt das sauber. Der Bitmap-Bug passt besser zum stillen ENOENT.
Bei deinem Kerneltest ist nur der Haken: der 7.0.14-16 hat den Fix gar nicht drin, der hängt ja an 7.1 und in die...
Saubere Vorarbeit, mehr Eingrenzung geht kaum. Bei deinen Zahlen: 18874331135 Sektoren bei 8 Sektoren/Cluster sind ~2,36 Mrd. Cluster, also knapp über 2^31. Mit 4k-Clustern liegt diese Grenze genau bei 8 TiB, und dein C: ist mit ~26 Mio. Clustern...
Die 8,0 GB dedizierter GPU-Speicher aus dem Taskmanager würde ich für die BAR-Frage nicht heranziehen, den Wert meldet Windows aus den Treiberangaben, unabhängig davon wie die BARs tatsächlich gemappt sind. Die Treiberversion steht immerhin drin...
@zeropage dass unter xrdp/mstsc alle Buttons ankommen und nur über SPICE/VNC nicht, spricht eher fürs Protokoll bzw. den SPICE-Client als für den Gast. Lass im Gast mal xev laufen und drück Wheel und die beiden Daumentasten einzeln durch, dann...
Der Hinweis mit dem Repo-Wechsel ist spannend, sowas würd ich nicht gleich als Zufall abtun. Beim Umstellen auf Enterprise ziehst du dir meistens einen ordentlichen Schwung Updates rein, Kernel inklusive. Schau mal in /var/log/apt/history.log...
Der 8125B mit dem Kernel-Treiber r8169 ist so ziemlich der Klassiker für genau sowas. Zwei Verdächtige: EEE und ASPM. ethtool --show-eee <if> zeigt dir, ob EEE aktiv ist, abschalten mit ethtool --set-eee <if> eee off. Der XMG-108 hat EEE ab Werk...
Wenn du errors auf dem Netzwerkport hast, kann das den Durchsatz auch Massiv bremsen. Da solltest du aber auf dem Switchport die Errors hochgehen sehen.
Auch da hilft manchmal ein neues Kabel. ;)