Probleme gibt es immer mal wieder dann, wenn man nicht empfohlene Dinge macht ( wie docker oder podman in lxcs packen) oder die Distribution im Container zu alt ist ( ich würde nicht erwarten, dass Debian 8,9,10 oder Ubuntu 20 Container in...
Das komplette Wegfrieren ohne irgendwas im dmesg/pstore ist wahrscheinlich kein echtes Panic, sondern ein harter Stall, bei dem watchdog-mux nicht mehr dazu kommt den softdog zu füttern -> nach dem Timeout feuert der Software-Watchdog und...
Für gezieltes Rausschmeißen einzelner Snapshots geht die CLI ganz gut, proxmox-backup-client snapshot forget <group>/<zeit> killt genau den einen. Und wenn du mehrere nach bestimmten Kriterien loswerden willst, snapshot list --output-format json...
Korrekt, zum Hintergrund: Die meisten Distributionen (inklusive Debian) haben in ihren Container-Templates mittlerweile systemd und da dessen Sandboxing-Mechanismen den gleichen Kram wie Container brauchen, sind beide Optionen standardmäßig...
Schöner Direktvergleich, das RAW-vs-zfs_send-Verhalten sieht man da echt gut. Beim extern gezogenen Snapshot frag ich mich noch: ziehst du die cv4pve-autosnap-Snapshots mit aktivem qemu-guest-agent? Im VZDump-Log siehst du ja fs-freeze/fs-thaw...
A fix available now: https://pve.proxmox.com/wiki/Roadmap#9.2-known-issues (Point 3) "On Intel hosts, Windows 11/2022/2025 VMs with host CPU type and VBS enabled may intermittently freeze"
Verdammt, hätte ich mal schneller wieder hier reingeschaut. Habs eben selbst festgestellt das es hier schon einen alten Folder gab der diesen owner hatte. Zusammen mit deiner Erkärung nun alles wieder logisch ;-) Backup mit des Pilot Software hat...
Der ethtool-Workaround ist der Standard-Fix für die e1000e-Hänger, ziemlich egal ob den jetzt ne KI oder ein Mensch vorschlägt. tso off gso off gro off auf dem I219 hat bei mir die "Detected Hardware Unit Hang" zuverlässig weggeräumt. Die...
Vielen Dank an alle, die mir beratend unter die Arme gegriffen haben.
Ich habe mit dem Ventoy Stick die aktuellste Version 9.2.2 installiert und meine Backups wieder zurückgespielt. Und alles läuft.
Allein die Tatsache, dass es so etwas wie...
Genau, das ist der fehlende Quorum. Mit zwei Nodes und ohne QDevice hast du bei einem Ausfall nur noch eine Stimme von zweien, also kein Quorum mehr, und pmxcfs geht in read-only. Deshalb kann das Backup die VM nicht mal kurz anfahren.
pvecm...
Das ist der PBS backup-owner-check, hat mit BackupPilot selbst nix zu tun. In PBS gehört jede Backup-Group (dein Backup-Ziel unter host/<name>) genau einem Owner. Die Group gehört schon test-only@pbs, und jetzt willst du mit...
Einerseits ist das durchaus interessant. Anderseits sind gerade "Homelabs" sehr unterschiedlich aufgebaut und lassen sich wohl nur schwierig vergleichen. Vielleicht kannst du einen generischen fio-Test vorschlagen. "Irgendein" Backup laufen zu...
Der Datastore hängt ja direkt auf nem SMB/CIFS-Share von der QNAP (SMB-PBS2), oder? Das ist mMn die Ursache. Der PBS-Chunkstore verträgt sich mit CIFS ziemlich schlecht, fsync und Locking sind da unzuverlässig, und wenn dann noch der IPsec-Tunnel...
@TErxleben danke für den Link. Ja ich verwende nun die integrierte Backuplösung von PBS → USB schon ne ganze weile.
Im Endeffekt läuft es sehr einfach: USB Platte an den PBS hängen, das was man definiert hat, wird automatisch auf die Platte...
Das trifft dich direkt @Enigmaso, deine VM steht laut Screenshot noch auf pc-q35-11.0. Sobald du das Update von heute Nacht drauf hast, den Maschinentyp auf 11.0+pve2 ziehen und die VM komplett runterfahren und neu starten, nicht nur rebooten...
Deine Beobachtung mit der X722 ist eigentlich schon die halbe Miete. Das Ding hängt am i40e-Treiber und der reserviert pro Queue ordentlich Speicher fürs RX/TX-Ring bzw. Page-Pool, und die Queue-Anzahl skaliert mit den CPU-Cores. Bei 8 Cores und...
Was steckt denn als OSD drin, Consumer-SSDs oder Enterprise mit PLP? Frag ich, weil "hängt, SMART sauber, halb voll" klingt ziemlich nach Consumer-SSD ohne Power-Loss-Protection. Die brechen unter Cephs Sync-Writes gern mal auf Sekunden-Latenz...
Für die Replikation schau direkt ins Job-Log: in der GUI beim Gast unter Replication den Job anklicken, da steht meist recht klar drin an welchem Punkt er abbricht. Auf der Shell dazu journalctl -u pvesr. Und parallel pvecm status beobachten...
Zur spa_slop_shift-Frage aus #3: nein, kein Reboot nötig. Das echo ins /sys/module/zfs/parameters/spa_slop_shift greift sofort, ZFS rechnet den Slop-Space live neu. Nur ist der Wert nach nem Reboot wieder auf Default. Wenn dus dauerhaft willst...