Direkt zum Hauptinhalt

Proxmox Best Practice Setup für ZFS und / oder Ceph im Cluster für Einsteiger (Stand Dezember 2024)

Der

Proxmox Verfasser des Artikels, Christian-Peter Zengel, hat zum Zeitpunkt des Artikels ca 15 Jahre ErfahrungCluster mit ZFS und Proxmox.Ceph Er– Best Practices für Einsteiger

Praxiswissen aus rund 150 Proxmox- und ZFS-Systemen

Der Verfasser dieses Artikels, Christian-Peter Zengel, verfügt über rund 15 Jahre Praxiserfahrung mit Proxmox VE und ZFS und betreibt aktuell caetwa 150 Systeme mit Proxmox und ZFS.

DasDie EinsatzgebietErfahrungen gehtreichen von StandaloneinstallationStandalone-Installationen bis hin zu Proxmox-Clustern mit bis zu cazehn 10Hosts. Der Schwerpunkt liegt klar auf ZFS, Replikation, Backup, Monitoring und praxistauglicher Hochverfügbarkeit.

Hinweis: Dieser Artikel versteht sich nicht als Ceph-Expertenleitfaden. Ceph wird hier vor allem zum Funktionsvergleich und als Einstieg behandelt. Für viele kleine und mittlere Installationen bis etwa zehn Hosts im Cluster. Es ist keineZFS mit Replikation in unserer Praxis häufig die einfachere, günstigere und besser beherrschbare Lösung.


Proxmox Best Practice Kurs mit ZFS und Ceph Expertise vorhanden!

DieserDiese Dokumentation basiert auf diesemeinem online KurseOnlinekurs von cloudistboese.de.

18.12.2024 - 11h Proxmox Best Practice Cluster mit ZFS +und Ceph für Einsteiger 

ZFSDer istKurs dievermittelt perfekteeinen Grundlageschnellen, fürpraxisnahen kleineEinstieg in den Aufbau eines Proxmox-Clusters mit ZFS, einfacher Ceph-Grundlage, Backup, Snapshots, Monitoring und mittlereHochverfügbarkeit.

Kunden

komplettAktuelle unverwundbar gegen Ausfall, TrojanerKurse und vorWiederholungen allemauf Dummheitcloudistboese.de zuansehen sein.

Ceph


ist

Für die Basis der höchsten Verfügbar- und Skalierbarkeit

In diesem Kurs vermitteln wir ZFS und Ceph Grundkenntnisse für Proxmox

Achtung: Das Tempo dieses Kurses ist relativ schnell, dafür werden alle Schritte mit Screenshots dokumentiert!

Erwen eignet sich fürdiese den schnellen Einstieg mit mit Wissen aus zuverlässiger Quelle.

Anleitung?

Dauer ca 4h+

    Basisinstallation Proxmox VE mit EFI auf ZFS Installation und Hinweise auf Fehlerbehebung von PVE-Clustern Einrichtung eines einfachen Ceph Clusters Musteranlage einer VM und LXC für höchste Leistung und Platzersparnis Konfiguration einer Hochverfügbarkeit für eine VM Replikation mit Bordmitteln und deren Erfolgskontrolle Automatisches Snapshotting von ZFS + Ceph mit CV4PVE + Admin GUI Einrichtung Proxmox Backupserver auf LVM oder ZFS mit Sicherheitsoptimierung Monitoring mit Check_MK plus Special Agent

    Nach diesem Kurs kannst Du Proxmox im Cluster sicher und einfach betreiben.

    Für erweiterte Trojanerabwehr bitte den Trojanersicherkurs besuchen.

    Trainer/in: Christian Zengel

    Der folgende Artikel eignetrichtet sich besonders füran EinsteigerEinsteiger, Administratoren und IT-Dienstleister, die mit mehr als einem Proxmox-Host imstarten möchten und eine robuste, nachvollziehbare Cluster-Grundlage suchen.

      Proxmox VE mit ZFS installieren Proxmox Cluster startenmit müssen.
      mehreren Nodes aufbauen ZFS-Replikation verstehen und kontrollieren VMs und LXCs performant anlegen einfache Ceph-Grundlagen kennenlernen Proxmox Backup Server integrieren Snapshots, Replikation und Monitoring verbessern Hochverfügbarkeit sinnvoll einordnen

      DerNach Bezugdiesem aufKurs Cephkönnen sollSie lediglicheinen zumkleinen FunktionsvergleichProxmox-Cluster dienen.sicherer Wirplanen, empfehleninstallieren bisund 10 Hosts immer ZFS!betreiben.


      ZFS

      Installationoder Ceph im Proxmox

       Cluster?

      EinZFS System hat extra Plattenist für unserenkleine Workshop,und zweimittlere wurdenProxmox-Installationen bereitseine installiert.sehr starke Grundlage. Durch Prüfsummen, Snapshots, Replikation und einfache Wiederherstellung schützt ZFS zuverlässig vor vielen typischen Problemen wie defekten Datenträgern, versehentlichen Änderungen und manchen Folgen von Ransomware-Angriffen.

      EsZFS kommtersetzt derjedoch kein Backup. Gegen kompromittierte Root-Zugänge, Brand, Diebstahl, vollständigen Standortausfall oder absichtlich gelöschte Snapshots hilft nur ein sauberes Backup- und Replikationskonzept.

      Ceph bietet echten verteilten Storage und hohe Skalierbarkeit, benötigt aber deutlich mehr Hardware, Netzwerkplanung und Betriebserfahrung. Für viele Umgebungen bis etwa zehn Hosts ist ZFS mit Replikation oft wirtschaftlicher und einfacher zu betreiben.


      Installation von Proxmox VE auf ZFS

      Für den Workshop wird ein HPE Microserver Gen10 Plus V2,V2 vorzugsweiseverwendet. Empfehlenswert ist eine Ausstattung mit ECC,ECC-RAM zumund Einsatzdirekt ansprechbaren Datenträgern.

       HPE Microserver Gen10 Plus V2 ansehen

      Bildschirmfoto 2024-12-18 um 11.08.06.jpg Proxmox VE Installation auf HPE Microserver mit ZFS

      Wir installieren mindestensProxmox einenVE Raid1,bevorzugt 10auf ZFS Mirror, RAID10 oder Z,RAIDZ. niemalsHardware-RAID-Controller sollten für ZFS vermieden werden. Empfehlenswert sind Controller im HBA- oder IT-Mode, damit ZFS direkten Zugriff auf Basisdie einesDatenträger Hardware Raid Controllers!erhält.

      Für Cluster dringendsollten alleHostnamen, IPsIP-Adressen, Netzwerke und NamenDNS-Einträge vorhervor klären,der sonstInstallation kommtsauber esgeplant zuwerden. späterenNachträgliche ZusatzarbeitenÄnderungen fürverursachen denhäufig Clusterunnötige Zusatzarbeit.

      Bildschirmfoto 2024-12-18 um 11.08.29.jpg Proxmox VE Installation mit ZFS Storage Auswahl


      Proxmox Cluster mit drei PVENodes erstellen

      Ein Proxmox-Cluster wirdkann insehr Sekundenschnell erzeugt,erzeugt werden. Auch ein einzelner Node alleinekann läuftzunächst problemlos allein laufen. Für echte Cluster-Funktionen und Quorum sollten jedoch mindestens drei Nodes oder ein sinnvoller QDevice-Aufbau geplant werden.

      Bildschirmfoto 2024-12-18 um 11.15.59.jpg Proxmox VE Cluster erstellen

      Bildschirmfoto 2024-12-18 um 11.17.18.jpg Proxmox Cluster Join Informationen anzeigen

      Bildschirmfoto 2024-12-18 um 11.17.34.jpg Proxmox Cluster Konfiguration mit mehreren Nodes

      Cluster

      Weitere Proxmox Nodes hinzufügen

      Weitere Nodes mitwerden denüber Joindie InformationJoin-Informationen des ersten ClusternodesCluster-Nodes inhinzugefügt. derAuf Zwischenlage aufdem neuen Node werden die Informationen unter Join Cluster Einfügeneingefügt. Zusätzlich werden Root-Passwort und RootpasswortCluster-Netzwerk und Clusternetz(e) bereitstellenangegeben.

      Bildschirmfoto 2024-12-18 um 11.17.55.jpg Proxmox VE Join Cluster Dialog

      Bildschirmfoto 2024-12-18 um 11.18.05.jpg Proxmox VE Cluster Join Einstellungen

      Bildschirmfoto 2024-12-18 um 11.18.42.jpg

      Bildschirmfoto 2024-12-18 um 11.20.33.jpgProxmox VE Node wird Cluster hinzugefügt

      DerWährend des Cluster-Beitritts kann der neue Node wird im Vorgangkurzzeitig die Verbindung zum Browser verlieren, da er Schlüssel und Zertifikate des Clusters übernimmt.übernommen Derwerden. BrowserDanach musssollte die Weboberfläche neu geladen werden. Danach ist die Administration von jedem Clustermitglied aus möglich.

      Lokale Storages benötigen lokalen Login zum Einrichten

      Bildschirmfoto 2024-12-18 um 11.21.06.jpg Proxmox Cluster mit mehreren Nodes nach erfolgreichem Join

      Postinstaller für erweiterteProxmox Funktionen

      VE

      Unser Proxmox ZFS Postinstaller vom #BashclubBashclub funktionierthilft ambei bestenvielen mitwiederkehrenden Standalone.Aufgaben nach der Installation.

      Für unserCluster-Setups Setupsollten die Optionen bewusst gewählt werden. Im Workshop verzichten wir beispielsweise auf Autosnapshots für rpool/data, also dem local-zfs Storedata und auf das SSH-Hardening, soweit dies aus Kompatibilitätsgründen

      sinnvoll

      Diese Zusammfassung zeigt die für unser Setup günstigsten Settings, mehr Kontext im Kursist.

      Bildschirmfoto 2024-12-18 um 11.23.17.jpg Bashclub Proxmox ZFS Postinstaller Einstellungen

      Demonstration

      ZFS Raid

      RAID
      demonstrieren und überwachen

      SoftwareZFS-Software-RAID Raidlässt mitsich ZFSim istFehlerfall ultrasehr schnell beianalysieren Problemenund entstört.wiederherstellen. Der direkte Zugriff auf die PlattenDatenträger bringtermöglicht viaein gutes Monitoring und kann Probleme vorfrühzeitig Ausfallsichtbar zummachen.

      Vorschein.

      Im BeispielWorkshop packenwird wirbeispielhaft eine Platte vor einem Reboot offline,offline bittegesetzt. Das ist eine Demonstration und sollte auf produktiven Systemen nicht nachmachen!unüberlegt nachgestellt werden.

       ZFS RAID Status in Proxmox VE

       ZFS Pool mit fehlerhaftem Datenträger in Proxmox

      Das Proxmox-Dashboard zeigt nicht alle Storage-Probleme so deutlich, wie es für den produktiven Betrieb wünschenswert wäre. Für professionelle Umgebungen empfehlen wir zusätzliches Monitoring, zum Beispiel mit Checkmk oder CV4PVE.

      Bildschirmfoto 2024-12-18 um 11.23.54.jpg Proxmox Summary Dashboard ohne deutliche ZFS Fehleranzeige

      Bildschirmfoto 2024-12-18 um 11.24.19.jpg S.M.A.R.T Kontrolle von Datenträgern in Proxmox VE


      VMs und LXCs unter Proxmox richtig anlegen

      TrotzFür defektemmoderne Raidvirtuelle zeigtMaschinen dassollten Summarydashboardheute keinin Problem.der HierRegel mussq35 mitund Check_MKOVMF/UEFI oderverwendet CV4PVEwerden. kontrolliertÄltere werden,Einstellungen oder...wie i440FX und klassisches BIOS sind für neue Systeme meist nicht mehr empfehlenswert.

      Bildschirmfoto 2024-12-18 um 11.24.30.jpg

      Proxmox VE VM Erstellung mit moderner Hardware-Konfiguration

      S.M.A.R.T Kontrolle via GUI aus Erfahrung oft noch ohne Fehler, während unser Check_MK Plugin schon Probleme erkennt!

      Bildschirmfoto 2024-12-18 um 11.24.34.jpg

      Bildschirmfoto 2024-12-18 um 11.24.50.jpg Proxmox VM mit UEFI und TPM Einstellungen

      Mühselige Kontrolle aller Systeme via GUI pro Host ist nicht praxistauglich!!!

      Bildschirmfoto 2024-12-18 um 11.24.53.jpg

      Musterinstallation Linux / Windows als VM

      Der Postinstaller stellt die aktuelle Windows Treiber ISO in der Stabilen Version bereit, der Proxmox Installer das zweite Laufwerk dafür

      Bildschirmfoto 2024-12-18 um 11.28.12.jpg

      Bildschirmfoto 2024-12-18 um 11.28.19.jpg

      i440FX als Maschinentyp und Bios sind inzwischen eher zu vermeiden, schliesslich soll der Kram lange laufen.

      Funfact, i440FX war für die Pro Version des ersten Pentiums, dung ding da ding!


      Bildschirmfoto 2024-12-18 um 11.28.43.jpg

      Proxmox VE legt im ZFS oder Ceph ebenfalls einen Blockstorage für TPM und EFI Einstellungen an, diese werden Raw ohne Dateisystem geschrieben und haben nichts mit der EFI-Boot-Partition zu tun.

      Die native Bildschirmauflösung des Systems wird in der VM beim Starten mit ESC eingestellt.

      Der Virtio

      VirtIO SCSI singleSingle: Controllergute wirdPerformance im Host alsund eigener Prozess und im Gast als eigener Controller pro Disk aktiviertQEMU

      DerGuest QemuAgent:

      Agent sorgtwichtig für Shattenkopien,Shutdown, Freezing,Freeze, HerunterfahrenIP-Erkennung und mehr!Backups
      Discard

      Bildschirmfoto 2024-12-18 um 11.29.33.jpg

      Die Kombination von Discard,und SSD Emulation, wie auch IO thread gibtEmulation:

      bessere AuslastungRückgabe undgelöschter Entlastung von gelöschten DatenBlöcke an den Host
      IO

      Bildschirmfoto 2024-12-18 um 11.30.01.jpg

      Thread:
      bessere

      Entkopplung von I/O-Last

      CPU Typ HostHost: istideal fürbei identischeidentischer HardwareHardware, vorsichtig bei gemischten CPUs im Cluster Ballooning: ermöglicht dynamischere RAM-Nutzung, benötigt aber passende Treiber

       VirtIO SCSI Single Controller in Proxmox VE

       Proxmox VM Disk Einstellungen mit Discard SSD Emulation und IO Thread

       Proxmox CPU Typ Host für virtuelle Maschinen

       Proxmox Memory Ballooning für virtuelle Maschinen

       VirtIO Netzwerkkarte für Proxmox VM


      ZFS-Replikation in ClusternProxmox und Standalone zu bevorzugen, da hier alle Prozessorfunktionen genutzt werden

      Bildschirmfoto 2024-12-18 um 11.30.41.jpg

      Ballooning spart RAM beim einschalten und macht noch mehr. Treiber unter Windows sind notwendig

      Bildschirmfoto 2024-12-18 um 11.31.00.jpg

      Virtio Netzwerkkarten brauchen unter Windows eigene Treiber, performen aber bis 100Gbit

      Bildschirmfoto 2024-12-18 um 11.31.21.jpg

      VE

      Die eingebaute ZFS-Replikation von Proxmox VE ist erstfür malviele gutkleine genug,und auchmittlere wennCluster eseine mitsehr Zsyncgute besserGrundlage. geht.Bei Dafürvorhandener hatReplikation man,liegt leiderder nurgrößte inTeil der VM hier, Kontrolle über den Erfolg. Löscht man den Job, löscht sich das Replikat

      Das Zeitfenster ist mit 15-60 Minuten optimal, mit einer Minute perfekt. Jedoch sollte man nicht jede VMbereits auf einedem Minute stellen. da hier das ZFS Auflisten zu Timeouts führt. 

      Autosnapshotting ist nicht vorgesehen, leider!

      Bildschirmfoto 2024-12-18 um 11.32.04.jpg

      Bildschirmfoto 2024-12-18 um 11.32.23.jpg

      Linux unterstützt alle Virtio LaufwerkeZielsystem und Netzwerkkarten nativ

      Bildschirmfoto 2024-12-18 um 11.37.48.jpg

      Installation Ceph

      Der Assistent installiert die notwendigen Repositories. Wir empfehlen hier wenigstens die Community Subscription zu nehmen, da ein defekter Ceph-Cluster ein Single-Point-of-Failure ist

      Bildschirmfoto 2024-12-18 um 11.44.26.jpg

      Bildschirmfoto 2024-12-18 um 11.44.39.jpg

      Bildschirmfoto 2024-12-18 um 11.46.22.jpg

      Bildschirmfoto 2024-12-18 um 11.46.26.jpg

      Die Auswahl der Netze für Cluster, Ceph, Rendundanz und weitere Segmentierungen sollten von einem Erfahrenen Fachmann vorgenommen werden. Wir empfehlen hier Inett aus Saarbrücken

      Im aktuellen Setup können wir zum Testenmuss nur dasinkrementell LAN nehmen, das wir ausdrücklich so nicht empfohlen!!!

      Bildschirmfoto 2024-12-18 um 11.47.07.jpg

      Bildschirmfoto 2024-12-18 um 11.47.37.jpg

      Die Installation muss auf allen Clustermitgliedern wiederholt werden, wobei die Konfiguration via PVE Cluster übernommen wird

      Jeder Host bekommt mindestens eine SSD als sog. OSD, ab drei Stück haben wir einen funktionierenden Ceph Cluster, ohne extra Sicherheit. Als Nettonutzplatz erhalten wir 1/3 der SSDs, in dem Fall knapp 1TB

      Auf keinen Fall dafür in irgendeiner Weise Hardware Raid Controller nutzen!!!

      Bildschirmfoto 2024-12-18 um 11.52.59.jpg

      Ceph OSD Einrichtung

      Bildschirmfoto 2024-12-18 um 11.53.32.jpg

      Bildschirmfoto 2024-12-18 um 11.53.55.jpg

      Ceph Pool anlegen

      Der Pool verbindet die OSDs zum Verbund, die Rolle Monitor und Manager können auf mehrere Nodes verteilt werden, sonst wäre der Reboot des ersten Nodes nicht ohne Schaden möglich!

      Bildschirmfoto 2024-12-18 um 11.54.36.jpg

      Bildschirmfoto 2024-12-18 um 14.49.23.jpg

      VM Migration Node zu Node

      Die Übertragung einer laufenden VM oder eines LXC mit Shutdown ist bei ZFS und Ceph möglich.

      Wärend bei CEPH der Speicher verteilt ist, muss bei ZFS RAM und Disk nocheinmalübertragenergänzt werden.

      BeiOhne vorheriger ZFS Replikation ist das meiste der VM schon auf dem Ziel und kann inkrementell ergänzr werden.

      Gab es vorher keinevorherige Replikation muss die komplette VM oder der komplette Container übertragen werden. Je nach Zustand erfolgt die Übertragung über KVM-Mechanismen oder ZFS. Dabei kann es Unterschiede beim Erhalt von Snapshots geben.

       Proxmox VE ZFS Replikation einrichten

       Proxmox VE Replikationsjob für VM

      Replikationsintervalle von 15 bis 60 Minuten sind für viele Umgebungen ein guter Kompromiss. Eine Minute ist technisch möglich, sollte aber nicht pauschal für jede VM verwendet werden.


      Ceph-Grundlagen im Proxmox Cluster

      Ceph ermöglicht verteilten Storage innerhalb eines Proxmox-Clusters. Dadurch können VMs auf gemeinsamem Storage liegen und bei passender Architektur sehr flexibel zwischen Nodes betrieben werden.

      DasCeph Mittelbenötigt derjedoch Übertragungsorgfältige istPlanung, jegeeignete nachNetzwerke, Zustandpassende derHardware VMund viaausreichende KVM oder ZFS möglich.Redundanz.

      ErsteresFür würdeproduktive Ceph-Cluster empfehlen wir mindestens eine Proxmox-Subscription und erfahrene Planung. Ein fehlerhaft aufgebauter Ceph-Cluster kann selbst zum Verlustkritischen vonAusfallrisiko Snapshots führen!werden.

      Bildschirmfoto 2024-12-18 um 11.56.37.jpg Ceph Installation in Proxmox VE starten

      Bildschirmfoto 2024-12-18 um 11.56.53.jpg Ceph Netzwerk und Cluster Einstellungen in Proxmox VE

      Klonen

      Die zwischenAuswahl ZFSder Netzwerke für Cluster, Ceph, Redundanz und Cephweitere

      Segmentierungen sollte durch erfahrene Fachleute erfolgen. Für produktive Ceph-Umgebungen sollte das normale LAN nicht einfach mitverwendet werden.

      Proxmox kannCeph Public und Cluster Network in Proxmox VE mit

      Bordmitteln

      Ceph OSDs und Pools einrichten

      Jeder Host benötigt geeignete Datenträger als OSDs. Für ein einfaches Testsetup reichen drei OSDs, produktiv sollte Ceph jedoch deutlich sorgfältiger und redundant geplant werden.

      Hardware-RAID-Controller sollten auch für Ceph nicht verwendet werden. Ceph benötigt direkten Zugriff auf die meisten Formate konvertieren.Datenträger.

      Bildschirmfoto 2024-12-18 um 11.58.52.jpg

      Qemu-Guest-AgentCeph OSD in Proxmox VE erstellen Installation

      Dieses Paket für geordnetes Herunterfahren immer mitinstallieren und starten!

      Bildschirmfoto 2024-12-18 um 12.02.01.jpg

      IO Leistung der Systeme bei diesen Voraussetzungen

      ZFS ist dreimal schneller und auf zwei Kisten verfügbar

      Wir gehen von der sechsfachen benötigten Leistung aus um Leistungsmässig an ZFS Raid1 zu kommen

      Bildschirmfoto 2024-12-18 um 12.11.17.jpg

      Login für Root und PVE User mit zwei Faktor absichern!

      Bildschirmfoto 2024-12-18 um 12.11.21.jpg

      Bildschirmfoto 2024-12-18 um 12.11.35.jpg Ceph Pool in Proxmox VE anlegen

      Monitor- und Manager-Rollen sollten auf mehrere Nodes verteilt werden. Andernfalls kann bereits ein Reboot eines einzelnen Nodes zu Problemen führen.


      Migration zwischen Nodes

      Die Migration laufender VMs oder gestoppter LXCs ist sowohl mit ZFS als auch mit Ceph möglich. Der wesentliche Unterschied liegt im Storage-Konzept.

        Ceph: Speicher liegt verteilt im Cluster ZFS: Speicher muss auf dem Zielhost vorhanden sein oder übertragen werden ZFS mit Replikation: nur die Änderungen müssen ergänzt werden ZFS ohne Replikation: vollständige Übertragung notwendig

         Proxmox VE Migration einer VM zwischen Nodes

        Bildschirmfoto 2024-12-18 um 12.12.09.jpg Proxmox Klonen zwischen ZFS und Ceph Storage


        QEMU Guest Agent installieren

        WeitereDer UserQEMU benötigenGuest entsprechendeAgent Rechte!sollte in virtuellen Maschinen immer installiert und aktiviert werden. Er ermöglicht geordnetes Herunterfahren, bessere Backup-Konsistenz, IP-Erkennung und weitere Verwaltungsfunktionen.

        Bildschirmfoto 2024-12-18 um 12.12.28.jpg QEMU Guest Agent Installation in Proxmox VM


        Proxmox Sicherheit: 2FA, SSH und Netzwerksegmentierung

        Zwei-Faktor-Authentifizierung aktivieren

        LoginRoot- Realmund istProxmox-Benutzer Linuxsollten Usermit oderZwei-Faktor-Authentifizierung Proxmoxabgesichert Userbasiswerden.

        Es könnenProxmox VE Zwei Faktor Authentifizierung aktivieren in der GUI keine weiteren Linux/PAM User angelegt werden, jedoch GUI aktiviert

        Bildschirmfoto 2024-12-18 um 12.12.49.jpg Proxmox VE Benutzer mit 2FA absichern

        SSH Daemon gegen Passwort Passwort-Login absichern

        Bildschirmfoto 2024-12-18 um 12.13.29.jpgSSH-Zugänge sollten nach Möglichkeit nur mit Schlüsseln und ohne Passwort-Login betrieben werden.

        Bildschirmfoto 2024-12-18 um 12.13.39.jpg Proxmox SSH Daemon gegen Passwort Login absichern

        Eigene virtuelle Switche für VMsVerwaltungsnetz trennen das Verwaltungsnetz ab

        Wenn die ResourcenRessourcen vorhanden sind, dringendsollten dafür sorgen daß AnwenderAnwender- und Gast Gast-VMs keinen direkten Zugriff auf Proxmox VE, SwitcheSwitches undoder Firewalls habenerhalten.

        Bildschirmfoto 2024-12-18 um 12.14.57.jpg Proxmox VE virtuelle Switche zur Trennung von Verwaltungsnetz und VM Netz

        Replikationen zuverlässig prüfen

        Ein Blick auf ZFS klärtallein zeigt nicht zuverlässig, welche VM gerade auf welchem Host aktiv ist!ist.

        Deshalb

        PVE1müssen Replikationen kontrolliert und zweinachvollziehbar sindüberwacht aufwerden.

        den

        Das erstenProxmox BlickDashboard zeigt defekte Platten, RAID-Probleme und Replikationsfehler nicht zuimmer unterscheiden,so auchzentral, nichtwie mites Snapshotauflistungfür größere Umgebungen wünschenswert wäre. Deshalb sollten Checkmk, CV4PVE oder eigene Prüfwerkzeuge eingesetzt werden.

        Bildschirmfoto 2024-12-18 um 12.20.07.jpg Proxmox VE Replikationen pro VM prüfen

        Bildschirmfoto 2024-12-18 um 12.20.50.jpg Proxmox Dashboard ohne zentrale Anzeige aller ZFS Replikationen


        Proxmox Konfiguration sichern

        Die Proxmox-Konfiguration liegt in einer Cluster-Datenbank und wird unter /etc/pve eingebunden. Unser erweitertesPostinstaller Ablagekonzeptkann machtdiese dieKonfiguration Funktionregelmäßig vonnach abgelegten/rpool/pveconf Datensichern vielund deutlicher.mit MehrZFS-Autosnapshots auf cloudistboese.de

        Bildschirmfoto 2024-12-18 um 12.21.29.jpghistorisieren.

        Bildschirmfoto 2024-12-18 um 12.25.09.jpg Proxmox Konfiguration mit Rsync und ZFS Auto Snapshot sichern

        Prüfung der Replikationen muss mühselig pro VM vorgenommen werden

        image.jpeg

        Bildschirmfoto 2024-12-18 um 12.25.56.jpg

        Leider zeigt das PVE Dashboard weder defekte Platten, noch Raids oder Replikationen in der Übersicht an. Hier wird später Check_MK oder CV4PVE für Übersicht sorgen müssen!

        Bildschirmfoto 2024-12-18 um 12.26.11.jpg

        Bildschirmfoto 2024-12-18 um 12.26.55.jpg

        Postinstaller sichert komplette Konfiguration und dessen Historie

        Hochverfügbarkeit mit RsyncProxmox und ZFS-Auto-Snapshot

        Üblicherweise nutzen wir zfs-auto-snapshot gnadenlos auf alle Datasets und Volumes

        HA

        Die Proxmox Konfiguration liegt jedoch in einer Datenbank und wird nach /etc/pve gemountet

        Diesen Ordner sichern wir regelmässig nach /rpool/pveconf und bauen mit Autosnapshots eine Historie

        Bildschirmfoto 2024-12-18 um 12.28.52.jpg

        Hochverfügbarkeit einer VM / HA

        Die HA HA-Engine sorgt dafürdafür, daßdass VMs /oder LXCLXCs beibeim Ausfall eines Hosts auf einem anderen Host gestartet werden.werden können.

        DerWichtig Übergangist dauertdie mindestensUnterscheidung:

        zwei
        Minuten, wobei nur bei SANCeph oder CEPHSAN: keinStorage Datenverlustist entstehtgemeinsam verfügbar ZFS-Replikation: es kann die Replikationslücke verloren gehen HA mit ZFS: gut für Dienste mit tolerierbarem Datenverlustfenster

        Bei ZFS verlierthängt mandas diermögliche dieDatenverlustfenster Replikationslücke!

        vom

        Replikationsintervall ab. Daher eignet sie  sich amHA bestenmit ZFS besonders für FirewallsSysteme undwie Firewalls, Telefonanlagen

        oder


        Dienste,
        bei

        Diedenen HAein Gruppekurzer definiertRückstand dievertretbar gewünschte Ausführungspriorität, wobei höher mehr Prio hatist.

        Prio 1Proxmox HA Gruppe mit Prioritäten konfigurieren ist am niedrigsten

        Bildschirmfoto 2024-12-18 um 13.20.48.jpg

        Die VMs werden den Gruppen zugewiesen und definieren unseren Wunschort und Zustand

        Bildschirmfoto 2024-12-18 um 13.21.03.jpg

        Da PVE1 die höchste Priorität hatte wird VM 100 sofort dort hin migriert, die Replikation umgedreht

        Bildschirmfoto 2024-12-18 um 13.21.24.jpg

        Bildschirmfoto 2024-12-18 um 13.21.43.jpg Proxmox VM einer HA Gruppe zuweisen

        Wird ein Node regulär neu gestartet, werden die VMs nicht automatisch umgezogen, sondern heruntergefahren.

        Die Weboberfläche eines anderen Nodes muss dann geöffnet werden, diesollten VMs vorher umgezogenbewusst werden!migriert werden. Ein Reboot ersetzt keine geplante Wartung.


        Snapshots

        Bildschirmfoto 2024-12-18 um 13.24.15.jpg

        Bei Ceph sollte es kein Problem sein einen Node neuzustarten, jedoch muss dafür der Cluster redundant gebaut sein. Sonst besser alle VMs stoppen

        Bildschirmfoto 2024-12-18 um 13.30.54.jpg

        Bildschirmfoto 2024-12-18 um 13.33.21.jpg

        Manuellemanuell und automatischeautomatisch Snapshots

        nutzen

        Manuelle Snapshots viaüber die Proxmox GUI oder API werden mitabhängig demvom passendendarunterliegenden DatastoresnapshotStorage ausgeführt,erzeugt also– beispielsweise auf ZFS, Ceph oder KVManderen Storage-Backends.

        Bildschirmfoto 2024-12-18 um 13.36.44.jpg

        Bei ZFS werden diese Snapshot-Zustände mitrepliziert und diein Konfigurationsdateider umVM-Konfiguration diesen Zustand erweitertsichtbar.

        Bildschirmfoto 2024-12-18 um 13.37.17.jpg Manuellen Snapshot in Proxmox VE erstellen

        Bildschirmfoto 2024-12-18 um 13.37.27.jpg ZFS Snapshot einer Proxmox VM

        Bildschirmfoto 2024-12-18 um 13.37.32.jpg


        Automatische

        CV4PVE-Admin Snapshotsfür Snapshots, Monitoring und ManagementReplikationen

        mit

        CV4PVE-Admin

        kann eine sinnvolle AlternativeErgänzung zu zfs-auto-snapshotProxmox seinVE sein. Es bietet bessere Übersicht über Replikationen, Snapshots und ergänztbestimmte wichtige, fehlende Einblicke der PVE GUIMonitoring-Funktionen.

        Bildschirmfoto 2024-12-18 um 13.38.57.jpg CV4PVE Admin für Proxmox VE Monitoring und Snapshots

        Bildschirmfoto 2024-12-18 um 13.39.11.jpg CV4PVE Admin Übersicht aller Proxmox Replikationen

        Bildschirmfoto 2024-12-18 um 13.40.57.jpg

        Diese Anleitung scheint die sinnvollste, bitte auf eigene Maschine

        Bildschirmfoto 2024-12-18 um 13.42.06.jpg

        Bildschirmfoto 2024-12-18 um 13.45.00.jpg

        Eigener PVE User plus gewünschte Rechte sind hier erklärt

        Bildschirmfoto 2024-12-18 um 13.45.15.jpg

        Bildschirmfoto 2024-12-18 um 13.45.28.jpg

        Bildschirmfoto 2024-12-18 um 13.45.40.jpg

        Bildschirmfoto 2024-12-18 um 13.45.52.jpg

        Bildschirmfoto 2024-12-18 um 13.45.54.jpg

        Bildschirmfoto 2024-12-18 um 13.46.13.jpg

        Bildschirmfoto 2024-12-18 um 13.46.25.jpg

        Bildschirmfoto 2024-12-18 um 13.47.36.jpg

        Alle Replikationen mit Bordmitteln im Blick, nicht mehr jede VM muss aufgeklappt werden

        Bildschirmfoto 2024-12-18 um 13.48.50.jpg

        Automatische Snapshots können hierdort definiert werden,werden. jedochWichtig mussist, dass das TeilSystem aufzuverlässig laufen

        läuft
        und

        Bildschirmfoto 2024-12-18 um 13.51.18.jpgüberwacht wird.

        Bildschirmfoto 2024-12-18 um 13.52.50.jpg Automatische Snapshots mit CV4PVE Admin konfigurieren

        Bildschirmfoto 2024-12-18 um 13.53.32.jpg


        Bildschirmfoto 2024-12-18 um 13.53.32.png

        Bildschirmfoto 2024-12-18 um 13.53.50.jpg

        ZFS Snapshots können via GUI nur einzeln zurückgerollt werden, hier ist Ceph im Vorteil

        Bildschirmfoto 2024-12-18 um 13.53.50.png

        Bildschirmfoto 2024-12-18 um 13.54.03.jpg

        Bildschirmfoto 2024-12-18 um 13.54.03.png

        Bildschirmfoto 2024-12-18 um 13.56.34.png

        Replikation bricht nicht bei Rollback

        Bildschirmfoto 2024-12-18 um 13.56.57.png

        Proxmox kann von HW Raid, ZFS, BTRFS, jedoch nicht von Ceph booten

        Den Ceph Zustand kann man nicht mit Check_MK Bordmitteln prüfen

        Bildschirmfoto 2024-12-18 um 13.57.50.jpg

        Datensicherung mit Proxmox Backup Server

        Proxmox kann nativ erst mal nur eine Vollsicherung

        Erst der

        Proxmox Backup Server bringteinrichten

        inkrementelle

        Proxmox VE kann klassische Backups erstellen. Der Proxmox Backup Server ergänzt inkrementelle, deduplizierte Backups, zentrale Verwaltung, Verify Jobs, Prune Jobs und ManagementGarbage Collection.

        ErPBS kann auf eineneigener bestehendenHardware, PVEin installierteiner werden,VM alternativoder in bestimmten Szenarien auch als LXC betrieben werden. Für produktive Backups ist ein dediziertes, abgesichertes System vorzuziehen.

        Bildschirmfoto 2024-12-18 um 14.03.19.jpg

        Proxmox Backup Server Installation

        Die Repos fehlen jedoch hier

        Bildschirmfoto 2024-12-18 um 14.05.51.jpg

        Bildschirmfoto 2024-12-18 um 14.06.08.png Proxmox Backup Server Weboberfläche Port 8007

        Für den Datastore empfehlen sich lokale Dateisysteme oder geeignete Storage-Anbindungen. SMB verursacht in vielen Umgebungen zusätzlichen Overhead und ist für PBS meist nicht die beste Wahl.


        Backup-Benutzer, Token und Rechte

        HierFür wäreBackups aktuellsollte Bookwormein eigener Backup-Benutzer mit Token verwendet werden. Root-Zugänge und Backup-Zugänge sollten mit Zwei-Faktor-Authentifizierung abgesichert werden.

        Der

        Benutzer oder Token benötigt die Berechtigung Datastore Backup.

        Bildschirmfoto 2024-12-18 um 14.08.51.png Proxmox Backup Server Benutzer mit Zwei Faktor Authentifizierung

        Bildschirmfoto 2024-12-18 um 14.09.02.png Proxmox Backup Server API Token für Backup Benutzer erstellen

        Bildschirmfoto 2024-12-18 um 14.09.20.png Proxmox Backup Server Rechte Datastore Backup vergeben


        Zugriff

        Proxmox Backup Server in diesemProxmox FallVE viaeinbinden

        PVE3

        Für aufdie PortEinbindung 8007des mitProxmox SSLBackup Servers in Proxmox VE werden mehrere Angaben benötigt:

          Name des Datastores in Proxmox VE Serveradresse des PBS Datastore-Name im PBS Benutzer oder Token Token Secret Fingerprint des PBS-Zertifikats

          Bildschirmfoto 2024-12-18 um 14.09.48.jpg Proxmox VE Backup Storage mit Proxmox Backup Server verbinden

           Proxmox Backup Storage in allen PVE Nodes verfügbar

          Das Dateisystemlokale könnte mit BTRFS, ZFS oder Ext4 bereitgestellt werden, wobei Ext4 keine Snapshots zum AbsichernBootvolume von BackupsProxmox beherrscht,VE dafürsollte 100%nicht Platzausnutzungals Backup-Ziel verwendet werden.

          Bildschirmfoto 2024-12-18 um 14.18.43.png


          Backups, Prune, Garbage Collection und Verify

          Bildschirmfoto 2024-12-18 um 14.19.30.jpg

          Das
          erste

          DerBackup Backupstoreeiner wirdVM alsist Mountpointin bereitgestellt.der SMBRegel performtein hiervollständiger sehrDurchlauf. schlecht

          Root User plus BackupuserDanach werden mit 2faDirty abgesichert!

          Bildschirmfoto 2024-12-18 um 14.24.09.jpg

          Bildschirmfoto 2024-12-18 um 14.24.13.jpg

          Bildschirmfoto 2024-12-18 um 14.24.25.jpg

          Bildschirmfoto 2024-12-18 um 14.24.32.jpg

          Für die Sicherung benötigen wir einen Token auf den Backupuser

          Bildschirmfoto 2024-12-18 um 14.24.45.jpg

          Backup BenutzerBitmap und -TokenDeduplizierung benötigennur dienoch Berechtigunggeänderte DatastoreDaten Backup

          effizient

          Bildschirmfoto 2024-12-18 um 14.25.28.jpg

          Bildschirmfoto 2024-12-18 um 14.25.34.jpg

          Bildschirmfoto 2024-12-18 um 14.25.44.jpg

          Für den Datastore in PVE benötigen wir mehrere Parameter

          Bildschirmfoto 2024-12-18 um 14.26.11.jpg

          Oben den Datastorenamens seitens PVE, den Tokennamen wie sein Passwort.

          Auf der Rechten Seite der Datastorename aus dem PBSübertragen und unten dessen Fingerabdruck, den wir auf der Startseite des PBS findengespeichert.

          Bildschirmfoto 2024-12-18 um 14.27.28.jpg

          Danach taucht der Backupstore in jedem PVE auf, wenn gewünscht

          Bildschirmfoto 2024-12-18 um 14.27.49.jpg

          Achtung, das Bootvolume von PVE ist per Default auch als Backupstore definiert, weg damit!

          Bildschirmfoto 2024-12-18 um 14.28.24.jpg

          Bildschirmfoto 2024-12-18 um 14.28.30.jpg

          Bildschirmfoto 2024-12-18 um 14.28.31.jpg

          Erstes manuelles Backup zeigt den Dirty-Bitmap Status: created-new, was eine Vollsicherung bedeutet

          Bildschirmfoto 2024-12-18 um 14.29.02.jpg

          Bildschirmfoto 2024-12-18 um 14.29.19.jpg

          Bildschirmfoto 2024-12-18 um 14.30.15.jpg

          Die zweite Sicherung wird dann inkrementell durchgeführt, bis die VM gestoppt wird!!!

          Bildschirmfoto 2024-12-18 um 14.30.40.jpg

          Bildschirmfoto 2024-12-18 um 14.31.05.jpg

          Löschen einer Sicherung ist gewollt nicht über PVE möglich, in PBS kann man das manuell durchführen oder automatisch.

          Der Platz wird erst nach einem Prune lauf freigegeben!

          Bildschirmfoto 2024-12-18 um 14.31.11.jpg

          Bildschirmfoto 2024-12-18 um 14.31.34.jpg

          Nach einem Stop der VM oder Reboot des Hosts oder Stoppen des Gasts wirdkann wieder eineein Vollsicherungvollständiger durchgeführt,Scan notwendig werden. Durch Chunk-Deduplizierung werden jedoch nur neue oder geänderte Chunks aufgespeichert.

          das

          ZielErstes manuelles Backup mit Proxmox Backup Server geschrieben.

          Dadurch

          gehtInkrementelles Backup mit Proxmox Backup Server das

          auch

          Prune nochJobs

          relativ

          Prune flott.Jobs Siehedefinieren dieAufbewahrungszeiten. MBDer angabenProxmox-Simulator untenhilft bei der Sicherung

          Prüfung
          der

          Bildschirmfoto 2024-12-18 um 14.32.32.jpg

          Regeln.

          Bildschirmfoto 2024-12-18 um 14.33.02.jpg Proxmox Backup Server Prune Job konfigurieren

          Garbage

          Für den automatischen Lauf immer VMs ausschliessen oder alles mitnehmen. Eine Auswahl der VMs führt zu Fehlern über die Zeit durch Unterlassung

          Bildschirmfoto 2024-12-18 um 14.35.48.jpg

          Die Retention, also das Aufräumen hier ist nicht sinnvoll, noch möglich

          Bildschirmfoto 2024-12-18 um 14.36.48.jpg

          In Prunejobs regelst Du die Aufhebezeiten und die Ausführung der Regel, was aber nur für die Auswahl relevant ist. Der Vorgang geht relativ schnell

          Der Simulator von Proxmox hilft dabei

          Bildschirmfoto 2024-12-18 um 14.37.41.jpg

          Bildschirmfoto 2024-12-18 um 14.38.41.jpg

          Bildschirmfoto 2024-12-18 um 14.38.50.jpg

          Collection

          Die Garbage Collection räumt dann alle Junks auf die in keinem Backupnicht mehr benötigtbenötigte Chunks auf. Dieser Vorgang kann Last erzeugen und sollte sinnvoll geplant werden.

          Der VorgangProxmox Backup Server Garbage Collection starten hat hohe Last und dauert, also bei Stilstand ausführen

          Bildschirmfoto 2024-12-18 um 14.39.20.jpg

          dBildschirmfoto 2024-12-18 um 14.40.54.jpg

          Verify

          Jobs

          Der Verify JobJobs überprüftprüfen regelmässig die Vollständigkeit der Junks undregelmäßig die Integrität der Backups. Der Erfolg wird insowohl derim RechtenPBS Spalteals auch in PVEProxmox undVE PBS angezeigt

          Bildschirmfoto 2024-12-18 um 14.41.35.jpgangezeigt.

          Bildschirmfoto 2024-12-18 um 14.41.55.jpg Proxmox Backup Server Verify Job zur Integritätsprüfung

          Bildschirmfoto 2024-12-18 um 14.42.01.jpg


          Optional

          Optional: Replikationskontrolle mit checkzfs von #Bashclub

          Mit checkzfs vom Bashclub können ZFS-Replikationen zusätzlich kontrolliert werden. Da unklarnicht istimmer sofort erkennbar ist, welcher Host gerade welche ZFS MaschineVM aktiv betreibt, bleibtkann uns nur denein Vergleich allerder Datastores gegeneinander.hilfreich sein.

          Der VorgangCheck sollte nurnicht während laufender Replikationen ausgeführt werdenwerden, wennda geradedies keinezu ReplikationFehlmeldungen läuf,führen sonst spuckt er Fehlerkann.

          Bildschirmfoto 2024-12-18 um 14.59.16.jpg checkzfs Replikationskontrolle für Proxmox ZFS Cluster

          Bildschirmfoto 2024-12-18 um 15.01.43 1.jpg CV4PVE als Alternative zur Replikationskontrolle in Proxmox

          Bildschirmfoto 2024-12-18 um 15.01.43.jpg


          Bildschirmfoto 2024-12-18 um 15.01.45.jpg

          Fazit:

          Proxmox Cluster mit ZFS bewusst planen

          Für diesenviele Anwendungsfallkleine und mittlere Umgebungen ist eventuellein CV4PVEProxmox-Cluster einfacher,mit daZFS, esReplikation, auchProxmox vieleBackup TeileServer vomund gutem Monitoring übernimmteine sehr leistungsfähige und wirtschaftliche Lösung.

          Ceph ist besonders interessant, wenn echter verteilter Storage, hohe Skalierung und passende Hardware vorhanden sind. Für kleinere Installationen ist ZFS jedoch häufig einfacher zu verstehen, schneller einzurichten und leichter zuverlässig zu betreiben.

            ZFS für kleine und mittlere Cluster bevorzugt prüfen Ceph nur mit passender Hardware und Erfahrung produktiv einsetzen Backups nie durch Snapshots ersetzen Replikationen regelmäßig kontrollieren Monitoring zwingend einplanen 2FA und SSH-Hardening aktivieren Proxmox Backup Server sauber absichern

            Ressourcen

              Aktueller sysops Prospekt aow.de – Linkliste zu allen Projekten cloudistboese.de – Schulungsportal für Proxmox, ZFS und Open Source sysops.tv auf YouTube Bashclub Proxmox ZFS Postinstaller auf GitHub

              Proxmox Schulung oder Beratung anfragen

              Sie möchten Proxmox VE mit ZFS, Replikation, Backup und Monitoring professionell einsetzen? Die sysops GmbH unterstützt bei Planung, Installation, Migration, Schulung und Betrieb.

              📧 Bildschirmfoto 2024-12-18 um 15.17.28.jpginfo@sysops.de
              📞 +49 (0) 6021 2125-0

              Vielen Dank für Ihre Aufmerksamkeit

              Aufmerksamkeit.
              Christian-Peter Zengel (sysops.tv)tv

               


              ResourcenUpdate: Ceph-Vernetzung mit Proxmox VE 9 und Network Fabrics

              Seit Proxmox VE 9 lässt sich die Ceph-Vernetzung deutlich einfacher abbilden. Mit den neuen SDN Network Fabrics können geroutete Underlay-Netzwerke direkt über die Proxmox-Oberfläche erstellt werden.

              Damit werden insbesondere Full-Mesh-Netzwerke für Ceph übersichtlicher und wartbarer. Proxmox beschreibt selbst, dass Fabrics ab PVE 9 über den SDN-Stack in der GUI erstellt werden können und sich für Full-Mesh-Ceph-Setups eignen. [oai_citation:0‡Proxmox VE](https://aow.de/books/ubersicht-des-projekts/page/prospekt - Unser aktueller Prospektpve.proxmox.com/wiki/Full_Mesh_Network_for_Ceph_Server?utm_source=chatgpt.com)

              https://aow.deFür -neue LinklisteCeph-Installationen zusollte allendaher Projektengeprüft werden, ob die Vernetzung über Datacenter → SDN → Fabrics sinnvoller ist als eine manuelle statische Netzwerkkonfiguration.

              https://cloudistboese.de - Schulungsportal, alle Kurse können kostenfrei wiederholt werden. Kurse meist online, auch vor Ort

              http://youtube.com/sysopstv - Livesendung Montags und Donnerstags gegen 17:15h, Donnerstags Stammtisch online