build 7bbbddf7 | content blog-content@c8490fa · 338 posts | profiles 20 · corpus 267 | 0 skipped | | format
apiVersion: soultec.ch/v1kind: Postmetadata: name: tips-and-tricks-for-vsan-troubleshooting locale: de labels: author: dario-doerflinger series: lessons-learned capability/storage: 2.62 vendor/vmware: 0.88 annotations: source: blog-content/posts/de/tips-and-tricks-for-vsan-troubleshooting.md route: /de/insights/tips-and-tricks-for-vsan-troubleshooting/ schema: /nerd/schema/posts.json markdown: /de/insights/tips-and-tricks-for-vsan-troubleshooting.mdspec: title: Tipps und Tricks fürs vSAN Troubleshooting date: 2017-07-27 author: dario-doerflinger locale: de summary: >- Heute war ich in einer Web-Session von VMware zum Thema vSAN Troubleshooting. Die Tipps und Tricks daraus gebe ich hier weiter. capabilities: [storage] vendors: [vmware] series: lessons-learned migrated: 2026-08-24 translationReviewed: false draft: false sections: - body: | Heute war ich in einer Web-Session von VMware zum Thema vSAN Troubleshooting, und die Tipps und Tricks daraus gebe ich hier gerne weiter. - heading:

Das Naheliegende

body: | Stell sicher, dass deine Hardware auf der VMware HCL steht. – Disks, Controller, Firmware, Treiber Stell sicher, dass du aktuelle Backups hast, und teste den Restore vollständig. - heading:

vSAN im Überblick

body: | Cluster: 2 bis 64 physische Hosts Host: 1 bis 5 Disk Groups Disk Group: 1 Flash für Cache, 1 bis 7 Flash- oder HDD-Devices für Capacity vSAN Objekte: – VM Home, VM Swap, VMDK, Delta Disk, Memory Delta Storage Policies: – Werden pro VM oder pro VMDK angewendet – Definieren Schutzniveau und Performance Jedes Objekt besteht aus einer oder mehreren Komponenten, je nach Storage Policy. ![Screen Shot 2017-07-27 at 13.12.56](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/01.webp) C1 und C2 = Komponenten, W = Witness Zustände einer Komponente: - Active – Komponente erreichbar - Absent – nicht erreichbar, aber ohne erkannten Fehlercode - Host-Ausfall oder Maintenance Mode mit «ensure accessibility» - Rebuild startet nach 60 Minuten Timeout - Degraded – nicht erreichbar, mit erkanntem Fehlercode - Device-Ausfall - Rebuild startet sofort - Active – stale - In der Warteschlange der Objekte, die neu gebaut werden - heading:

vSAN Werkzeuge

body: | - vRealize Ops und Log Insight - ESXCLI - RVC - Health Check - [vSAN Observer](https://kb.vmware.com/kb/2064240) (bei Performance-Problemen) ### ESXCLI **esxcli vsan** – zeigt die verfügbaren Namespaces *Neu in 6.6: debug und health* **esxcli vsan health cluster list** – gibt einen Überblick nach Ampelsystem (grün, gelb, rot) über alle Tests **esxcli vsan health cluster get -t "vSAN Disk Balance"** – liefert das Ergebnis eines Tests aus dem obigen Befehl **esxcli vsan health cluster get -t "vSAN object health"** – vSAN Object Health kann auf ernste Probleme hindeuten, wenn der Status rot ist. Hol dir die UUID des Objekts, um das Problem zu verfolgen **esxcli vsan debug** – zeigt die verfügbaren Namespaces **esxcli vsan debug resync summary** – Informationen zum laufenden Resync **esxcli vsan debug object health summary get** – Überblick über deine Health **esxcli vsan debug object list |more** – gibt alle Objekte samt Komponentenzustand zurück **esxcli vsan debug disk list** – Informationen zu deinen Disks und ob sie mitkommen **esxcli vsan debug controller list** – Informationen zu deinen Disk Controllern (HCL-Informationen, Queue Depth) ### RVC (Ruby vSphere Console) Die RVC ist auf allen vCenter Server Varianten vorinstalliert. vsan.check\_state 0 ![Screen Shot 2017-07-27 at 13.28.44](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/02.webp) vsan.disks\_stats 0 ![Screen Shot 2017-07-27 at 13.29.08.png](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/03.webp) vsan.cluster\_info 0 ![Screen Shot 2017-07-27 at 13.29.53](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/04.webp) ### Health UI ![Screen Shot 2017-07-27 at 13.30.33](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/05.webp) vSAN Disk Balance ![Screen Shot 2017-07-27 at 13.32.00](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/06.webp) - heading:

vSAN Health

body: | **python /usr/lib/vmware-vpx/vsan-health/vsan-vc-health-status.py > /tmp/vsan\_status.txt** ![Screen Shot 2017-07-27 at 13.34.56](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/07.webp) Dasselbe auf einem einzelnen Node: Pfad: /usr/lib/vmware/vsan/bin/vsan-health-status.pyc > python /usr/lib/vmware/vsan/bin/vsan-health-status.pyc [KB 2107705](http://kb.vmware.com/kb/2107705) hat mehr dazu. Wann du das brauchst: wenn der Health Service auf dem vCenter nicht verfügbar ist. - heading:

Anwendungsfälle

body: | Cluster mit 6 Hosts. Drei Nodes kamen dazu. Nach dem Hinzufügen der Hosts kam keine Kapazität dazu. > esxcli vsan storage list ![Screen Shot 2017-07-27 at 13.40.13](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/08.webp)**In CMMDS: false – merk dir die naa…-ID** - Prüf vobd.log (such nach der naa…-ID) - Prüf boot.gz (mit zcat; such nach der naa…-ID) - Disk naa…-ID detected to be a snapshot Lösung: – Die Disk lässt sich nicht hinzufügen, weil bereits ein Dateisystem darauf liegt – Die Disk hatte eine UUID, war in einem Cluster und wurde irgendwann verwendet – Löschen der Daten bestätigt – Mit partedutil die Partitionen entfernt – Disk Groups gelöscht und neu erstellt ### Nützliche Logs: > vobd.log Such nach «problem» und «permanent».status: corpus: 267 alsoLike: - {ref: posts/iscsi-datastore-not-consumed, score: 1.00} - {ref: posts/setting-up-a-greenfield-vsan-cluster-on-6-5-update-1, score: 1.00} - {ref: solutions/vmware/vmware-cloud-foundation/vmware-vsan, score: 0.76}
{ "apiVersion": "soultec.ch/v1", "kind": "Post", "metadata": { "name": "tips-and-tricks-for-vsan-troubleshooting", "locale": "de", "labels": { "author": "dario-doerflinger", "series": "lessons-learned", "capability/storage": "2.62", "vendor/vmware": "0.88" }, "annotations": { "source": "blog-content/posts/de/tips-and-tricks-for-vsan-troubleshooting.md", "route": "/de/insights/tips-and-tricks-for-vsan-troubleshooting/", "schema": "/nerd/schema/posts.json", "markdown": "/de/insights/tips-and-tricks-for-vsan-troubleshooting.md" } }, "spec": { "title": "Tipps und Tricks fürs vSAN Troubleshooting", "date": "2017-07-27", "author": "dario-doerflinger", "locale": "de", "summary": "Heute war ich in einer Web-Session von VMware zum Thema vSAN Troubleshooting. Die Tipps und Tricks daraus gebe ich hier weiter.", "capabilities": [ "storage" ], "vendors": [ "vmware" ], "series": "lessons-learned", "migrated": "2026-08-24", "translationReviewed": false, "draft": false }, "sections": [ { "body": "Heute war ich in einer Web-Session von VMware zum Thema vSAN Troubleshooting, und die Tipps und Tricks daraus gebe ich hier gerne weiter." }, { "heading": "

Das Naheliegende

",
"body": "Stell sicher, dass deine Hardware auf der VMware HCL steht. \n– Disks, Controller, Firmware, Treiber\n\nStell sicher, dass du aktuelle Backups hast, und teste den Restore vollständig." }, { "heading": "

vSAN im Überblick

",
"body": "Cluster: 2 bis 64 physische Hosts \nHost: 1 bis 5 Disk Groups \nDisk Group: 1 Flash für Cache, 1 bis 7 Flash- oder HDD-Devices für Capacity\n\nvSAN Objekte: \n– VM Home, VM Swap, VMDK, Delta Disk, Memory Delta\n\nStorage Policies: \n– Werden pro VM oder pro VMDK angewendet \n– Definieren Schutzniveau und Performance\n\nJedes Objekt besteht aus einer oder mehreren Komponenten, je nach Storage Policy.\n\n![Screen Shot 2017-07-27 at 13.12.56](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/01.webp)\n\nC1 und C2 = Komponenten, W = Witness\n\nZustände einer Komponente:\n\n- Active – Komponente erreichbar\n- Absent – nicht erreichbar, aber ohne erkannten Fehlercode\n - Host-Ausfall oder Maintenance Mode mit «ensure accessibility»\n - Rebuild startet nach 60 Minuten Timeout\n- Degraded – nicht erreichbar, mit erkanntem Fehlercode\n - Device-Ausfall\n - Rebuild startet sofort\n- Active – stale\n - In der Warteschlange der Objekte, die neu gebaut werden" }, { "heading": "

vSAN Werkzeuge

",
"body": "- vRealize Ops und Log Insight\n- ESXCLI\n- RVC\n- Health Check\n- [vSAN Observer](https://kb.vmware.com/kb/2064240) (bei Performance-Problemen)\n\n### ESXCLI\n\n**esxcli vsan** – zeigt die verfügbaren Namespaces \n*Neu in 6.6: debug und health*\n\n**esxcli vsan health cluster list** – gibt einen Überblick nach Ampelsystem (grün, gelb, rot) über alle Tests \n**esxcli vsan health cluster get -t \"vSAN Disk Balance\"** – liefert das Ergebnis eines Tests aus dem obigen Befehl \n**esxcli vsan health cluster get -t \"vSAN object health\"** – vSAN Object Health kann auf ernste Probleme hindeuten, wenn der Status rot ist. Hol dir die UUID des Objekts, um das Problem zu verfolgen\n\n**esxcli vsan debug** – zeigt die verfügbaren Namespaces \n**esxcli vsan debug resync summary** – Informationen zum laufenden Resync \n**esxcli vsan debug object health summary get** – Überblick über deine Health \n**esxcli vsan debug object list |more** – gibt alle Objekte samt Komponentenzustand zurück \n**esxcli vsan debug disk list** – Informationen zu deinen Disks und ob sie mitkommen \n**esxcli vsan debug controller list** – Informationen zu deinen Disk Controllern (HCL-Informationen, Queue Depth)\n\n### RVC (Ruby vSphere Console)\n\nDie RVC ist auf allen vCenter Server Varianten vorinstalliert.\n\nvsan.check\\_state 0 \n![Screen Shot 2017-07-27 at 13.28.44](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/02.webp)\n\nvsan.disks\\_stats 0 \n![Screen Shot 2017-07-27 at 13.29.08.png](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/03.webp)\n\nvsan.cluster\\_info 0 \n![Screen Shot 2017-07-27 at 13.29.53](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/04.webp)\n\n### Health UI\n\n![Screen Shot 2017-07-27 at 13.30.33](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/05.webp)\n\nvSAN Disk Balance \n![Screen Shot 2017-07-27 at 13.32.00](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/06.webp)" }, { "heading": "

vSAN Health

",
"body": "**python /usr/lib/vmware-vpx/vsan-health/vsan-vc-health-status.py > /tmp/vsan\\_status.txt**\n\n![Screen Shot 2017-07-27 at 13.34.56](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/07.webp)\n\nDasselbe auf einem einzelnen Node: \nPfad: /usr/lib/vmware/vsan/bin/vsan-health-status.pyc\n\n> python /usr/lib/vmware/vsan/bin/vsan-health-status.pyc\n\n[KB 2107705](http://kb.vmware.com/kb/2107705) hat mehr dazu.\n\nWann du das brauchst: wenn der Health Service auf dem vCenter nicht verfügbar ist." }, { "heading": "

Anwendungsfälle

",
"body": "Cluster mit 6 Hosts. Drei Nodes kamen dazu. Nach dem Hinzufügen der Hosts kam keine Kapazität dazu.\n\n> esxcli vsan storage list\n\n![Screen Shot 2017-07-27 at 13.40.13](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/08.webp)**In CMMDS: false – merk dir die naa…-ID**\n\n- Prüf vobd.log (such nach der naa…-ID)\n- Prüf boot.gz (mit zcat; such nach der naa…-ID)\n - Disk naa…-ID detected to be a snapshot\n\nLösung: \n– Die Disk lässt sich nicht hinzufügen, weil bereits ein Dateisystem darauf liegt \n– Die Disk hatte eine UUID, war in einem Cluster und wurde irgendwann verwendet \n– Löschen der Daten bestätigt \n– Mit partedutil die Partitionen entfernt \n– Disk Groups gelöscht und neu erstellt\n\n### Nützliche Logs:\n\n> vobd.log\n\nSuch nach «problem» und «permanent»." } ], "status": { "corpus": 267, "alsoLike": [ { "ref": "posts/iscsi-datastore-not-consumed", "score": "1.00" }, { "ref": "posts/setting-up-a-greenfield-vsan-cluster-on-6-5-update-1", "score": "1.00" }, { "ref": "solutions/vmware/vmware-cloud-foundation/vmware-vsan", "score": "0.76" } ] }}
apiVersion = "soultec.ch/v1"kind = "Post"[metadata]name = "tips-and-tricks-for-vsan-troubleshooting"locale = "de"[metadata.labels]author = "dario-doerflinger"series = "lessons-learned""capability/storage" = "2.62""vendor/vmware" = "0.88"[metadata.annotations]source = "blog-content/posts/de/tips-and-tricks-for-vsan-troubleshooting.md"route = "/de/insights/tips-and-tricks-for-vsan-troubleshooting/"schema = "/nerd/schema/posts.json"markdown = "/de/insights/tips-and-tricks-for-vsan-troubleshooting.md"[spec]title = "Tipps und Tricks fürs vSAN Troubleshooting"date = 2017-07-27author = "dario-doerflinger"locale = "de"summary = "Heute war ich in einer Web-Session von VMware zum Thema vSAN Troubleshooting. Die Tipps und Tricks daraus gebe ich hier weiter."capabilities = ["storage"]vendors = ["vmware"]series = "lessons-learned"migrated = 2026-08-24translationReviewed = falsedraft = false[[sections]]body = "Heute war ich in einer Web-Session von VMware zum Thema vSAN Troubleshooting, und die Tipps und Tricks daraus gebe ich hier gerne weiter."[[sections]]heading = "

Das Naheliegende

"
body = '''Stell sicher, dass deine Hardware auf der VMware HCL steht. – Disks, Controller, Firmware, TreiberStell sicher, dass du aktuelle Backups hast, und teste den Restore vollständig.'''[[sections]]heading = "

vSAN im Überblick

"
body = '''Cluster: 2 bis 64 physische Hosts Host: 1 bis 5 Disk Groups Disk Group: 1 Flash für Cache, 1 bis 7 Flash- oder HDD-Devices für CapacityvSAN Objekte: – VM Home, VM Swap, VMDK, Delta Disk, Memory DeltaStorage Policies: – Werden pro VM oder pro VMDK angewendet – Definieren Schutzniveau und PerformanceJedes Objekt besteht aus einer oder mehreren Komponenten, je nach Storage Policy.![Screen Shot 2017-07-27 at 13.12.56](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/01.webp)C1 und C2 = Komponenten, W = WitnessZustände einer Komponente:- Active – Komponente erreichbar- Absent – nicht erreichbar, aber ohne erkannten Fehlercode - Host-Ausfall oder Maintenance Mode mit «ensure accessibility» - Rebuild startet nach 60 Minuten Timeout- Degraded – nicht erreichbar, mit erkanntem Fehlercode - Device-Ausfall - Rebuild startet sofort- Active – stale - In der Warteschlange der Objekte, die neu gebaut werden'''[[sections]]heading = "

vSAN Werkzeuge

"
body = '''- vRealize Ops und Log Insight- ESXCLI- RVC- Health Check- [vSAN Observer](https://kb.vmware.com/kb/2064240) (bei Performance-Problemen)### ESXCLI**esxcli vsan** – zeigt die verfügbaren Namespaces *Neu in 6.6: debug und health***esxcli vsan health cluster list** – gibt einen Überblick nach Ampelsystem (grün, gelb, rot) über alle Tests **esxcli vsan health cluster get -t "vSAN Disk Balance"** – liefert das Ergebnis eines Tests aus dem obigen Befehl **esxcli vsan health cluster get -t "vSAN object health"** – vSAN Object Health kann auf ernste Probleme hindeuten, wenn der Status rot ist. Hol dir die UUID des Objekts, um das Problem zu verfolgen**esxcli vsan debug** – zeigt die verfügbaren Namespaces **esxcli vsan debug resync summary** – Informationen zum laufenden Resync **esxcli vsan debug object health summary get** – Überblick über deine Health **esxcli vsan debug object list |more** – gibt alle Objekte samt Komponentenzustand zurück **esxcli vsan debug disk list** – Informationen zu deinen Disks und ob sie mitkommen **esxcli vsan debug controller list** – Informationen zu deinen Disk Controllern (HCL-Informationen, Queue Depth)### RVC (Ruby vSphere Console)Die RVC ist auf allen vCenter Server Varianten vorinstalliert.vsan.check\_state 0 ![Screen Shot 2017-07-27 at 13.28.44](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/02.webp)vsan.disks\_stats 0 ![Screen Shot 2017-07-27 at 13.29.08.png](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/03.webp)vsan.cluster\_info 0 ![Screen Shot 2017-07-27 at 13.29.53](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/04.webp)### Health UI![Screen Shot 2017-07-27 at 13.30.33](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/05.webp)vSAN Disk Balance ![Screen Shot 2017-07-27 at 13.32.00](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/06.webp)'''[[sections]]heading = "

vSAN Health

"
body = '''**python /usr/lib/vmware-vpx/vsan-health/vsan-vc-health-status.py > /tmp/vsan\_status.txt**![Screen Shot 2017-07-27 at 13.34.56](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/07.webp)Dasselbe auf einem einzelnen Node: Pfad: /usr/lib/vmware/vsan/bin/vsan-health-status.pyc> python /usr/lib/vmware/vsan/bin/vsan-health-status.pyc[KB 2107705](http://kb.vmware.com/kb/2107705) hat mehr dazu.Wann du das brauchst: wenn der Health Service auf dem vCenter nicht verfügbar ist.'''[[sections]]heading = "

Anwendungsfälle

"
body = '''Cluster mit 6 Hosts. Drei Nodes kamen dazu. Nach dem Hinzufügen der Hosts kam keine Kapazität dazu.> esxcli vsan storage list![Screen Shot 2017-07-27 at 13.40.13](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/08.webp)**In CMMDS: false – merk dir die naa…-ID**- Prüf vobd.log (such nach der naa…-ID)- Prüf boot.gz (mit zcat; such nach der naa…-ID) - Disk naa…-ID detected to be a snapshotLösung: – Die Disk lässt sich nicht hinzufügen, weil bereits ein Dateisystem darauf liegt – Die Disk hatte eine UUID, war in einem Cluster und wurde irgendwann verwendet – Löschen der Daten bestätigt – Mit partedutil die Partitionen entfernt – Disk Groups gelöscht und neu erstellt### Nützliche Logs:> vobd.logSuch nach «problem» und «permanent».'''[status]corpus = 267[[status.alsoLike]]ref = "posts/iscsi-datastore-not-consumed"score = "1.00"[[status.alsoLike]]ref = "posts/setting-up-a-greenfield-vsan-cluster-on-6-5-update-1"score = "1.00"[[status.alsoLike]]ref = "solutions/vmware/vmware-cloud-foundation/vmware-vsan"score = "0.76"
<?xml version="1.0" encoding="UTF-8"?><manifest kind="Post"> <apiVersion>soultec.ch/v1</apiVersion> <metadata> <name>tips-and-tricks-for-vsan-troubleshooting</name> <locale>de</locale> <labels> <author>dario-doerflinger</author> <series>lessons-learned</series> <entry key="capability/storage">2.62</entry> <entry key="vendor/vmware">0.88</entry> </labels> <annotations> <source>blog-content/posts/de/tips-and-tricks-for-vsan-troubleshooting.md</source> <route>/de/insights/tips-and-tricks-for-vsan-troubleshooting/</route> <schema>/nerd/schema/posts.json</schema> <markdown>/de/insights/tips-and-tricks-for-vsan-troubleshooting.md</markdown> </annotations> </metadata> <spec> <title>Tipps und Tricks fürs vSAN Troubleshooting</title> <date>2017-07-27</date> <author>dario-doerflinger</author> <locale>de</locale> <summary>Heute war ich in einer Web-Session von VMware zum Thema vSAN Troubleshooting. Die Tipps und Tricks daraus gebe ich hier weiter.</summary> <capabilities> <item>storage</item> </capabilities> <vendors> <item>vmware</item> </vendors> <series>lessons-learned</series> <migrated>2026-08-24</migrated> <translationReviewed>false</translationReviewed> <draft>false</draft> </spec> <sections> <section> <body>Heute war ich in einer Web-Session von VMware zum Thema vSAN Troubleshooting, und die Tipps und Tricks daraus gebe ich hier gerne weiter.</body> </section> <section> <heading>

Das Naheliegende

</heading>
<body>Stell sicher, dass deine Hardware auf der VMware HCL steht. – Disks, Controller, Firmware, TreiberStell sicher, dass du aktuelle Backups hast, und teste den Restore vollständig. </body> </section> <section> <heading>

vSAN im Überblick

</heading>
<body>Cluster: 2 bis 64 physische Hosts Host: 1 bis 5 Disk Groups Disk Group: 1 Flash für Cache, 1 bis 7 Flash- oder HDD-Devices für CapacityvSAN Objekte: – VM Home, VM Swap, VMDK, Delta Disk, Memory DeltaStorage Policies: – Werden pro VM oder pro VMDK angewendet – Definieren Schutzniveau und PerformanceJedes Objekt besteht aus einer oder mehreren Komponenten, je nach Storage Policy.![Screen Shot 2017-07-27 at 13.12.56](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/01.webp)C1 und C2 = Komponenten, W = WitnessZustände einer Komponente:- Active – Komponente erreichbar- Absent – nicht erreichbar, aber ohne erkannten Fehlercode - Host-Ausfall oder Maintenance Mode mit «ensure accessibility» - Rebuild startet nach 60 Minuten Timeout- Degraded – nicht erreichbar, mit erkanntem Fehlercode - Device-Ausfall - Rebuild startet sofort- Active – stale - In der Warteschlange der Objekte, die neu gebaut werden </body> </section> <section> <heading>

vSAN Werkzeuge

</heading>
<body>- vRealize Ops und Log Insight- ESXCLI- RVC- Health Check- [vSAN Observer](https://kb.vmware.com/kb/2064240) (bei Performance-Problemen)### ESXCLI**esxcli vsan** – zeigt die verfügbaren Namespaces *Neu in 6.6: debug und health***esxcli vsan health cluster list** – gibt einen Überblick nach Ampelsystem (grün, gelb, rot) über alle Tests **esxcli vsan health cluster get -t "vSAN Disk Balance"** – liefert das Ergebnis eines Tests aus dem obigen Befehl **esxcli vsan health cluster get -t "vSAN object health"** – vSAN Object Health kann auf ernste Probleme hindeuten, wenn der Status rot ist. Hol dir die UUID des Objekts, um das Problem zu verfolgen**esxcli vsan debug** – zeigt die verfügbaren Namespaces **esxcli vsan debug resync summary** – Informationen zum laufenden Resync **esxcli vsan debug object health summary get** – Überblick über deine Health **esxcli vsan debug object list |more** – gibt alle Objekte samt Komponentenzustand zurück **esxcli vsan debug disk list** – Informationen zu deinen Disks und ob sie mitkommen **esxcli vsan debug controller list** – Informationen zu deinen Disk Controllern (HCL-Informationen, Queue Depth)### RVC (Ruby vSphere Console)Die RVC ist auf allen vCenter Server Varianten vorinstalliert.vsan.check\_state 0 ![Screen Shot 2017-07-27 at 13.28.44](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/02.webp)vsan.disks\_stats 0 ![Screen Shot 2017-07-27 at 13.29.08.png](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/03.webp)vsan.cluster\_info 0 ![Screen Shot 2017-07-27 at 13.29.53](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/04.webp)### Health UI![Screen Shot 2017-07-27 at 13.30.33](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/05.webp)vSAN Disk Balance ![Screen Shot 2017-07-27 at 13.32.00](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/06.webp) </body> </section> <section> <heading>

vSAN Health

</heading>
<body>**python /usr/lib/vmware-vpx/vsan-health/vsan-vc-health-status.py &gt; /tmp/vsan\_status.txt**![Screen Shot 2017-07-27 at 13.34.56](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/07.webp)Dasselbe auf einem einzelnen Node: Pfad: /usr/lib/vmware/vsan/bin/vsan-health-status.pyc&gt; python /usr/lib/vmware/vsan/bin/vsan-health-status.pyc[KB 2107705](http://kb.vmware.com/kb/2107705) hat mehr dazu.Wann du das brauchst: wenn der Health Service auf dem vCenter nicht verfügbar ist. </body> </section> <section> <heading>

Anwendungsfälle

</heading>
<body>Cluster mit 6 Hosts. Drei Nodes kamen dazu. Nach dem Hinzufügen der Hosts kam keine Kapazität dazu.&gt; esxcli vsan storage list![Screen Shot 2017-07-27 at 13.40.13](/blog-assets/tips-and-tricks-for-vsan-troubleshooting/08.webp)**In CMMDS: false – merk dir die naa…-ID**- Prüf vobd.log (such nach der naa…-ID)- Prüf boot.gz (mit zcat; such nach der naa…-ID) - Disk naa…-ID detected to be a snapshotLösung: – Die Disk lässt sich nicht hinzufügen, weil bereits ein Dateisystem darauf liegt – Die Disk hatte eine UUID, war in einem Cluster und wurde irgendwann verwendet – Löschen der Daten bestätigt – Mit partedutil die Partitionen entfernt – Disk Groups gelöscht und neu erstellt### Nützliche Logs:&gt; vobd.logSuch nach «problem» und «permanent». </body> </section> </sections> <status> <corpus>267</corpus> <alsoLike> <item> <ref>posts/iscsi-datastore-not-consumed</ref> <score>1.00</score> </item> <item> <ref>posts/setting-up-a-greenfield-vsan-cluster-on-6-5-update-1</ref> <score>1.00</score> </item> <item> <ref>solutions/vmware/vmware-cloud-foundation/vmware-vsan</ref> <score>0.76</score> </item> </alsoLike> </status></manifest>
Lessons Learned · 2017-07-27

Tipps und Tricks fürs vSAN Troubleshooting

Heute war ich in einer Web-Session von VMware zum Thema vSAN Troubleshooting. Die Tipps und Tricks daraus gebe ich hier weiter.

2017-07-27Datum
Dario DörflingerAutor
3Min. Lesezeit
Themen Storage 2.62
Hersteller VMware 0.88

Dieser Beitrag ist von 2017. Er bleibt online, weil er nach wie vor nachgefragt wird, beschreibt aber einen Produktstand von damals.

Heute war ich in einer Web-Session von VMware zum Thema vSAN Troubleshooting, und die Tipps und Tricks daraus gebe ich hier gerne weiter.

Das Naheliegende

Stell sicher, dass deine Hardware auf der VMware HCL steht.
– Disks, Controller, Firmware, Treiber

Stell sicher, dass du aktuelle Backups hast, und teste den Restore vollständig.

vSAN im Überblick

Cluster: 2 bis 64 physische Hosts
Host: 1 bis 5 Disk Groups
Disk Group: 1 Flash für Cache, 1 bis 7 Flash- oder HDD-Devices für Capacity

vSAN Objekte:
– VM Home, VM Swap, VMDK, Delta Disk, Memory Delta

Storage Policies:
– Werden pro VM oder pro VMDK angewendet
– Definieren Schutzniveau und Performance

Jedes Objekt besteht aus einer oder mehreren Komponenten, je nach Storage Policy.

Screen Shot 2017-07-27 at 13.12.56

C1 und C2 = Komponenten, W = Witness

Zustände einer Komponente:

  • Active – Komponente erreichbar
  • Absent – nicht erreichbar, aber ohne erkannten Fehlercode
    • Host-Ausfall oder Maintenance Mode mit «ensure accessibility»
    • Rebuild startet nach 60 Minuten Timeout
  • Degraded – nicht erreichbar, mit erkanntem Fehlercode
    • Device-Ausfall
    • Rebuild startet sofort
  • Active – stale
    • In der Warteschlange der Objekte, die neu gebaut werden

vSAN Werkzeuge

  • vRealize Ops und Log Insight
  • ESXCLI
  • RVC
  • Health Check
  • vSAN Observer (bei Performance-Problemen)

ESXCLI

esxcli vsan – zeigt die verfügbaren Namespaces
Neu in 6.6: debug und health

esxcli vsan health cluster list – gibt einen Überblick nach Ampelsystem (grün, gelb, rot) über alle Tests
esxcli vsan health cluster get -t “vSAN Disk Balance” – liefert das Ergebnis eines Tests aus dem obigen Befehl
esxcli vsan health cluster get -t “vSAN object health” – vSAN Object Health kann auf ernste Probleme hindeuten, wenn der Status rot ist. Hol dir die UUID des Objekts, um das Problem zu verfolgen

esxcli vsan debug – zeigt die verfügbaren Namespaces
esxcli vsan debug resync summary – Informationen zum laufenden Resync
esxcli vsan debug object health summary get – Überblick über deine Health
esxcli vsan debug object list |more – gibt alle Objekte samt Komponentenzustand zurück
esxcli vsan debug disk list – Informationen zu deinen Disks und ob sie mitkommen
esxcli vsan debug controller list – Informationen zu deinen Disk Controllern (HCL-Informationen, Queue Depth)

RVC (Ruby vSphere Console)

Die RVC ist auf allen vCenter Server Varianten vorinstalliert.

vsan.check_state 0
Screen Shot 2017-07-27 at 13.28.44

vsan.disks_stats 0
Screen Shot 2017-07-27 at 13.29.08.png

vsan.cluster_info 0
Screen Shot 2017-07-27 at 13.29.53

Health UI

Screen Shot 2017-07-27 at 13.30.33

vSAN Disk Balance
Screen Shot 2017-07-27 at 13.32.00

vSAN Health

python /usr/lib/vmware-vpx/vsan-health/vsan-vc-health-status.py > /tmp/vsan_status.txt

Screen Shot 2017-07-27 at 13.34.56

Dasselbe auf einem einzelnen Node:
Pfad: /usr/lib/vmware/vsan/bin/vsan-health-status.pyc

python /usr/lib/vmware/vsan/bin/vsan-health-status.pyc

KB 2107705 hat mehr dazu.

Wann du das brauchst: wenn der Health Service auf dem vCenter nicht verfügbar ist.

Anwendungsfälle

Cluster mit 6 Hosts. Drei Nodes kamen dazu. Nach dem Hinzufügen der Hosts kam keine Kapazität dazu.

esxcli vsan storage list

Screen Shot 2017-07-27 at 13.40.13In CMMDS: false – merk dir die naa…-ID

  • Prüf vobd.log (such nach der naa…-ID)
  • Prüf boot.gz (mit zcat; such nach der naa…-ID)
    • Disk naa…-ID detected to be a snapshot

Lösung:
– Die Disk lässt sich nicht hinzufügen, weil bereits ein Dateisystem darauf liegt
– Die Disk hatte eine UUID, war in einem Cluster und wurde irgendwann verwendet
– Löschen der Daten bestätigt
– Mit partedutil die Partitionen entfernt
– Disk Groups gelöscht und neu erstellt

Nützliche Logs:

vobd.log

Such nach «problem» und «permanent».

Passt ausserdem