Beste allen,
Wij ondervinden problemen met een cluster bestaande uit 4 KVM nodes op 2 ZFS fileservers.
Het probleem zit in het netwerk.
Beide ZFS servers hebben 4x1Gbit poorten in een bond 802.3ad (layer2+3 xmit-hash-policy)
Alle 4 KVM nodes hebben 2x1Gbit in een bond 802.3ad (layer2+3 xmit-hash-policy)
De Switch is managed en ingested op LACP, LAG groepen en Layer2+3 hashing
De 4 KVM nodes maken allemaal verbinding via een NFS share naar de primaire ZFS server (2e ZFS server is back-up/standby). Wij zien echter dat er maar 1 netwerk poort tegelijk gebruikt wordt op de KVM nodes. Hierdoor kan een enkele kopie/IO actie alle VM's onbereikbaar maken op een node.
Wij willen juist dat een enkele KVM node met 2 gigabit poorten tegelijk kan verbinden naar de ZFS server. Dus wanneer 2 VM's iets zouden kopieren, dat je 2Gbit totaal kan gebruiken. Ook willen we dat de ZFS servers met 4x1Gbit onderling kunnen communiceren, zodat kopieer acties en initiele syncs/resyncs met hoge snelheid mogelijk worden.
Wanneer wij een test doen naar beide ZFS servers tegelijk werkt het wel goed, dan zien we inderdaad beide netwerk interfaces gebruikt worden. Het werkt ook goed wanneer we vanaf alle 4 KVM nodes tegelijk een test doen naar de ZFS server, op de ZFS server zien we dan alle 4 de poorten in gebruik (op de KVM nodes ieder 1 actief).
Kortom:
1. Is het mogelijk om met layer2/layer2+3 te loadbalancen naar een enkele server?
2. Kan iemand ons eventueel betaald helpen met het zoeken en implementeren van een oplossing?
Wij hadden zelf bedacht dat 4x1Gbit en 2x1Gbit trunks een goede oplossing was, maar vooralsnog hadden we net zo goed zonder trunks aan de slag kunnen gaan.
10Gbit op de fileservers is geen oplossing, de nodes blijven dan nog steeds met maximaal 1Gbit verbinden. Het is ook geen oplossing om in alle 6 servers een 10Gbit kaart te steken, dat is enorme overkill en te kostbaar.

Likes:


Quote
