Rook ceph หักบน kubernetes?

Sep 08 2020

ใช้ Ceph v1.14.10, Rook v1.3.8 บน k8s 1.16 ในสถานที่ หลังจาก 10 วันโดยไม่มีปัญหาใด ๆ เราตัดสินใจที่จะระบายบางโหนดจากนั้นพ็อดที่ย้ายทั้งหมดไม่สามารถยึดติดกับ PV ของพวกเขาได้อีกต่อไปดูเหมือนว่าคลัสเตอร์ Ceph จะแตก:

ConfigMap ของฉันrook-ceph-mon-endpointsกำลังอ้างถึง mon pod IP ที่ขาดหายไป 2 รายการ:

csi-cluster-config-json: '[{"clusterID":"rook-ceph","monitors":["10.115.0.129:6789","10.115.0.4:6789","10.115.0.132:6789"]}]

แต่

kubectl -n rook-ceph get pod -l app=rook-ceph-mon -o wide

NAME                               READY   STATUS    RESTARTS   AGE     IP             NODE                    NOMINATED NODE   READINESS GATES
rook-ceph-mon-e-56b849775-4g5wg    1/1     Running   0          6h42m   10.115.0.2     XXXX   <none>           <none>
rook-ceph-mon-h-fc486fb5c-8mvng    1/1     Running   0          6h42m   10.115.0.134   XXXX   <none>           <none>
rook-ceph-mon-i-65666fcff4-4ft49   1/1     Running   0          30h     10.115.0.132   XXXX   <none>           <none>

เป็นเรื่องปกติหรือฉันต้องเรียกใช้งาน "การกระทบยอด" เพื่ออัปเดต CM ด้วย mon pod IP ใหม่

(อาจเกี่ยวข้องกับ https://github.com/rook/rook/issues/2262)


ฉันต้องอัปเดตด้วยตนเอง:

  • rook-ceph-config ลับ
  • ซม. rook-ceph-mon-endpoints
  • ซม. rook-ceph-csi-config

คำตอบ

ThomasDecaux Sep 10 2020 at 22:48

ดังที่ @travisn กล่าวว่า:

ตัวดำเนินการเป็นเจ้าของการอัปเดต configmap และข้อมูลลับนั้น ไม่คาดว่าจะอัปเดตด้วยตนเองเว้นแต่จะมีสถานการณ์การกู้คืนระบบตามที่อธิบายไว้ที่https://rook.github.io/docs/rook/v1.4/ceph-disaster-recovery.html.