Mengupgrade Rook dan Ceph secara non-disruptive: prosedur upgrade operator Rook v1.20, urutan daemon MON→MGR→OSD→MDS→RGW, pemantauan cluster saat upgrade, rilis Ceph v20.x yang didukung, checklist upgrade serta dukungan komunitas dan referensi resmi.

Kita telah mencapai skala (episode 16). Episode 17 membahas kewajiban jangka panjang berikutnya: mengupgrade Rook & Ceph. Storage adalah fondasi — dan fondasi harus selalu mengikuti patch keamanan & rilis stabil.
Mengapa penting? Upgrade Ceph yang salah bisa menurunkan cluster dalam sekejap. Namun Ceph & Rook dirancang untuk upgrade rolling yang hampir seamless — dengan syarat mengikuti prosedur dan memantau health. Di episode ini kalian mempelajari prosedur itu dan rilis yang relevan di 2026.
Upgrade Rook sama dengan mengganti image operator:
kubectl -n rook-ceph set image deploy/rook-ceph-operator \
rook-ceph-operator=rook/ceph:v1.20.6Jika via Helm:
helm upgrade rook-ceph rook-release/rook-ceph \
--namespace rook-ceph \
--set image.repository=rook/ceph --set image.tag=v1.20.6Setelah operator mengambil image baru, ia meng-upgrade daemon sesuai rilis.
HEALTH_OK sebelum memulai.Rook menangani upgrading Ceph secara berurutan dengan strategi rolling:
Rook melakukan upgrade otomatis berdasarkan cephVersion.image yang ditingkatkan:
spec:
cephVersion:
image: rook/ceph:v20.2.0 # target Ceph v20Selama upgrade rolling, tiap daemon di-restart satu per satu — ada window singkat layanan "reduced". Namun infrastruktur tetap bisa diakses; hanya availability redundancy yang berkurang sesaat.
ceph health detail
ceph versionsceph versions menampilkan versi yang sedang berjalan di tiap daemon.PG Degraded singkat saat OSD restart).kubectl -n rook-ceph get pods -w | grep -E "osd|mon|mgr|mds|rgw"Saat semua Pod mencapai versi baru dan ceph versions seragam:
ceph status
kubectl -n rook-ceph get podsvalues.yaml helm chart.HEALTH_OK.force).ceph versions seragam & health OK.Warning
Downgrade umumnya tidak didukung. Jika upgrade gagal, perbaiki masalah — bukan mengembalikan versi. Backup seluruh CRD & konfigurasi sebelum major upgrade sebagai jaring pengaman (bisa re-deploy dari backup bila perlu).
rook-io (tanya cepat komunitas).ceph-daemon internals.Inti yang harus dibawa pulang:
ceph versions & health selama upgrade; window availability singkat.Di episode 18 selanjutnya kita akan membahas monitoring & observability Ceph — dashboard, metrik Prometheus via ServiceMonitor, Grafana, alerting OSD down/PG missing/kapasitas, dan sentralisasi log. Sampai jumpa di episode 18!