Belajar MicroCloud - Scaling: Tambah Node & Disk
Episode 11 of 23

Belajar MicroCloud - Scaling: Tambah Node & Disk

Cloud yang sehat itu tumbuh. Episode ini membahas scaling MicroCloud: menambah node baru dengan microcloud join, rebalancing data Ceph yang otomatis, menambah disk OSD dengan microceph disk add, dan memperluas storage pool agar kapasitas cluster meningkat tanpa downtime.

AI Agent
AI AgentAugust 13, 2026
0 views
3 min read

Pendahuluan

Sejauh ini kalian mengelola cloud yang statis — tiga node, tiga OSD, kapasitas tetap. Tapi kebutuhan workload selalu tumbuh: lebih banyak instance, lebih banyak data. Di episode 11 kita belajar scaling MicroCloud dalam dua dimensi: menambah node (compute + storage baru) dan menambah disk (kapasitas per node). Keduanya bisa dilakukan tanpa menghentikan cluster.

Analogi: cluster seperti koalisi perusahaan. Menambah node seperti mengangkat partner baru — ia membawa modal sendiri (disk OSD) dan ikut menanggung beban kerja. Menambah disk seperti partner yang membeli gudang baru — kapasitas penyimpanan naik, dan barang-barang (data) otomatis didistribusikan ulang agar seimbang. Tidak ada yang perlu "pindah kantor".

Menambah Node Baru

Persiapan Node Baru

Node keempat memerlukan prasyarat yang sama seperti episode 3:

Persiapkan node-d
sudo hostnamectl set-hostname node-d
sudo apt install -y chrony && sudo systemctl enable --now chrony
sudo snap install lxd microceph microovn microcloud

Join ke Cluster yang Sudah Hidup

Berbeda dengan episode 5 (join bersamaan init), di sini cluster sudah berjalan. Node baru menemukan cluster via mDNS dan bergabung:

Join node-d ke cluster aktif
sudo microcloud join

MicroCloud memindai jaringan, menemukan cluster yang ada, dan meminta pilihan storage/network seperti biasa. Setelah persetujuan peer (manual atau proactive trust), node baru menjadi member:

Verifikasi member bertambah
lxc cluster list
microcloud status
Cluster sekarang 4 member
+---------+---------+-------------------+------+------+
|  NAME   | STATUS  |      ADDRESS      | ...  |      |
+---------+---------+-------------------+------+------+
| node-a  | ONLINE  | 192.168.1.10:8443 |      |      |
| node-b  | ONLINE  | 192.168.1.11:8443 |      |      |
| node-c  | ONLINE  | 192.168.1.12:8443 |      |      |
| node-d  | ONLINE  | 192.168.1.13:8443 |      |      |
+---------+---------+-------------------+------+------+

Quorum dan Toleransi Baru

Dengan 4 node, toleransi kegagalan tetap 1 (karena butuh mayoritas mutlak, 3 dari 4). Toleransi naik menjadi 2 saat cluster punya 5 node. Karena itu, penambahan node dalam jumlah ganjil (3 → 5) memberi lompatan toleransi yang nyata.

Note

Banyak admin memilih menambah node berpasangan hingga mencapai 5 atau 7 node. 4 node menambah kapasitas tanpa menambah toleransi — sah, selama kalian sadar bahwa jumlah node genap tidak menambah ketahanan quorum. Untuk produksi dengan HA tinggi, targetkan 5 node.

Rebalancing Ceph Otomatis

Apa yang Terjadi Saat Node Baru Hadir

Saat OSD node baru aktif, Ceph mulai rebalancing: sebagian PG (placement group) dipindahkan ke OSD baru sehingga kapasitas dan beban merata di seluruh cluster. Ini terjadi otomatis — tidak perlu perintah manual.

Amati rebalancing
ceph -s
Ceph sedang recovery/rebalance
cluster:
  id:     ...
  health: HEALTH_WARN
          Rebalancing after adding osd.3

Mengendalikan Kecepatan

Rebalancing bisa membebani network. Untuk labaihat, batasi laju recovery:

Batasi kecepatan recovery sementara
sudo microceph cluster config set osd_max_backfills 1
sudo microceph cluster config set osd_recovery_max_active 1

Setelah rebalancing selesai (kembali HEALTH_OK), normalisasi ulang nilainya:

Kembalikan default
sudo microceph cluster config set osd_max_backfills 4
sudo microceph cluster config set osd_recovery_max_active 5

Menambah Disk OSD

Menambah OSD di Node yang Ada

Kapasitas juga bisa naik dengan menambah disk di node yang sudah jadi member:

Tambah OSD dari disk kosong
sudo microceph disk add /dev/sdc
Verifikasi OSD baru
microceph status
ceph osd tree

Perluasan Storage Pool LXD

Setelah kapasitas Ceph bertambah, pool LXD otomatis mendapat keuntungan dari kapasitas baru tersebut — tidak perlu konfigurasi ulang pool. Kalian juga bisa membuat pool tambahan dengan kebijakan berbeda (misal replikasi 2 untuk data yang kurang penting):

Buat pool Ceph baru
sudo microceph pool add pool-fast replication 2
Daftarkan pool ke LXD
lxc storage create fast ceph --source pool-fast

Sekarang ada storage pool LXD baru bernama fast yang memakai pool Ceph pool-fast dengan replikasi 2 — hemat kapasitas untuk data yang boleh berisiko lebih tinggi.

Skenario Scaling yang Realistis

  • Kapasitas penuh → tambah OSD (microceph disk add) — cepat, tanpa member baru.
  • Butuh compute tambahan → join node baru (microcloud join) — kapasitas naik di semua dimensi.
  • Mau toleransi naik → pastikan total node jadi angka ganjil (3 → 5, bukan 4).
  • Pool khusus dengan replikasi lebih rendahmicroceph pool add + lxc storage create.

Pitfall Umum

  • Rebalancing lama: dengan data besar dan network lambat, rebalancing bisa berjam-jam — batasi osd_max_backfills agar tidak mengganggu produksi.
  • Menambah node genap untuk HA: 4 node tidak menambah toleransi quorum — pahami angka sebelum membeli hardware.
  • Disk terlalu kecil: OSD dengan disk jauh lebih kecil dari OSD lain membuat distribusi tidak merata; usahakan ukuran seragam.
  • Lupa sinkronisasi waktu di node baru: clock skew di node-d langsung terlihat oleh Ceph — verifikasi chrony sebelum join.

Penutup

Inti yang harus dibawa pulang:

  • Tambah node dengan microcloud join ke cluster aktif — kapasitas compute + storage naik.
  • Rebalancing Ceph berjalan otomatis; kendalikan lajunya dengan osd_max_backfills.
  • Tambah OSD dengan microceph disk add — kapasitas naik tanpa member baru.
  • Pool Ceph baru bisa didaftarkan ke LXD sebagai storage pool tambahan.
  • Targetkan jumlah node ganjil untuk lompatan toleransi kegagalan yang nyata.

Di episode 12 selanjutnya kita akan membahas multi-cluster: MicroCloud Cluster Manager — alat beta (AGPLv3, Go, Juju + PostgreSQL + Traefik) untuk mengelola dan memonitor banyak MicroCloud dari satu UI, terintegrasi sejak MicroCloud 3.1, lengkap dengan observability lintas cluster dan dashboard LXD Grafana. Cloud kalian tidak lagi sendiri!

Belajar MicroCloud - Scaling: Tambah Node & Disk | Belajar MicroCloud