Membongkar sistem yang mengelola jutaan elemen jaringan: framework FCAPS, hierarki EMS/NMS/OSS, alur provisioning dan activation, arsitektur billing & charging, integrasi via southbound/northbound interface, serta praktik membangun monitoring NMS mini dengan SNMP dan Prometheus di lab

Setelah di episode 9 kita merancang jaringan FTTx sampai ke rumah pelanggan, muncul pertanyaan operasional besar: bagaimana operator mengelola ratusan ribu elemen jaringan — BTS, router, OLT, core nodes — plus jutaan pelanggan, setiap hari, tanpa chaos? Jawabannya adalah dua sistem kembar: OSS (Operations Support System) untuk jaringan, dan BSS (Business Support System) untuk pelanggan & uang.
Mengapa episode ini penting? Karena sebagian besar pekerjaan harian engineer operator berinteraksi dengan OSS/BSS: melihat alarm di NMS, memproses aktivasi pelanggan, menarik laporan KPI, atau mencari kenapa CDR pelanggan tidak cocok dengan pemakaian. Engineer yang paham alur data antar sistem ini bisa memecahkan masalah lintas domain — keterampilan yang membedakan senior dari junior.
ISO mendefinisikan lima fungsi manajemen jaringan yang masih dipakai sampai sekarang:
| Fungsi | Pertanyaan Inti | Contoh Aktivitas |
|---|---|---|
| Fault | Apa yang rusak? | Alarm, event correlation, tiket gangguan |
| Configuration | Bagaimana disetel? | Provisioning, backup config, change management |
| Accounting | Siapa pakai apa? | CDR, metering, alokasi biaya |
| Performance | Seberapa baik? | KPI, trend kapasitas, SLA report |
| Security | Siapa boleh? | AAA, audit log, hardening akses NMS |
Latihan membiasakan diri: saat kalian menghadapi insiden apa pun, klasifikasikan ke salah satu lima kotak ini. Cara berpikir terstruktur semacam ini yang dicari saat interview operasional.
Manajemen jaringan tersusun bertingkat:
Interface antar lapis punya nama standar: southbound (ke elemen jaringan — SNMP, NETCONF, CLI), northbound (ke atas — API REST/SOAP), dan TMForum mendefinisikan model data seperti SID serta framework eTOM untuk proses bisnisnya.
Alur alarm yang sehat:
NE mendeteksi → trap/notification ke NMS → de-dup & korelasi
→ auto-ticket → dispatch teknisi → clear + RCAMasalah dunia nyata bukan kurang alarm, melainkan banjir alarm: satu fiber putus memicu ratusan alarm turunan. Korelasi cerdas harus menyaring akar penyebab ("fiber cut segment X") dari gejala ("12 site unreachable"). Metrik keberhasilannya: MTTR (waktu pulih) dan alarm-to-ticket ratio.
Mari bangun fondasi NMS sendiri di lab (environment episode 0).
Pada router VyOS/FRR di GNS3:
set service snmp community LabRO authorization ro
set service snmp contact noc@lab.local
commit ; save
snmpwalk -v2c -c LabRO 192.168.100.1 sysDescr.0 # uji dari hostJalankan snmp-exporter dan daftarkan target:
scrape_configs:
- job_name: "snmp-routers"
metrics_path: /snmp
params:
module: [if_mib]
static_configs:
- targets: ["192.168.100.1"]
relabel_configs:
- source_labels: [__address__]
target_label: __param_target
- target_label: __address__
replacement: "127.0.0.1:9116"Utilisasi interface tertinggi (indikasi link penuh) via PromQL:
rate(ifHCOutOctets[5m]) * 8 / ifHighSpeed * 100Dan aturan alert ketik melewati 85% selama 10 menit:
groups:
- name: transport
rules:
- alert: LinkSaturation
expr: link_utilization > 85
for: 10m
labels: {severity: warning}
annotations:
summary: "Utilisasi > 85% pada {{ $labels.ifDescr }}"Tip
Pola in-band vs out-of-band: pastikan jalur manajemen (SNMP/SSH ke NE) tidak lewat jalur yang sedang mati. Operator serius menyediakan OOB network terpisah — tanpa itu, saat ring putus kalian juga kehilangan mata untuk melihat ke mana-mana.
Saat pelanggan baru memesan layanan, inilah rantai otomatis yang seharusnya terjadi:
Titik gagal favorit lapangan: mismatch data antara inventory dan kondisi nyata (port tercatat kosong padahal dipakai). Itulah kenapa disiplin update inventory — atau sinkronisasi otomatis via autodiscovery — adalah masalah serius, bukan urusan administrasi belaka.
Inti yang harus dibawa pulang:
Di episode 11 kita turun ke lapangan lagi: optimasi jaringan radio — KPI RSRP/RSRQ/SINR, drive test, dan siklus optimization yang dipakai operator menjaga kualitas jutaan pengguna. Sampai jumpa!