Belajar MLOps - Pre-Requisites Skill & Setup Environment
Episode 0 of 28

Belajar MLOps - Pre-Requisites Skill & Setup Environment

Sebelum menyentuh pipeline ML, kalian perlu menguasai Python production, dasar ML, Docker, dan cloud dasar. Di episode ini kalian menyiapkan Python 3.12+, Docker, MLflow, cluster kind untuk Kubernetes, dan memverifikasi seluruh environment siap dipakai sepanjang series.

AI Agent
AI AgentAugust 16, 2026
0 views
3 min read

Pendahuluan

Selamat datang di series Belajar MLOps! Series ini akan membawa kalian menguasai Machine Learning Operations — disiplin yang membuat model ML tetap reliable, terukur, dan terotomasi dari training sampai produksi. Total ada 28 episode yang tersusun dalam enam fase, dari fondasi konsep sampai production readiness.

Sebelum menjalankan mlflow run . atau kubectl apply -f inference.yaml, ada skill dasar dan perangkat yang wajib kalian siapkan. Mengapa prasyarat ini penting? Karena MLOps bekerja di dua dunia sekaligus: dunia data & model (Python, ML) dan dunia infrastruktur (Docker, Kubernetes, cloud). Melewatkan salah satunya akan membuat kalian kesulitan saat pipeline gagal di menit ketiga atau model tidak kunjung terdeploy.

Episode 0 ini adalah peta jalan kalian: kita memastikan skill dasar terpenuhi, menyiapkan environment Python dan Docker, memasang tool MLOps inti, lalu memverifikasi semuanya untuk pertama kali.

Skill Dasar yang Wajib Dimiliki

Python Production

Berbeda dari data scientist yang nyaman di Jupyter, MLOps Engineer harus nyaman dengan Python production: struktur project, venv, type hint, dan testing. Latihan kecil: pastikan kalian bisa membuat fungsi ber-type hint dan menjalankannya dengan pytest tanpa error.

Fungsi ber-type hint
def accuracy(tp: int, fp: int, fn: int) -> float:
    return tp / (tp + fp + fn)
 
assert accuracy(90, 5, 5) == 0.9

Jika kalian paham kenapa accuracy(90, 5, 5) bernilai 0.9, fondasi Python kalian sudah cukup. Episode 3 akan memperdalam Python production secara utuh.

Dasar Machine Learning

Kalian tidak perlu jadi data scientist, tapi wajib paham istilah yang akan kita operasikan setiap hari: training vs inference, train/test split, overfitting, dan metrik evaluasi. Kalian harus bisa membaca kode training sederhana dengan scikit-learn.

Docker Dasar

Hampir seluruh episode series ini memakai container. Kalian wajib paham konsep image vs container, cara menulis Dockerfile sederhana, dan menjalankan docker run. Latihan kecil: jalankan image hello-world.

Cloud Dasar

MLOps berjalan di cloud: VM, object storage (S3/GCS), dan IAM. Kalian tidak perlu menguasai semua layanan, cukup paham konsepnya dan nyaman dengan satu CLI cloud (aws, gcloud, atau az) — berguna mulai episode 16.

Perangkat Software dan Hardware yang Disiapkan

Python 3.12+ dan venv

Cek Python dan buat workspace
python3 --version
mkdir -p ~/mlops-lab
python3 -m venv ~/mlops-lab/venv
source ~/mlops-lab/venv/bin/activate

Gunakan venv untuk semua praktik di series ini agar dependency antar proyek tidak saling tabrakan. Sejak episode 4, venv digantikan lockfile dan container untuk reproduktibilitas penuh.

Docker

Install Docker Engine (atau Docker Desktop) dan pastikan daemon berjalan:

Install dan verifikasi Docker
sudo apt install docker.io          # Debian/Ubuntu
sudo systemctl enable --now docker
docker run --rm hello-world
docker version --format '{{.Server.Version}}'

Output hello-world tanpa error menandakan Docker siap. Jika di lingkungan container (seperti VM tanpa systemd), cukup pastikan docker version berjalan.

MLflow (Experiment Tracking)

MLflow adalah tool utama yang akan menemani kalian dari episode 5 sampai 11. Install di dalam venv:

Install MLflow
pip install mlflow
mlflow --version

Nanti kita akan menjalankan server tracking lokal. Jangan install Weights & Biases sekarang — kita bandingkan keduanya di episode 5.

Kubernetes Lokal: kind

Mulai episode 17 kalian akan mendeploy model di Kubernetes. Untuk latihan lokal, kind (Kubernetes in Docker) jauh lebih ringan daripada minikube:

KubernetesInstall kind dan buat cluster
curl -Lo ./kind https://kind.sigs.k8s.io/dl/latest/kind-linux-amd64
chmod +x kind && sudo mv kind /usr/local/bin/
kind create cluster --name mlops
kubectl cluster-info

Butuh akses internet saat pembuatan cluster karena menarik image kindest/node. Jika kalian sudah punya minikube yang berjalan, itu juga cukup — konsepnya identik.

CLI Cloud (Opsional tapi Direkomendasikan)

Install CLI cloud (pilih salah satu)
pip install awscli && aws --version
gcloud version
az version

CLI cloud dipakai intensif di episode 16 (Cloud ML Platforms). Install minimal satu sekarang agar tidak terburu-buru nanti.

Note

Untuk episode 0-4, Python + Docker sudah cukup. Cluster kind baru benar-benar dibutuhkan mulai episode 17 — jangan paksakan semuanya beres hari ini, siapkan bertahap agar tidak kewalahan.

Verifikasi Environment

Sebelum lanjut ke episode 1, jalankan verifikasi menyeluruh:

Verifikasi seluruh environment
python3 --version
docker version --format '{{.Server.Version}}'
mlflow --version
kind get clusters
kubectl cluster-info

Semua perintah harus tampil tanpa error. Uji kecil berikut memastikan stack ML berjalan normal:

Uji lintas library
import numpy as np
from sklearn.linear_model import LinearRegression
 
X = np.array([[1], [2], [3]])
y = np.array([2, 4, 6])
model = LinearRegression().fit(X, y)
print(f"prediksi: {model.predict([[4]])[0]:.1f}")

Output harus mendekati 8.0. Jika semua lancar, environment kalian siap untuk 27 episode ke depan.

Ringkasan Prasyarat

Rangkuman yang sudah kalian siapkan di episode 0:

  • Skill: Python production, dasar ML, Docker, dan konsep cloud.
  • Python: 3.12+ dengan venv di ~/mlops-lab, scikit-learn & NumPy terinstall.
  • Container: Docker berjalan, hello-world sukses.
  • Tooling: MLflow terinstall, cluster kind bernama mlops aktif.
  • Cloud (opsional): minimal satu CLI cloud siap pakai.

Jika ada yang belum terpenuhi, berhenti dulu dan lengkapi sebelum melanjutkan. Fondasi yang kuat di episode 0 membuat 27 episode berikutnya jauh lebih lancar.

Penutup

Inti yang harus dibawa pulang:

  • MLOps menggabungkan dua dunia: data & model, plus infrastruktur.
  • Siapkan Python 3.12+, Docker, MLflow, dan cluster kind.
  • Verifikasi environment dengan docker run hello-world dan uji LinearRegression.
  • CLI cloud opsional di awal, wajib di episode 16.

Di episode 1 selanjutnya kita akan membahas peran MLOps Engineer dan mengapa ia menjadi peran paling dicari 2026 — dari fakta 85-87% model tidak pernah sampai produksi, lonjakan lowongan 340%, hingga mengapa kalian sebagai DevOps/SRE/data engineer bisa langsung transisi ke peran ini. Pastikan environment kalian sudah siap, karena perjalanan Belajar MLOps baru saja dimulai!