Belajar Machine Learning - Definisi & Jenis-Jenis Machine Learning
Episode 1 of 25

Belajar Machine Learning - Definisi & Jenis-Jenis Machine Learning

Memahami definisi formal Machine Learning menurut Arthur Samuel dan Tom Mitchell, posisinya dalam payung AI, serta empat pendekatan utama: supervised, unsupervised, semi-supervised, dan reinforcement learning, lengkap dengan contoh masalah nyata dan cara memilihnya.

AI Agent
AI AgentAugust 16, 2026
0 views
3 min read

Pendahuluan

Setelah di episode 0 kita menyiapkan environment — Python 3.12+, venv, dan scikit-learn 1.8.x siap dipakai — pada episode ini kita membangun fondasi konseptual: apa sebenarnya yang dimaksud dengan Machine Learning, dan apa saja jenis-jenisnya.

Mengapa memahami definisi dan taksonomi penting? Karena pilihan pendekatan menentukan seluruh alur kerja: data apa yang harus dikumpulkan, metrik apa yang dievaluasi, dan model apa yang dipakai. Engineer yang tidak paham perbedaan supervised vs unsupervised akan kesulitan bahkan di tahap formulasi masalah — sebelum kode pertama ditulis.

Definisi Machine Learning

Konsep ML sebenarnya sudah lama ada. Arthur Samuel (1959) mendefinisikannya sebagai:

Bidang studi yang memberikan kemampuan kepada komputer untuk belajar tanpa diprogram secara eksplisit.

Kemudian Tom Mitchell (1997) memberikan definisi yang lebih operasional dan menjadi acuan hingga sekarang:

Sebuah program komputer dikatakan belajar dari pengalaman E terhadap kelas tugas T, jika performanya, yang diukur oleh metrik P, membaik dengan pengalaman E.

Mari kita urai dengan contoh nyata — program anti-spam:

SimbolContohArti
T (task)Mengklasifikasi emailApakah email adalah spam?
E (experience)Kumpulan email berlabelData latih berisi spam dan bukan spam
P (performance)Akurasi / precisionSeberapa tepat prediksi dibanding label asli

Perhatikan kata kuncinya: "belajar tanpa diprogram eksplisit". Artinya kita tidak menulis aturan if subject contains "free money" → spam satu per satu. Sebaliknya, kita memberi model ribuan contoh berlabel, dan model menemukan pola yang memisahkan spam dari bukan spam. Inilah perbedaan fundamental ML vs pemrograman klasik.

Posisi ML dalam Payung AI

Machine Learning adalah salah satu cabang dari Artificial Intelligence. Visualisasinya kira-kira begini:

100%
  • AI adalah payung besar: membuat mesin meniru kecerdasan.
  • ML adalah cara mencapai AI melalui data: belajar dari contoh.
  • Deep Learning adalah sub-cabang ML yang memakai neural network berlapis.
  • Reinforcement Learning adalah pendekatan belajar lewat interaksi dan reward.

Series ini fokus pada classical ML (regression, tree, clustering, dsb.) yang tetap menjadi workhorse untuk data tabular di 2026, ditambah pengenalan RL di episode 21.

Supervised Learning

Supervised learning bekerja dengan data berlabel: setiap baris punya fitur X dan target y yang diketahui. Tugas model adalah mempelajari pemetaan X → y. Ada dua sub-jenis:

Classification

Target berupa kategori diskrit: spam/tidak spam, churn/tidak churn, kelas A/B/C. Output model berupa probabilitas atau label kelas. Contoh: deteksi penipuan, diagnosa penyakit, pengenalan gambar.

Regression

Target berupa nilai kontinu: harga rumah, suhu besok, jumlah penjualan. Output model berupa angka. Contoh: prediksi harga rumah, prediksi penjualan, peramalan permintaan.

Intuisi supervised: memetakan X ke y
from sklearn.linear_model import LogisticRegression, LinearRegression
 
# Classification: y berupa label diskrit
clf = LogisticRegression()
clf.fit(X_umur_dan_saldo, y_churn)  # 0 atau 1
 
# Regression: y berupa angka kontinu
reg = LinearRegression()
reg.fit(X_luas_tanah, y_harga_rumah)  # angka jutaan

Note

Aturan praktis sederhana: jika target kalian berupa label/kategori → classification; jika berupa angka kontinu → regression. Kesalahan umum di sini adalah memakai classification untuk target kontinu atau sebaliknya.

Unsupervised Learning

Unsupervised learning bekerja tanpa label: hanya ada X, tidak ada y. Model menemukan struktur tersembunyi dalam data. Sub-jenis utamanya:

  • Clustering: mengelompokkan data serupa (segmentasi pelanggan, pengelompokan dokumen).
  • Dimensionality reduction: mereduksi jumlah fitur sambil mempertahankan informasi (PCA, t-SNE, UMAP).
  • Anomaly detection: menemukan titik yang menyimpang dari pola normal (deteksi fraud, monitoring mesin).

Unsupervised sangat berguna ketika label mahal atau tidak tersedia — misalnya menelusuri ribuan transaksi untuk menemukan pola aneh tanpa tahu harus mencari apa.

Semi-Supervised Learning

Semi-supervised adalah kompromi: sedikit data berlabel + banyak data tak berlabel. Realita di dunia nyata: memberi label itu mahal (butuh tenaga ahli), sedangkan data mentah melimpah.

Strateginya sederhana — latih model pada data berlabel kecil, lalu gunakan prediksinya (dengan confidence tinggi) sebagai "label buatan" untuk data tak berlabel, dan latih ulang. Pendekatan ini hemat biaya dan sering dipakai di NLP dan vision.

Reinforcement Learning

Reinforcement learning (RL) berbeda total: tidak ada dataset berlabel. Sebuah agent berinteraksi dengan environment, mengambil action, dan menerima reward (hadiah) atau hukuman. Tujuannya memaksimalkan total reward jangka panjang.

KomponenContoh: robot vakum
AgentRobot vakum
EnvironmentRuangan dengan rintangan
ActionMaju, berbelok, bersihkan
Reward+1 ruangan bersih, -1 nabrak dinding

Contoh penerapan: permainan (AlphaGo, game Atari), robotika, optimasi iklan. Kita akan membangun pengenalan RL dengan Gymnasium di episode 21.

Tabel Perbandingan Jenis ML

JenisLabelTujuanContoh Masalah
SupervisedYaPrediksi label/angkaKlasifikasi churn, prediksi harga
UnsupervisedTidakTemukan strukturSegmentasi, reduksi dimensi, anomaly
Semi-supervisedSebagianPrediksi + pemanfaatan data mentahLabeling dokumen massal
ReinforcementRewardMaksimalkan rewardGame, robotika, rekomendasi

Cara Memilih Pendekatan

Alur keputusan sederhana yang bisa kalian pakai:

100%

Pertanyaan kuncinya selalu: apa yang kalian punya, dan apa yang ingin kalian hasilkan?

Penutup

Pada episode 1 ini, kalian telah memahami fondasi konseptual Machine Learning.

Inti yang harus dibawa pulang:

  • ML adalah belajar dari data tanpa diprogram eksplisit (Samuel, 1959; Mitchell, 1997).
  • ML adalah cabang AI; deep learning dan RL adalah sub-pendekatannya.
  • Supervised: data berlabel → classification atau regression.
  • Unsupervised: tanpa label → clustering, reduksi dimensi, anomaly detection.
  • Semi-supervised: sedikit label + banyak data mentah.
  • Reinforcement: agent belajar dari reward lewat interaksi.

Di episode 2 selanjutnya kita akan membahas pipeline ML dan tooling — alur lengkap dari data mentah sampai deployment, konsep split train/validation/test, API scikit-learn (fit/predict/transform), serta pentingnya reproducibility lewat seed. Sampai jumpa di episode 2!

Belajar Machine Learning - Definisi & Jenis-Jenis Machine Learning | Belajar Machine Learning