stdsquare²
🎓 Kelas
stdsquare / materi / slides / pertemuan-02
Tema
Japan
Arcade
Dark Retro
Font
‹ Daftar slide Pertemuan 2: Statistik Deskriptif Returns dan Volatilitas
Prodi Bisnis Digital · FEB UNDIP

Machine Learning in Finance

Pertemuan 2: Statistik Deskriptif Returns dan Volatilitas

Sebelum model apa pun dibangun, kita harus bisa membaca angka mentah harga saham menjadi return dan volatilitas — dua bahasa dasar keuangan kuantitatif.

RPS minggu 2 · 2x50 menit

Tujuan Pembelajaran Hari Ini

Di akhir pertemuan ini, Anda mampu:

Return
Menghitung simple return dan log return dari deret harga aset, serta menjelaskan bedanya.
Volatilitas
Menghitung variance dan standar deviasi return sebagai ukuran risiko, lalu men-annualize-kannya.
Pola Data
Mengenali volatility clustering dan fat tail — dua fenomena data finansial yang membedakannya dari data "normal".
Jembatan ke ML
Menjelaskan mengapa statistik deskriptif ini menjadi fitur (feature) input bagi model machine learning finance selanjutnya.

Mengapa Bukan Harga Saja yang Dilihat?

Bandingkan dua saham fiktif berbasis emiten nyata di Bursa Efek Indonesia (BEI):

BBCA (bank besar)
Rp 9.000 → Rp 9.200
Harga naik ~Rp 200. Terlihat kecil, tapi apakah itu pergerakan wajar atau luar biasa untuk saham ini?
GOTO (teknologi)
Rp 60 → Rp 62
Harga naik ~Rp 2. Angka rupiahnya jauh lebih kecil, tapi persentasenya bisa jadi lebih besar.
Harga mentah (Rp) tidak bisa dibandingkan langsung antar-saham karena skalanya berbeda. Kita butuh ukuran yang relatif, yaitu return (persentase perubahan).
Bagian 1 dari 3
Returns: Dari Harga ke Perubahan Relatif
Cara mengubah deret harga saham menjadi ukuran keuntungan/kerugian yang bisa dibandingkan antar-waktu dan antar-aset.

Simple Return: Persentase Perubahan Harga

Return adalah persentase perubahan nilai aset dari satu periode ke periode berikutnya. Bentuk paling umum disebut simple return.

Rt = (Pt − Pt−1) / Pt−1
Keterangan simbol
  • Pt = harga aset pada periode sekarang (mis. harga penutupan hari ini)
  • Pt−1 = harga aset pada periode sebelumnya (mis. harga penutupan kemarin)
  • Rt = return periode t, biasanya ditulis dalam bentuk persen (%)

Hitung dari Nol: Return Harian BBCA

Data ilustrasi harga penutupan BBCA (Rp): kemarin Rp 9.000, hari ini Rp 9.200.

LangkahPerhitunganNilai
1. Harga kemarin (Pt−1)diketahuiRp 9.000
2. Harga hari ini (Pt)diketahuiRp 9.200
3. Selisih harga9.200 − 9.000Rp 200
4. Simple return200 / 9.0000,0222 = 2,22%
5. Log returnln(9.200 / 9.000)0,0220 = 2,20%
Hasil Return Harian BBCA
2,22%
simple return (log return 2,20% — hampir sama untuk perubahan kecil)

Simple Return vs Log Return: Kapan Pakai Mana?

Simple return
  • Mudah diinterpretasi: "untung 2,22%"
  • Cocok untuk laporan ke nasabah/investor
  • Tidak bisa langsung dijumlah antar-periode
Log return
  • ln(Pt/Pt−1) — memakai logaritma natural (ln)
  • Bisa dijumlah antar-hari untuk dapat return kumulatif
  • Standar dipakai di model time series (ARIMA, GARCH)
Mata kuliah ini akan lebih sering memakai log return mulai pertemuan-pertemuan model time series, karena sifatnya yang bisa dijumlahkan.

Return Kumulatif: Menyambung Beberapa Periode

Untuk mengetahui total keuntungan selama beberapa hari, return harian harus digabung secara majemuk (compounding), bukan dijumlah biasa.

Rkumulatif = (1+R1)×(1+R2)×…×(1+Rn) − 1
Contoh singkat — 2 hari BBCA

Hari 1: return +2,22%  |  Hari 2: return −1,00%

Rkumulatif = (1,0222 × 0,9900) − 1 = 1,0120 − 1 = 1,20%

Jebakan umum pemula: menjumlahkan langsung 2,22% + (−1,00%) = 1,22% — hampir benar tapi tidak presisi. Cara majemuk (1,20%) yang akurat secara matematis.

Distribusi Return: Tidak Selalu "Normal"

Return finansial sering digambar sebagai kurva lonceng (distribusi normal), tapi kenyataannya punya fat tail — kejadian ekstrem lebih sering terjadi dari yang diprediksi kurva normal.

Return harian (0 = rata-rata)fat tail kirifat tail kanankurva normal (garis putus)
Contoh nyata fat tail: penurunan tajam harga saham saat krisis 2008 atau awal pandemi Maret 2020 — kejadian yang menurut distribusi normal "seharusnya" nyaris mustahil terjadi.

Coba Sendiri: Bentuk Ekor Distribusi Return

Ubah parameter data dan amati bagaimana histogram empiris return berubah bentuk dibanding kurva normal teoretis.

Bagian 2 dari 3
Volatilitas: Mengukur Risiko
Dari sekumpulan return, kita ringkas seberapa besar fluktuasinya menjadi satu angka: standar deviasi.

Variance dan Standar Deviasi sebagai Ukuran Risiko

Volatilitas mengukur seberapa jauh return "menyebar" dari rata-ratanya. Semakin besar sebarannya, semakin tidak pasti hasil investasi.

σ2 = Σ(Ri − R̄)2 / (n−1)
Keterangan simbol
  • Ri = return pada observasi ke-i; (dibaca "R bar") = rata-rata (mean) return
  • σ2 (variance) = rata-rata kuadrat deviasi dari mean
  • σ (standar deviasi) = akar dari variance — inilah yang disebut volatilitas
  • n−1 = pembagi untuk sampel (bukan seluruh populasi), konvensi standar statistik

Hitung dari Nol: Volatilitas dari 5 Hari Return

Data ilustrasi return harian (%): 2; −1; 1; −2; 0 (n = 5 observasi).

LangkahPerhitunganNilai
1. Rata-rata (mean)(2−1+1−2+0) / 50%
2. Deviasi kuadrat tiap hari2², 1², 1², 2², 0²4; 1; 1; 4; 0
3. Jumlah deviasi kuadrat4+1+1+4+010
4. Variance (sampel, n−1)10 / (5−1)2,5
5. Standar deviasi harian√2,51,58%
Volatilitas Harian
1,58%
standar deviasi return 5 hari (data ilustrasi)

Men-tahunkan Volatilitas (Annualizing)

Volatilitas harian sulit dibandingkan dengan angka yang biasa dilaporkan media (biasanya tahunan). Kita gunakan aturan akar-waktu (square-root-of-time rule), dengan asumsi ~252 hari bursa efektif per tahun di BEI.

σtahunan = σharian × √252
Menerapkan ke hasil slide sebelumnya

σharian = 1,58%  →  √252 ≈ 15,87

σtahunan = 1,58% × 15,87 ≈ 25,07%

Asumsi kunci rumus ini: return antar-hari independen (tidak saling memengaruhi). Pada kenyataannya asumsi ini sering dilanggar — lihat slide berikutnya.

Volatility Clustering: Volatilitas Tidak Konstan

Fenomena empiris: periode volatilitas tinggi cenderung diikuti periode volatilitas tinggi lain, dan periode tenang diikuti periode tenang lain.

periode bergejolak (mis. krisis)periode bergejolak lagiperiode tenang
Implikasi untuk pemodelan: volatilitas hari ini membantu memprediksi volatilitas besok — inilah gagasan dasar model ARCH/GARCH yang akan kita pelajari beberapa minggu lagi.
Bagian 3 dari 3
Dari Statistik Deskriptif ke Machine Learning
Menyambungkan angka-angka yang baru kita hitung ke peran mereka sebagai fitur input model machine learning finance.

Statistik Deskriptif = Fitur (Feature) untuk Model ML

Model machine learning (ML) tidak "melihat" grafik harga seperti manusia — ia hanya menerima angka. Statistik deskriptif inilah yang menjadi fitur (feature) input model.

Ukuran statistik dasar sebagai fitur
  • Mean — rata-rata return, proksi ekspektasi keuntungan
  • Standar deviasi — volatilitas, proksi risiko
  • Skewness — kemencengan distribusi (return ekstrem lebih sering di sisi mana?)
  • Kurtosis — "ketebalan ekor" distribusi (proksi fat tail yang kita bahas tadi)
Model klasifikasi/regresi yang akan Anda pelajari (logistic regression, random forest, dst.) sering memakai mean, std dev, skewness, dan kurtosis return sebagai kolom input tabel data.

Studi Kasus: Membandingkan Volatilitas Dua Saham BEI

Ilustrasi volatilitas tahunan (dibulatkan) berdasarkan pola historis umum kedua saham — angka aktual berfluktuasi tiap periode.

BBCA (perbankan besar)
~18%
volatilitas tahunan (ilustrasi)
Saham blue-chip, likuid, cenderung lebih stabil karena basis bisnis mapan dan investor institusi dominan.
GOTO (teknologi/startup)
~45%
volatilitas tahunan (ilustrasi)
Saham teknologi yang lebih muda, sentimen investor ritel lebih dominan, model bisnis masih menuju profitabilitas.
Volatilitas lebih tinggi ≠ pasti "buruk" — ia berarti rentang hasil lebih lebar, bisa untung besar maupun rugi besar. Investor konservatif umumnya menghindari volatilitas tinggi tanpa kompensasi return yang sepadan.

Latihan Kelas: Hitung Sendiri

Kerjakan berpasangan (5 menit), memakai kalkulator biasa:

Instruksi
  • Data harga penutupan saham fiktif "UMKM Digital Tbk." 4 hari berturut-turut: Rp 1.000; Rp 1.050; Rp 1.020; Rp 1.100.
  • 1) Hitung simple return untuk tiap pasangan hari berurutan (3 nilai return).
  • 2) Hitung mean dan standar deviasi dari ketiga return tersebut (pembagi n−1).
  • 3) Bandingkan hasil kelompok Anda dengan kelompok sebelah — apakah sama?
Dosen akan berkeliling membantu; kita bahas jawabannya bersama setelah 5 menit.

Kesalahan Umum Pemula — Hindari Ini

Menjumlahkan return langsung antar-periode, bukan memakai perkalian majemuk (1+R) — hasilnya sedikit meleset untuk periode panjang.
Lupa mengubah persen ke desimal sebelum dihitung (2% harus jadi 0,02, bukan angka 2 mentah) — hasil variance bisa salah 10.000 kali lipat.
Memakai pembagi n, bukan n−1, saat menghitung variance dari data sampel historis — sedikit meremehkan volatilitas sesungguhnya.
Mengasumsikan return selalu mengikuti distribusi normal, padahal data finansial nyata sering fat tail — bisa meremehkan risiko kejadian ekstrem.

Rangkuman & Menuju Pertemuan 3

KonsepRumus Kunci
Simple return(Pt − Pt−1) / Pt−1
Log returnln(Pt / Pt−1)
Variance (sampel)Σ(Ri−R̄)² / (n−1)
Volatilitas tahunanσharian × √252
Minggu depan (Pertemuan 3)

Model time series klasik: OLS sebagai fondasi untuk regresi dan forecasting data finansial.

Tugas Sebelum Pertemuan 3
Unduh data harga penutupan 1 saham BEI pilihan Anda (mis. dari IDX/Yahoo Finance), hitung mean & std dev return hariannya secara manual.