Menghadapi pelajaran Informatika di kelas 12 memang punya tantangan tersendiri. Apalagi kalau sudah masuk bab Analisis Data. Materi ini sering bikin siswa mengernyitkan dahi, karena isinya campuran antara logika, statistik dasar, dan sedikit pemrograman. Padahal kalau sudah paham polanya, analisis data itu sebenarnya menyenangkan. Ibarat main detektif, kita diminta mencari petunjuk dari tumpukan angka lalu menarik benang merahnya.
Masalahnya, jam pelajaran di sekolah kadang tidak cukup untuk latihan banyak soal. Akibatnya, saat ulangan atau ujian praktik, banyak yang blank. Nah, tulisan ini hadir sebagai teman belajar mandiri. Di bawah ini ada puluhan soal yang disusun bertingkat, dari yang ringan sampai yang butuh nalar lebih. Setiap soal sudah dilengkapi kunci jawaban dan pembahasan singkat supaya kamu tidak sekadar menghafal, tapi benar-benar mengerti alurnya.
Sebelum masuk ke soal, ada baiknya kita samakan dulu persepsi tentang apa saja yang biasanya dibahas di bab Analisis Data kelas 12. Kurikulum sekarang umumnya menyentuh topik seperti pengumpulan data, pembersihan data, statistik deskriptif, visualisasi data, sampai pengenalan analisis dengan spreadsheet atau bahasa pemrograman sederhana seperti Python. Jadi soal-soal di bawah ini akan menyebar ke wilayah-wilayah tersebut.
Bagian 1: Soal Pilihan Ganda
1. Tahap pertama yang harus dilakukan sebelum menganalisis data adalah…
A. Membuat grafik
B. Mengumpulkan data
C. Menghitung rata-rata
D. Menarik kesimpulan
E. Mempublikasikan hasil
Jawaban: B
Segala proses analisis selalu dimulai dari pengumpulan data. Tanpa data, tidak ada yang bisa dianalisis. Grafik, rata-rata, dan kesimpulan adalah tahap lanjutan.
2. Data yang berisi nilai tinggi badan siswa dalam satuan sentimeter termasuk jenis data…
A. Kualitatif
B. Nominal
C. Kuantitatif
D. Ordinal
E. Diskrit
Jawaban: C
Ting badan berupa angka dan bisa diukur, jadi masuk kategori kuantitatif. Kalau warnanya “merah, biru, hijau” itu baru kualitatif.
3. Perhatikan data berikut: 7, 8, 5, 9, 7, 6, 7. Modus dari data tersebut adalah…
A. 5
B. 6
C. 7
D. 8
E. 9
Jawaban: C
Angka 7 muncul tiga kali, paling sering dibanding angka lain. Modus adalah nilai yang paling sering muncul.
4. Median dari data 12, 15, 11, 17, 14 adalah…
A. 11
B. 12
C. 14
D. 15
E. 17
Jawaban: C
Urutkan dulu: 11, 12, 14, 15, 17. Nilai tengahnya adalah 14.
5. Rata-rata dari data 6, 8, 10, 12, 14 adalah…
A. 8
B. 9
C. 10
D. 11
E. 12
Jawaban: C
Jumlah semua = 50. Banyak data = 5. Rata-rata = 50 ÷ 5 = 10.
6. Kegiatan mengecek dan memperbaiki data yang kosong, ganda, atau salah format disebut…
A. Visualisasi data
B. Pembersihan data
C. Transformasi data
D. Reduksi data
E. Interpretasi data
Jawaban: B
Pembersihan data atau data cleaning adalah proses wajib sebelum analisis. Data kotor bikin hasil analisis menyesatkan.
7. Grafik yang paling tepat untuk menunjukkan proporsi atau persentase dari keseluruhan adalah…
A. Diagram garis
B. Diagram batang
C. Diagram lingkaran
D. Histogram
E. Scatter plot
Jawaban: C
Diagram lingkaran atau pie chart memang dipakai untuk menunjukkan bagian terhadap keseluruhan.
8. Dalam Python, library yang paling umum digunakan untuk mengolah dan menganalisis data berbentuk tabel adalah…
A. Turtle
B. Pygame
C. Pandas
D. Tkinter
E. Django
Jawaban: C
Pandas menyediakan struktur DataFrame yang sangat membantu saat mengolah data tabular.
9. Perhatikan potongan kode berikut:
data = [4, 8, 6, 10] print(sum(data) / len(data))
Output yang dihasilkan adalah…
A. 4
B. 6
C. 7
D. 8
E. 10
Jawaban: C
Jumlah data = 28, panjang data = 4. Hasilnya 28 ÷ 4 = 7.
10. Fungsi yang digunakan di Excel untuk menghitung banyaknya data angka dalam suatu rentang adalah…
A. SUM
B. AVERAGE
C. COUNT
D. MAX
E. IF
Jawaban: C
COUNT menghitung jumlah sel berisi angka. Kalau COUNTA menghitung semua sel yang tidak kosong.
11. Data yang dikumpulkan langsung oleh peneliti dari sumber pertama disebut…
A. Data sekunder
B. Data primer
C. Data kualitatif
D. Data nominal
E. Data eksternal
Jawaban: B
Data primer didapat langsung, misalnya lewat kuesioner atau observasi. Data sekunder berasal dari pihak lain.
12. Nilai yang membagi data menjadi empat bagian sama banyak disebut…
A. Desil
B. Persentil
C. Kuartil
D. Modus
E. Range
Jawaban: C
Kuartil membagi data jadi empat. Desil jadi sepuluh, persentil jadi seratus.
13. Simpangan baku atau standar deviasi menunjukkan…
A. Nilai tengah data
B. Seberapa menyebar data dari rata-rata
C. Nilai yang paling sering muncul
D. Selisih data terbesar dan terkecil
E. Jumlah seluruh data
Jawaban: B
Standar deviasi mengukur sebaran. Semakin besar nilainya, semakin bervariasi datanya.
14. Pada DataFrame Pandas bernama df, perintah untuk menampilkan lima baris pertama adalah…
A. df.tail()
B. df.head()
C. df.show()
D. df.first()
E. df.open()
Jawaban: B
head() defaultnya menampilkan lima baris teratas.
15. Kesalahan yang muncul karena mengambil kesimpulan dari data yang tidak mewakili populasi disebut…
A. Bias sampling
B. Outlier
C. Missing value
D. Duplikasi
E. Normalisasi
Jawaban: A
Bias sampling terjadi ketika sampel tidak representatif, sehingga kesimpulan jadi keliru.
Bagian 2: Soal Isian Singkat
16. Sebutkan tiga tahapan dalam proses analisis data!
Jawaban: Pengumpulan data, pembersihan data, dan analisis atau interpretasi data. (Jawaban lain yang relevan bisa diterima, misalnya visualisasi.)
17. Apa yang dimaksud dengan outlier?
Jawaban: Outlier adalah nilai yang jauh berbeda dari sebagian besar data lainnya. Biasanya muncul karena kesalahan input atau memang fenomena langka.
18. Tuliskan rumus umum untuk menghitung rata-rata!
Jawaban: Rata-rata = jumlah seluruh data dibagi banyaknya data.
19. Di Excel, fungsi apa yang dipakai untuk mencari nilai tertinggi?
Jawaban: MAX.
20. Library Python apa yang sering dipakai untuk membuat grafik dan visualisasi data?
Jawaban: Matplotlib atau Seaborn.
Bagian 3: Soal Uraian
21. Jelaskan perbedaan antara data kualitatif dan data kuantitatif, lalu berikan masing-masing dua contoh!
Jawaban:
Data kualitatif adalah data yang tidak berbentuk angka dan biasanya menggambarkan sifat atau kategori. Contohnya warna favorit siswa dan jenis kelamin. Data kuantitatif adalah data yang berupa angka dan bisa diukur atau dihitung. Contohnya tinggi badan dan jumlah saudara.
22. Diketahui data nilai ulangan: 70, 80, 90, 60, 80, 75, 85. Hitunglah mean, median, dan modusnya!
Jawaban:
Urutkan data: 60, 70, 75, 80, 80, 85, 90.
Mean = (60+70+75+80+80+85+90) ÷ 7 = 540 ÷ 7 = 77,14.
Median = nilai ke-4 = 80.
Modus = 80 karena muncul dua kali.
23. Mengapa pembersihan data penting dilakukan sebelum analisis? Jelaskan!
Jawaban:
Karena data mentah sering mengandung nilai kosong, duplikat, atau format yang tidak konsisten. Kalau dibiarkan, hasil analisis bisa salah dan kesimpulan yang diambil jadi menyesatkan. Pembersihan data memastikan hanya data valid yang diproses.
24. Tuliskan contoh potongan kode Python sederhana untuk menghitung rata-rata dari sebuah list!
Jawaban:
nilai = [80, 75, 90, 85] rata = sum(nilai) / len(nilai) print(rata)
25. Sebutkan dan jelaskan tiga jenis visualisasi data beserta kegunaannya!
Jawaban:
Diagram batang digunakan untuk membandingkan nilai antar kategori. Diagram garis cocok untuk menunjukkan tren dari waktu ke waktu. Diagram lingkaran dipakai untuk memperlihatkan proporsi tiap bagian terhadap keseluruhan.
Bagian 4: Soal Studi Kasus
26. Sebuah sekolah ingin mengetahui minat ekstrakurikuler siswa. Data dikumpulkan dari 200 responden. Hasilnya: futsal 60 siswa, basket 50 siswa, paskibra 40 siswa, seni 30 siswa, dan sisanya memilih robotik. Berapa persen siswa yang memilih robotik?
Jawaban:
Total yang sudah diketahui = 60+50+40+30 = 180.
Sisa untuk robotik = 200 – 180 = 20 siswa.
Persentase = (20 ÷ 200) × 100% = 10%.
27. Perhatikan data penjualan harian sebuah kantin: 50, 55, 60, 45, 100. Nilai 100 terlihat janggal. Apa yang sebaiknya dilakukan analis sebelum menghitung rata-rata?
Jawaban:
Analis perlu memeriksa apakah 100 merupakan outlier akibat kesalahan pencatatan atau memang data asli. Jika terbukti salah input, nilai tersebut diperbaiki atau dihapus. Jika asli, analisis bisa dilakukan dengan atau tanpa outlier, dan hasilnya dibandingkan agar kesimpulan tetap akurat.
28. Kamu diberi file CSV berisi data siswa dengan kolom nama, kelas, dan nilai. Tuliskan langkah singkat membaca file tersebut menggunakan Pandas!
Jawaban:
import pandas as pd df = pd.read_csv("data_siswa.csv") print(df.head())
Bagian 5: Tips Mengerjakan Soal Analisis Data
Satu hal yang sering dilupakan siswa adalah membaca soal sampai tuntas. Banyak yang langsung menghitung begitu melihat angka, padahal yang diminta bisa jadi median, bukan mean. Biasakan menandai kata kunci seperti “rata-rata”, “nilai tengah”, “paling sering muncul”, atau “persentase”. Kata-kata itu menentukan rumus yang dipakai.
Selain itu, latih kemampuan membaca tabel dan grafik. Di ujian praktik, sering muncul sajian data dalam bentuk tabel lalu kita diminta menafsirkan. Kemampuan ini hanya terasah kalau sering berlatih, bukan sekadar menghafal rumus.
Untuk soal pemrograman, jangan takut mencoba. Tulis kode sederhana, jalankan, lihat hasilnya. Salah itu bagian dari proses. Yang penting kamu paham logikanya, bukan sekadar menyalin.
Bagian 6: Rangkuman Materi yang Perlu Diingat
Analisis data pada dasarnya adalah rangkaian kegiatan mulai dari mengumpulkan, membersihkan, mengolah, hingga menafsirkan data untuk mengambil keputusan. Statistika deskriptif seperti mean, median, modus, dan standar deviasi menjadi alat dasar yang wajib dikuasai. Visualisasi data membantu menyampaikan pesan dari angka-angka agar lebih mudah dipahami. Sementara itu, tools seperti Excel, Google Sheets, Pandas, dan Matplotlib menjadi senjata praktis di dunia nyata.
Dengan sering mengerjakan latihan seperti di atas, kamu tidak hanya siap menghadapi ulangan, tapi juga punya bekal berpikir kritis. Kemampuan membaca data kini dicari di banyak bidang, dari bisnis sampai kesehatan. Jadi, kuasai materinya sekarang, manfaatnya terasa jauh setelah lulus nanti.
Kalau ada soal yang masih terasa sulit, coba ulang dari bagian dasar. Pahami konsepnya, baru hafalkan rumusnya. Selamat belajar, dan jangan ragu berlatih lebih dari sekali.









