Menghadapi tumpukan data sekunder sering kali membuat peneliti pemula merasa bingung ketika harus memasukkannya ke dalam perangkat lunak analisis. Artikel ini menyajikan cara mengolah data sekunder ke spss secara sistematis agar hasil analisis Anda akurat dan bebas dari galat teknis.
Berdasarkan pembagian data dalam ilmu statistik, data memang terbagi menjadi dua jenis utama berdasarkan sumbernya, yaitu data primer dan data sekunder. Karakteristik khas dari data sekunder adalah jenis data historis karena telah dikumpulkan di masa lalu oleh orang lain dari sumber primer untuk tujuan tertentu.
Dari pengalaman saya menangani berbagai proyek riset, banyak peneliti memilih jalur ini karena proses pengumpulan data sekunder terbilang lebih mudah, singkat, hemat, dan sumber pengambilannya lebih mudah diakses dibandingkan data primer. Anda tidak perlu menyebar kuesioner atau mematuhi proporsi sampel yang rumit di lapangan. Namun, tantangan terbesarnya justru ada pada proses perapian sebelum siap dieksekusi di SPSS.
Data sekunder bersumber dari pihak ketiga, seperti laporan tahunan perusahaan, publikasi badan pusat statistik, atau rekam medis rumah sakit. Sebelum membuka aplikasi SPSS, pastikan data Anda sudah memenuhi kriteria kebersihan data statistik.
Kesalahan umum yang saya lihat adalah peneliti langsung menyalin data mentah dari file PDF atau situs web ke dalam SPSS tanpa melakukan pemeriksaan ulang. Hal ini berpotensi merusak struktur pembacaan variabel pada sistem.
Berikut adalah beberapa aspek penting yang harus Anda siapkan terlebih dahulu sebelum melakukan impor data:
- Pastikan format angka sudah konsisten, terutama penggunaan tanda koma atau titik sebagai pemisah desimal.
- Susun data dalam format baris untuk setiap subjek/tahun (case) dan kolom untuk setiap variabel.
- Identifikasi jenis skala pengukuran data Anda, apakah termasuk rasio, interval, nominal, atau ordinal.
- Bersihkan sel yang kosong atau berisi teks non-angka pada variabel kuantitatif agar tidak terbaca sebagai string di SPSS.
Lembaga pemerintah biasanya mengumpulkan data publikasi seperti sensus, kesehatan, dan pendidikan dengan tujuan membuat perencanaan tepat, pengalokasian data tepat sasaran, dan membuat prioritas proyek. Struktur data massal seperti ini wajib dirapikan terlebih dahulu di Microsoft Excel.
Langkah Impor Data Sekunder dari Excel ke SPSS
Cara tercepat untuk memindahkan data sekunder dalam jumlah besar adalah dengan memanfaatkan fitur impor dari berkas spreadsheet. Metode ini meminimalkan risiko salah ketik yang sering terjadi pada input manual.
Buka perangkat lunak SPSS Anda yang sudah terpasang di komputer. Ikuti urutan langkah di bawah ini untuk memulai proses transfer data secara aman:
- Klik menu File pada pojok kiri atas layar SPSS Anda.
- Pilih opsi Import Data, kemudian klik Excel.
- Cari lokasi penyimpanan file spreadsheet data sekunder Anda, lalu klik Open.
- Pada kotak dialog yang muncul, centang opsi "Read variable names from first row of data" jika baris pertama Excel Anda berisi nama variabel.
- Klik OK dan tunggu hingga data terisi sempurna pada lembar kerja SPSS.
Setelah data masuk, Anda wajib memeriksa dua tab utama di bagian bawah layar, yaitu Data View dan Variable View. Pastikan tipe data pada Variable View sudah sesuai dengan sifat data sekunder Anda.
Pengaturan Variabel yang Tepat pada Variable View
Langkah ini merupakan krusial penentu apakah formula statistik Anda bisa berjalan atau tidak. Sering kali uji statistik menolak mengeksekusi data karena tipenya salah.
Mengatur Tipe Data dan Label
Dalam kasus yang sering saya temui, data sekunder berupa angka rasio sering kali otomatis terbaca sebagai tipe String (teks) oleh SPSS jika ada satu saja sel yang mengandung huruf. Ubah kolom Type menjadi Numeric untuk semua variabel angka.
Isi kolom Label dengan penjelasan lengkap dari variabel tersebut. Kolom ini berfungsi memberikan keterangan yang jelas saat lembar output hasil uji statistik dicetak.
Menentukan Skala Pengukuran (Measure)
Kolom Measure di ujung kanan Variable View wajib diatur dengan benar. Untuk data sekunder yang berupa angka absolut atau rasio (seperti nilai keuangan atau indeks), pilih opsi Scale.
Jika data sekunder Anda berupa kategori berperingkat, Anda bisa memilih Ordinal. Ketepatan pengisian kolom Measure ini akan memengaruhi keabsahan formula saat Anda melakukan pengujian hipotesis nanti.
Metode Statistik yang Sering Digunakan untuk Data Sekunder
Data sekunder memiliki karakteristik pemodelan yang sedikit berbeda dengan data primer hasil kuesioner. Anda tidak memerlukan uji validitas dan reliabilitas instrumen untuk data sekunder murni berbentuk angka nominal atau rasio.
Menurut dokumen akademis yang dirilis oleh id.scribd.com, metode statistik/penelitian yang dapat diterapkan pada data sekunder maupun primer antara lain: uji beda (data sekunder), uji regresi berganda (data sekunder dan data primer), serta pengujian normalisasi dan linieritas.
| Metode Statistik | Aplikasi Data Sekunder | Aplikasi Data Primer |
|---|---|---|
| Uji Beda (T-Test/Anova) | Ya | Ya |
| Uji Regresi Berganda | Ya | Ya |
| Pengujian Normalitas | Ya | Ya |
| Pengujian Linieritas | Ya | Ya |
| Uji Asumsi Klasik Lengkap | Ya | – |
Sebagai contoh nyata dalam riset kesehatan, Laporan SKI 2023 digunakan sebagai basis untuk menentukan variabel dependen dan independen dalam analisis data medis. Peneliti tidak perlu menguji ulang validitas isi laporan tersebut, melainkan langsung berfokus pada uji hubungan antarvariabel.
Melakukan Uji Regresi Berganda dan Asumsi Klasik
Jika data sekunder Anda bertujuan untuk melihat pengaruh beberapa variabel independen terhadap satu variabel dependen, maka analisis regresi linier berganda adalah pilihan utamanya. Namun, data sekunder wajib lolos uji asumsi klasik terlebih dahulu.
Uji asumsi klasik ini meliputi uji normalitas, multikolinieritas, heteroskedastisitas, dan autokorelasi. Berikut adalah cara mengeksekusinya di SPSS:
- Klik menu Analyze, pilih Regression, lalu klik Linear.
- Pindahkan variabel dependen ke kotak Dependent, dan variabel-variabel bebas ke kotak Independent(s).
- Klik tombol Statistics, centang opsi Collinearity diagnostics dan Durbin-Watson untuk uji multikolinieritas serta autokorelasi.
- Klik tombol Plots, masukkan ZPRED ke kolom X dan SRESID ke kolom Y untuk mendeteksi heteroskedastisitas lewat grafik scatterplot.
- Klik Continue, lalu klik OK untuk mengeluarkan lembar output.
Analisis data sekunder menuntut ketelitian tinggi pada keselarasan waktu pengumpulan data historis agar model regresi tidak mengalami bias akibat tren musiman.
Baca hasil output secara logis dengan melihat nilai signifikansi. Jika nilai p-value kurang dari 0,05, maka dapat disimpulkan terdapat pengaruh yang signifikan dari variabel sekunder yang Anda teliti.
Strategi Menghindari Kesalahan Olah Data Sekunder
Kesalahan fatal yang sering terjadi adalah ketidakselarasan satuan unit data, misalnya mencampur data dalam satuan jutaan rupiah dengan data berbentuk persentase tanpa melakukan penyesuaian skala terlebih dahulu.
Untuk mengatasi ketimpangan nilai yang terlalu jauh antarvariabel sekunder, Anda bisa mentransformasikan data tersebut ke dalam bentuk Logaritma Natural (LN) terlebih dahulu di SPSS melalui menu Compute Variable.
Transformasi data ke bentuk LN atau Standardized Score terbukti efektif memperbaiki sebaran data yang tidak normal, sehingga model penelitian Anda dapat memenuhi kriteria uji asumsi klasik tanpa harus membuang sampel penelitian yang berharga.






