anketkatilimci.com

SPSS'e veri girişi ve veri temizleme

5 dk okumaanketkatilimci.com Ekibi

Değişken adları, etiketler, ters kodlama, aykırı değerler ve kalite kontrolü. Analiz öncesi yapılması gereken her şey.

Veri temizleme, ham anket verisini analize hazır hâle getirme sürecidir. Analizin kalitesi doğrudan bu adıma bağlıdır: kirli veriyle yapılan en doğru test bile yanlış sonuç verir.

Bu yazı, Google Forms ya da Excel'den gelen bir anket verisini SPSS'te analize hazırlamanın sırasını anlatıyor.

Adım 0 — Yedek alın

Ham veri dosyasının bir kopyasını saklayın ve ona hiç dokunmayın. Bütün düzenlemeleri çalışma kopyasında yapın.

Gerekçesi: yaptığınız bir dönüştürmenin yanlış olduğunu üç hafta sonra fark edebilirsiniz. Ham veri elinizde değilse baştan başlarsınız.

Adım 1 — Excel dosyasını hazırlayın

SPSS'e almadan önce e-tabloda:

  • İlk satır değişken adları olsun, başka hiçbir şey olmasın. Başlıkların üstündeki boş satırları ve açıklama satırlarını silin.
  • Değişken adlarını kısaltın. SPSS uzun adları sevmez. bag1, bag2, doy1 gibi kısa ve tutarlı adlar kullanın; Türkçe karakter ve boşluk kullanmayın.
  • Kod defteri oluşturun. Ayrı bir sayfada hangi kodun hangi soruya karşılık geldiğini yazın. Bu belge, altı ay sonra tezinizi yazarken en çok işinize yarayacak dosyadır.
  • Likert etiketlerini sayıya çevirin. Forms metin yazar ("Kesinlikle katılıyorum"); SPSS sayı ister. Bul-değiştir ile dönüştürün.
  • Test yanıtlarınızı silin. Kendi denemeleriniz veri setinde kalmasın.

SPSS'te açmak için: File → Open → Data, dosya türü olarak Excel seçin, "Read variable names from first row" işaretli olsun.

Adım 2 — Değişkenleri tanımlayın

Variable View sekmesine geçin ve her değişken için şunları ayarlayın:

  • Name: Kısa değişken adı
  • Type: Sayısal veriler için Numeric, açık uçlu yanıtlar için String
  • Decimals: Tam sayılarda 0 — gereksiz ondalıklar çıktıları kirletir
  • Label: Sorunun açık hâli. Çıktılarda bu görünür; boş bırakırsanız tablolarınız q7 yazar ve okunmaz olur
  • Values: Kategorik değişkenlerde kod-etiket eşleşmesi (1 = Kadın, 2 = Erkek)
  • Missing: Kayıp değer kodunuz (örneğin 99). Bu adım atlanırsa SPSS 99'u geçerli bir yanıt sanar ve ortalamayı çarpıtır
  • Measure: Scale (sürekli), Ordinal (sıralı), Nominal (kategorik)

Measure alanı önemlidir: SPSS bazı prosedürlerde bu bilgiye göre davranır ve grafik önerilerini buna göre yapar.

Bu adım sıkıcıdır ama bir kez yapıldığında bütün çıktılarınız okunabilir hâle gelir.

Adım 3 — İlk kontrol: frekans tabloları

Analyze → Descriptive Statistics → Frequencies ile bütün değişkenlerin frekans tablosunu alın.

Aradığınız şeyler:

  • Olmayan kodlar: 5'li Likert'te 7 değeri görüyorsanız veri girişi hatası vardır
  • Beklenmeyen değerler: Yaş sütununda 350, kıdem sütununda −2
  • Aşırı yoğunlaşma: Bir seçenek %95 işaretlenmişse o değişken ayrım yapmıyor demektir
  • Boş kategoriler: Hiç kimsenin işaretlemediği seçenekler

Bu tek adım, veri girişi hatalarının çoğunu yakalar.

Adım 4 — Aykırı değerleri inceleyin

Analyze → Descriptive Statistics → Explore ile kutu grafiği ve uç değer listesi alın.

Aykırı değer bulduğunuzda sırayla sorun:

  1. Veri girişi hatası mı? (yaş 350) → Düzeltin ya da kayıp yapın.
  2. Gerçek ama uç bir değer mi? (45 yıllık kıdem) → Genellikle veride kalır.
  3. Özensiz doldurma mı? → Aşağıdaki kalite kontrolüne bakın.

Aykırı değer sildiğinizde kaç gözlem ve hangi ölçütle sildiğinizi mutlaka raporlayın. Ölçütü analiz sonuçlarına bakarak belirlemek yöntem etiğine aykırıdır.

Adım 5 — Kalite kontrolü

Çevrim içi anketlerde özensiz doldurma yaygındır. İki işaret arayın:

Düz-çizgi yanıtlama (straight-lining): Katılımcı bütün maddelere aynı değeri vermiş. Ölçek maddelerinin standart sapmasını hesaplayın; 0 ya da 0'a çok yakınsa şüphelenin.

SPSS'te: Transform → Compute Variable ile SD(bag1, bag2, ..., bag18) hesaplayın, sonra bu değişkenin frekansına bakın.

Ters madde içeren ölçeklerde düz-çizgi yanıt zaten mantıksal çelişki üretir; bu, ters maddelerin ikinci faydasıdır.

Çok hızlı doldurma: Zaman damgası varsa süreyi hesaplayın. Ortalama sürenin belirgin biçimde altında kalan formlar (örneğin üçte birinden kısa) okunmadan doldurulmuş olabilir.

Bu ölçütlerle form eleyecekseniz eşiği baştan belirleyin ve yöntem bölümünde yazın.

Adım 6 — Ters maddeleri kodlayın

Bu adımı atlamak, tez analizlerinde en sık yapılan hatadır. Sonucu: Cronbach alfa çöker, hatta negatif çıkar.

SPSS'te: Transform → Recode into Different Variables

5'li ölçek için dönüşüm: 1→5, 2→4, 3→3, 4→2, 5→1

Yeni değişkene farklı bir ad verin (bag7R gibi). Aynı değişkenin üzerine yazarsanız iki kez çalıştırdığınızda veriyi bozarsınız ve fark etmezsiniz.

Kodlamadan sonra kontrol edin: ters kodlanmış maddenin diğer maddelerle korelasyonu artık pozitif olmalıdır.

Adım 7 — Toplam ve ortalama puanları hesaplayın

Transform → Compute Variable

  • Ortalama: MEAN(bag1, bag2, bag3R, ..., bag18)
  • Toplam: SUM(...)

Ortalamayı tercih edin. Ortalama puan ölçeğin kendi aralığında kalır (1-5), bu da yorumlamayı kolaylaştırır. Toplam puan ise madde sayısına bağlıdır ve ölçekler arası karşılaştırmayı zorlaştırır.

MEAN fonksiyonu kayıp değerleri otomatik atlar. Katılımcının en az belirli sayıda maddeyi doldurmuş olmasını şart koşmak isterseniz MEAN.14(...) biçimini kullanın — bu, en az 14 maddenin dolu olmasını gerektirir.

Alt boyutu olan ölçeklerde önce alt boyut puanlarını, sonra genel puanı hesaplayın.

Adım 8 — Kayıp verileri ele alın

Kayıp oranını hem katılımcı hem değişken bazında kontrol edin, sonra yöntem seçin. Ayrıntısı kayıp veri yazımızda.

Adım 9 — Son kontrol

Analize geçmeden önce:

  • [ ] Bütün değişkenlerin Label'ı yazılı mı?
  • [ ] Kayıp değer kodları tanımlı mı?
  • [ ] Ters maddeler kodlandı mı ve kontrol edildi mi?
  • [ ] Ölçek puanları hesaplandı mı?
  • [ ] N kaç? (Elenen formlar sonrası sayıyı not edin)
  • [ ] Betimsel istatistikler makul mü? (5'li ölçekte ortalama 3,2 mantıklı; 12,4 değil)
  • [ ] Ham veri dosyası ayrı bir yerde duruyor mu?

Syntax kullanın

SPSS'te her işlemin sonunda Paste düğmesine basarsanız yaptığınız işlem komut olarak Syntax penceresine yazılır.

Bunu alışkanlık hâline getirin. Faydaları:

  • Veriyi baştan almanız gerekirse bütün temizliği tek tıkla tekrarlarsınız
  • Ne yaptığınızın kaydı kalır; üç ay sonra "bu değişkeni nasıl hesaplamıştım" sorusuna yanıt bulursunuz
  • Jüri sorduğunda gösterilecek bir belgeniz olur
  • Hatayı bulmak kolaylaşır

Syntax dosyasını tez klasörünüzde saklayın.

Sık sorulan sorular

Excel'de mi temizlemeliyim SPSS'te mi? Değişken adı düzenleme ve etiket-sayı dönüşümü Excel'de daha hızlıdır. Ters kodlama, puan hesaplama ve kayıp değer işlemlerini SPSS'te syntax ile yapın — böylece kaydı kalır.

Kaç formu eleyebilirim? Belirlediğiniz ölçütü karşılamayan tüm formları. Ölçütü baştan belirleyin ve raporlayın.

SPSS yerine jamovi ya da JASP kullanabilir miyim? Evet. Ücretsizdirler, aynı analizleri yaparlar ve APA biçiminde tablo üretmeleri SPSS'ten kolaydır. Çıktının hangi programdan geldiği, doğru raporlandığı sürece sorun yaratmaz.


Veri temizliği, analiz ve APA tabloları için veri analizi hizmetimize bakabilirsiniz. Temizlenmiş veri seti ve syntax dosyasını da teslim ediyoruz.

Bunlar da ilginizi çekebilir