Dergiler / İlköğretim Online (elektronik) / 2010 / Cilt: 9 - Sayı: 1

Klasik test ve madde tepki kuramlarına göre çoktan seçmeli testlerde farklı puanlama yöntemlerinin karşılaştırılması

A comparison of differential scoring methods for multiple choice tests in terms of classical test and item response theories

Sayfa
170–187
DOI
—

Özet

Bu çalışmada, çoktan seçmeli bir testte yer alan madde seçeneklerinin iki kategorili (1-0) puanlama, uzman yargısına dayalı seçenek ağırlıklandırma ve deneysel seçenek ağırlıklandırma yöntemleriyle puanlanması durumunda testin güvenirliğinin ve geçerliğinin Klasik Test Kuramı ve Madde Tepki Kuramı'na göre nasıl etkilendiğinin belirlenmesi amaçlanmıştır. Araştırma verisi çoktan seçmeli bir sözel yetenek testinin, Hacettepe ve Gazi Üniversitesi'nin çeşitli bölümlerinde okuyan toplam 1593 öğrenciye uygulanmasıyla elde edilmiştir. Araştırmanın bulguları, Madde Tepki Kuramı'nda "1-0" puanlamanın kullanıldığı durumda yetenek ölçeği üzerindeki parametrelerin ağırlıklı puanlamaların kullanıldığı duruma göre daha doğru kestirildiğini göstermiş, bu yöntemin test geçerliği açısından da daha etkili olduğu sonucuna ulaşılmıştır. Klasik Test Kuramı'nda ise deneysel ağırlıklandırmanın kullanıldığı durumda güvenirliğin daha yüksek kestirildiği, ancak tüm yöntemlerin test geçerliği açısından benzer etkiyi yaptığı belirlenmiştir.

Abstract

The purpose of this research is to determine the effects of binary (1-0) scoring, judgement-based (a priori) option weighting and empirical option weighting on the reliability and validity of a multiple-choice test regarding Classical Test and Item Response theories. Data were collected through the administration of a multiple-choice test of verbal ability to 1593 students attending several departments at Hacettepe and Gazi Universities. Research findings showed that regarding Item Response Theory, "1-0" scoring estimates the parameters within different intervals on the ability scale more precisely than weighted scoring and binary scoring is superior to weighted scoring in terms of validity. In case of Classical Test Theory, results indicated that empirical option weighting estimates the highest reliability and all scoring methods cause an identical effect on test validity.