Yalancı Değişken
Dummy Variable
Tanım
Regresyon analizinde nitel (kategorik) özellikleri temsil etmek amacıyla 1 ve 0 değerleri atanan sayısal gösterge değişkenidir.
Örnek Vaka / Uygulama
Araştırmacılerin bireylerin maaşları üzerindeki eğitim düzeyinin etkisini incelediği bir regresyon modelinde, eğitim kategorileri 'Lise', 'Lisans' ve 'Lisansüstü' ise, $3 - 1 = 2$ adet yalancı değişken üretilir. Lisans referans kategorisi (0, 0) kabul edildiğinde, birinci yalancı değişken lise mezuniyetini (1, 0), ikinci yalancı değişken ise lisansüstü mezuniyetini (0, 1) temsil edecek şekilde modele eklenir.
Derin Analiz
Yalancı değişkenler (veya gösterge değişkenleri), istatistiksel modellemede cinsiyet, medeni durum veya tedavi grubu gibi kategorik ve sayısal olmayan verilerin matematiksel denklemlere dahil edilmesini sağlar. İkili (dichotomous) yapılarda varlığı '1', yokluğu '0' olarak kodlanır. Eğer kategorik değişken $k$ sayıda alt gruba sahipse, çoklu doğrusallık (multicollinearity) sorununu önlemek ve modelin matris tersini alınabilir kılmak için tam olarak $k - 1$ adet yalancı değişken oluşturulur. Bu mekanizma, referans kategorisinin sıfır matrisine atanmasıyla tüm kategorik varyansın katsayı tahminlerine doğru şekilde yansıtılmasına olanak tanır.
Etimoloji
İngilizce 'dummy' (sahte, kukla, model) ve Latince 'variare' (değiştirmek, çeşitlendirmek) köklerinden türetilmiş olup, istatistik modellerinde kategorik verileri nicelleştirmek için kullanılan vekil değişken anlamını taşır.
Karıştırmayın
Sürekli değişkenler (continuous variables) ile karıştırılır; temel fark, yalancı değişkenlerin matematiksel bir miktar belirtmeyip yalnızca kategori üyeliğini bildiren ikili (binary) kodlar olmasıdır.