Ana içeriğe atla
Psikoloji Sözlüğüm LogoPsikoloji Sözlüğüm

Otomatik Konuşmacı Tanıma

Automatic Speaker Recognition

Tanım

Bir konuşmacının ses özelliklerinin genellikle bilgisayar tabanlı yöntemlerle analiz edilerek kimliğinin tespit edilmesi süreci.

Örnek Vaka / Uygulama

Adli bir soruşturmada ele geçirilen anonim bir tehdit ses kaydının, şüphelilerin ses örnekleriyle karşılaştırılarak kimin ait olduğunun istatistiksel bir güven aralığıyla belirlenmesi.

Derin Analiz

Bilişsel bilimler, akustik fonetik ve hesaplamalı mühendisliğin kesişim kümesinde yer alan bu sistem, insan sesinin hem fizyolojik (vokal traktüsün anatomik yapısı) hem de davranışsal (aksan, vurgu, konuşma ritmi) özelliklerini işler. Sinyal işleme algoritmaları, ses dalgalarını frekans bileşenlerine (örneğin Mel-Frekans Kepstrum Katsayıları - MFCC) ayırarak matematiksel bir akustik model oluşturur. Bu model, kayıtlı veri tabanındaki profillerle karşılaştırılarak olasılıksal bir eşleşme sağlanır. Nörobiyolojik düzlemde ise bu süreç, beyindeki işitsel korteksin ve üst düzey örüntü tanıma ağlarının (özellikle temporal lob ve prefrontal entegrasyon) insan yapımı bir simülasyonudur.

Etimoloji

İngilizce 'automatic' (Yunanca 'automatos' [kendi kendine hareket eden]) + 'speaker' (Cermen kökenli 'speak' [konuşmak] fiilinden türetilen konuşan kişi) + 'recognition' (Latince 'recognoscere' [yeniden tanımak, hatırlamak]).

Karıştırmayın

Konuşma tanıma (speech recognition - kelimelerin veya içeriğin ne anlama geldiğini çözme) ile sıklıkla karıştırılır; otomatik konuşmacı tanıma ise içeriğe değil, konuşanın *kim* olduğuna odaklanır.