Otomatik Konuşmacı Tanıma
Automatic Speaker Recognition
Tanım
Bir konuşmacının ses özelliklerinin genellikle bilgisayar tabanlı yöntemlerle analiz edilerek kimliğinin tespit edilmesi süreci.
Örnek Vaka / Uygulama
Adli bir soruşturmada ele geçirilen anonim bir tehdit ses kaydının, şüphelilerin ses örnekleriyle karşılaştırılarak kimin ait olduğunun istatistiksel bir güven aralığıyla belirlenmesi.
Derin Analiz
Bilişsel bilimler, akustik fonetik ve hesaplamalı mühendisliğin kesişim kümesinde yer alan bu sistem, insan sesinin hem fizyolojik (vokal traktüsün anatomik yapısı) hem de davranışsal (aksan, vurgu, konuşma ritmi) özelliklerini işler. Sinyal işleme algoritmaları, ses dalgalarını frekans bileşenlerine (örneğin Mel-Frekans Kepstrum Katsayıları - MFCC) ayırarak matematiksel bir akustik model oluşturur. Bu model, kayıtlı veri tabanındaki profillerle karşılaştırılarak olasılıksal bir eşleşme sağlanır. Nörobiyolojik düzlemde ise bu süreç, beyindeki işitsel korteksin ve üst düzey örüntü tanıma ağlarının (özellikle temporal lob ve prefrontal entegrasyon) insan yapımı bir simülasyonudur.
Etimoloji
İngilizce 'automatic' (Yunanca 'automatos' [kendi kendine hareket eden]) + 'speaker' (Cermen kökenli 'speak' [konuşmak] fiilinden türetilen konuşan kişi) + 'recognition' (Latince 'recognoscere' [yeniden tanımak, hatırlamak]).
Karıştırmayın
Konuşma tanıma (speech recognition - kelimelerin veya içeriğin ne anlama geldiğini çözme) ile sıklıkla karıştırılır; otomatik konuşmacı tanıma ise içeriğe değil, konuşanın *kim* olduğuna odaklanır.