Konuşma Parçası Etiketleme (POS)

Konuşma Parçası Etiketleme (POS)


Konuşma parçası etiketleme, bir cümledeki her kelimeye dilbilgisel rolünü atayan NLP görevidir. İsim, fiil, sıfat, zarf, zamir ve edat gibi etiketler kelimenin yanına yazılıyor. Görev basit görünse de bağlam gerektiriyor, çünkü aynı kelime cümleye göre farklı rol üstleniyor.

Türkçede işi zorlaştıran şey ekler. "Yüz" kelimesi tek başına isim de olabiliyor fiil de. "Kitapları" biçimi hem çoğul hem belirtme durumu taşıyabiliyor. Bu yüzden Türkçe etiketleyiciler önce kelimeyi biçimbirimlere ayırıyor, sonra bağlama bakarak doğru çözümlemeyi seçiyor. İngilizcede aynı sorun daha çok kelime sırasıyla çözülüyor.

Etiketler tek başına ürün olmuyor, başka işlerin girdisi oluyor. Bağlılık ayrıştırması, adlandırılmış varlık tanıma, arama sorgularının niyet analizi ve konuşma sentezinde vurgu yerleştirme bu bilgiyi kullanıyor.

Somut bir örnek: bir arama motoruna "kapak boya" yazıldığında sistem ilk kelimenin isim mi sıfat mı olduğunu bilmeden sorguyu doğru okuyamıyor. Etiketleme kapağın nesne, boyanın ürün kategorisi olduğunu ayırt ettiğinde sonuç kümesi değişiyor.

Günümüz dil modelleri bu etiketlemeyi ayrı bir adım olarak yapmıyor. Yine de klasik NLP boru hatlarında ve dilbilim çalışmalarında etiketli veri hâlâ kullanılıyor, çünkü çıktı denetlenebilir ve açıklanabilir kalıyor.

Özel yapay zekâ modellerinden kurumsal danışmanlık ve arama deneyimlerine kadar projenize güç katın.
Yapay zekâ ekibimizle tanışın