Ses AI KILAVUZU

Ortalama Görüş Puanı Değerlendirmesi

Ortalama Görüş Puanı (MOS), ses seslerinin ne kadar iyi sentezlendiğini veya aktarıldığını ölçen, insan dinleyiciler tarafından verilen 1 ila 5 arasındaki ortalama derecelendirmedir.

2 min readSon güncelleme

Genel Bakış

It is the gold-standard yardstick for judging text-to-speech, voice cloning, and audio codecs, because ultimately humans, not machines, are the audience.

Derin Dalış

MOS, ITU tarafından standart hale getirilen telefon ağı testinden gelir (Tavsiye P.800). Dinleyiciler kısa ses kliplerini duyar ve her birini beş puanlık bir ölçekte derecelendirir: 5 = mükemmel, 4 = iyi, 3 = orta, 2 = zayıf, 1 = kötü. Birçok klip ve dinleyicide birçok derecelendirmenin ortalaması alınarak MOS elde edilir. Varyantlar belirli soruları hedefler: Genel kalite için MOS-LQS, A/B tercihi için karşılaştırma MOS (CMOS) ve ayrıntılı codec karşılaştırması için MUSHRA. Modern yapay zeka konuşma araştırmalarında MOS, WaveNet, Tacotron ve VALL-E gibi sistemler için temel ölçümdür. İnsan değerlendirmesi yavaş ve maliyetli olduğundan, tahmin edilen MOS modelleri (DNSMOS, UTMOS, NISQA) artık puanları otomatik olarak tahmin ediyor, ancak insan MOS'u güvenilir referans olmaya devam ediyor.

Teknik Bilgi

Uygun bir MOS çalışması dinleme koşullarını kontrol eder: kalibre edilmiş kulaklıklar, sabit ses yüksekliği, rastgele klip sırası ve örnek başına yeterli değerlendirici (genellikle 20+), böylece ortalama istatistiksel olarak kararlı olur. Araştırmacılar %95 güven aralığı rapor ediyor çünkü 0,1 MOS boşluğu gürültü olabilir. En önemlisi, MOS mutlak bir fiziksel ölçüm değildir; o oturumdaki belirli klipler ve talimatlarla sabitlendiğinden, farklı çalışmalardan elde edilen puanlar doğrudan karşılaştırılamaz.

Stratejik Etki

Access and reach

Transkripsiyon, anlatım ve ses arayüzleri aracılığıyla erişilebilirliği artırır.

Maliyet ve bütçe

Medya ekipleri daha küçük bütçelerle daha iyi ses kalitesi sunabilir.

Speed and scale

Müşteriyle yüz yüze olan sistemler, sözlü etkileşimleri daha büyük ölçekte işleyebilir.

Ortalama Görüş Puanı Değerlendirmesinin Geleceği

Otomatik MOS tahmincileri hızla gelişiyor ve insan tarafından derecelendirilen büyük derlemler üzerinde eğitiliyor; bu da ekiplerin son bir insan testinden önce binlerce örneği ucuz bir şekilde taramasına olanak tanıyor. Tek bir bulanık sayı yerine doğallığı, anlaşılırlığı, konuşmacı benzerliğini ve duyguyu ayıran daha zengin, çok boyutlu puanlar bekleyin. Üretken konuşma insan eşitliğine yaklaştıkça, ham MOS 4,5'e yaklaştığında ve artık üst sistemleri ayırt edemediğinden, değerlendirme tercih testlerine ve incelikli yapaylıkların tespit edilmesine doğru kayıyor.

Gerçek Dünya Uygulaması

Dinleyicilerden doğallığı 1-5 arasında derecelendirmeleri istenerek bir navigasyon uygulaması için iki metinden konuşmaya sesin karşılaştırılması

Dinleyici derecelendirmelerini kullanarak yeni bir sinirsel ses codec bileşenini aynı bit hızında MP3 ile karşılaştırma

Sesli kitap ürününe dağıtılmadan önce ses klonlama modelinin çıktı kalitesinin doğrulanması

Telekom mühendisleri, 4.0 MOS hedefini karşıladığını onaylamak için yeni VoIP ağı üzerinden çağrı kalitesini puanlıyor

Riskler ve Korkuluklar

Onay eksik olduğunda sesin kötüye kullanılması ve kimliğe bürünme riskleri artar.

Aksanlar, lehçeler veya gürültülü ortamlarda doğruluk düşebilir.

Sentetik ses, net bir etiketleme olmadan, orijinal konuşmayla karıştırılabilir.

Uygulama Yol Haritası

1

Sesin yakalanması, klonlanması ve yeniden kullanılması için açık izin alın.

2

Kaliteyi farklı hoparlörler ve arka plan koşullarında test edin.

3

Bir insanın çıktıları ne zaman incelemesi veya onaylaması gerektiğini tanımlayın.

4

Sentetik sesi etiketleyin ve sorumluluk için kaynak kayıtlarını saklayın.

Keşfetmeye Devam Edin

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Mean Opinion Score Evaluation quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Testi başlat

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Next guide

Yapay Zeka Değerlendirme Temelleri

Sık sorulan sorular

What is Mean Opinion Score Evaluation?

Ortalama Görüş Puanı (MOS), ses seslerinin ne kadar iyi sentezlendiğini veya aktarıldığını ölçen, insan dinleyiciler tarafından verilen 1 ila 5 arasındaki ortalama derecelendirmedir. Metin-konuşmayı, ses klonlamayı ve ses codec bileşenlerini değerlendirmek için altın standart ölçüttür, çünkü sonuçta izleyici makineler değil insanlardır.

Standart ölçekte 5 Ortalama Görüş Puanı neyi temsil eder?

Standart ITU beş puanlık mutlak kategori derecelendirme ölçeğinde 5 mükemmel, 1 ise kötü anlamına gelir.

MOS çalışmaları neden ses klibi başına birden fazla dinleyici kullanıyor?

Bireysel derecelendirmeler subjektif ve gürültülü olduğundan, birçok değerlendiricinin ortalamasını almak, raporlanabilir bir güven aralığına sahip, istatistiksel olarak istikrarlı bir puan sağlar.

Ses kalitesi için orijinal MOS metodolojisini hangi kuruluş standartlaştırdı?

Uluslararası Telekomünikasyon Birliği, P.800 Tavsiyesinde MOS testini, orijinal olarak telefon konuşma kalitesine yönelik olarak tanımlamıştır.

İki ayrı çalışmanın MOS değerlerini karşılaştırmanın temel sınırlaması nedir?

Derecelendirmeler belirli örneklere, bağlantılara ve dinleyici havuzuna bağlı olduğundan, farklı oturumlardaki mutlak MOS sayıları güvenilir bir şekilde karşılaştırılamaz.

DNSMOS veya UTMOS gibi otomatik MOS tahmincileri hangi sorunu çözüyor?

İnsan derecelendirmeleri üzerine eğitilmiş Tahmin Edilen MOS modelleri, puanları otomatik olarak tahmin ederek ekiplerin, nihai bir insan değerlendirmesinden önce birçok örneği ucuz bir şekilde taramasına olanak tanır.