Home » Genel » Meta, birden fazla konuşmacıyı ve dili ayırt edebilen Muse Voice Transcribe’ı tanıttı




Meta, birden fazla konuşmacıyı ve dili ayırt edebilen Muse Voice Transcribe’ı tanıttı

Meta, ilk gerçek zamanlı ses algılama modeli Muse Voice Transcribe‘ı kullanıma sundu. Meta Superintelligence Labs tarafından geliştirilen model; konuşmayı metne dönüştürme, farklı konuşmacıları ayırt etme ve bir kişinin konuşmasını ne zaman tamamladığını belirleme görevlerini tek bir sistem içinde gerçek zamanlı olarak gerçekleştiriyor.

Uzun ve kalabalık konuşmaları işleyebiliyor

Muse Voice Transcribe’ın öne çıkan özelliklerinden biri, uzun ve kalabalık konuşmaları işleyebilmesi. Model, bir saati aşan ses kayıtlarını ve 20’den fazla konuşmacının yer aldığı görüşmeleri ek bir işlem aşamasına ihtiyaç duymadan metne dönüştürebiliyor. Konuşmacı günlüğü oluşturma olarak da bilinen “speaker diarization” özelliği sayesinde sistem, konuşmanın hangi bölümünün kim tarafından söylendiğini belirleyerek metni konuşmacılara detaylı ⇒

Alıntının kaynağı: Webrazzi

Bir cevap yazın

E-posta hesabınız yayımlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir

*