E
Enhar Ormeci
Misafir
Misafir
Bir toplantıda, röportajda veya podcast’te belirli bir bölümü bulmak için kaydın tamamını dinlemek gerekebilir. “Kim, ne söyledi?” sorusunun yanıtı kayıtta olsa da ona ulaşmak zaman alır. Bulut tabanlı servisler bu işi kolaylaştırır; ancak bunun için ses kaydını başka bir sunucuya yüklemeniz gerekir.
Speech Studio, bu işlemleri NVIDIA Jetson Orin Nano Developer Kit üzerinde, yerel olarak yapan açık kaynaklı bir araç. Ses kaydını yazıya döküyor, konuşmacıları ayırıyor, içeriği özetliyor ve kayıt hakkında sorularınızı yanıtlıyor. Ses dosyası bütün bu işlemler boyunca cihazda kalıyor.
Uygulamanın merkezinde, NVIDIA’nın konuşmacı ayrımı modeli
Bu bağlantıyı görüntüleyebilmek için kayıt olmalı zaten üyeyseniz üye girişi yapmalısınız.
var. “Kim, ne zaman konuştu?” sorusunu yanıtlayan bu model, aşağıda ayrı bir bölümde anlatılıyor.Projenin kaynak kodu GitHub’da:
Bu bağlantıyı görüntüleyebilmek için kayıt olmalı zaten üyeyseniz üye girişi yapmalısınız.
Bu yazıdaki ölçümler ve ekran görüntüleri, 8 GB belleğe sahip bir NVIDIA Jetson Orin Nano Developer Kit üzerinde alındı.
TAVSİYE EDİLEN ÜRÜNLER
Bu bağlantıyı görüntüleyebilmek için kayıt olmalı zaten üyeyseniz üye girişi yapmalısınız.
❮
Bu bağlantıyı görüntüleyebilmek için kayıt olmalı zaten üyeyseniz üye girişi yapmalısınız.
❯
Bu bağlantıyı görüntüleyebilmek için kayıt olmalı zaten üyeyseniz üye girişi yapmalısınız.