Nvidia ovozlarni farqlovchi yangi bepul sun'iy intellekt modelini taqdim etdi
Nvidia kompaniyasi suhbatdoshlarni real vaqtda aniqlashga qodir bo'lgan Nemotron 3 Diarization modelini chiqardi.

Nvidia o'zining yangi Nemotron 3 Diarization deb nomlangan sun'iy intellekt modelini ochiq holda taqdim etdi. Taxminan 100 million parametrga ega bu model suhbat davomida kim gapirayotganini aniqlab berish imkoniyatiga ega.
Mazkur tizim sakkiz nafargacha suhbatdoshni bir vaqtning o'zida farqlay oladi hamda bir nechta odam bir paytda gapirganda ham ularni ajratib ko'rsatadi. Biroq kuchli shovqin yoki ishtirokchilar sonining ko'pligi xatoliklar ko'rsatkichini oshirishi mumkin.
Model yozuvlar bilan ham, jonli ovoz bilan ham ishlay oladi hamda uni Parakeet kabi nutqni tanish tizimlari bilan birlashtirish mumkin. VoiceArena platformasidagi sinovlarda model 14,72 foizlik xatolik ko'rsatkichi bilan hozircha birinchi o'rinni egallab turibdi.
Asosiy faktlar
- Nemotron 3 Diarization modeli taxminan 100 million parametrga ega.
- Tizim bir vaqtning o'zida sakkiz nafargacha so'zlovchini farqlay oladi.
- Model VoiceArena reytingida 14,72 foizlik xatolik ko'rsatkichi bilan birinchi o'rinni egalladi.
- Yangi model avvalgi Streaming Sortformer tizimiga nisbatan xatoliklarni o'rtacha 41 foizga qisqartirdi.
Nega muhim?
Ovozli ma'lumotlarni tahlil qilish va transkripsiya qilish sifatini oshiradigan bunday bepul vositalar sun'iy intellekt texnologiyalaridan foydalanish imkoniyatlarini kengaytiradi. Bu esa o'z navbatida nutqni matnga aylantirish va ovozli yordamchilarni rivojlantirishda muhim ahamiyat kasb etadi.
Manba
The Decoder (the-decoder.com)
“Nvidia drops a free 100M-parameter model that identifies up to eight speakers in real time”
Asl maqolani o'qish →Ushbu matn asl maqolaning qisqa mazmuni bo'lib, sun'iy intellekt yordamida o'zbek tilida tayyorlandi. Batafsil ma'lumot va to'liq matn uchun asl manbaga murojaat qiling.


