0

Хиймэл оюуны технологийн хөгжлийн үр дүнд хүний дуу хоолойг хэдхэн секундын бичлэгээс хуулбарлан, тухайн хүний хоолойтой төстэй яриа үүсгэх боломжтой болжээ.
АНУ-ын хиймэл оюун ухаан, бүтээлч технологийн компани Pika наймдугаар сарын 18-нд “Pika Speech” нэртэй дуу хоолой үүсгэх загвараа танилцуулсан байна.
Тус компани уг технологи нь ердөө таван секундын дууны дээжээс хүний дуу хоолойг хуулбарлах боломжтой гэж мэдээлжээ. Хэрэглэгч өөрийн хүссэн бичвэрийг оруулахад Pika Speech тухайн дууны дээж дээр үндэслэн текстийг ижил төстэй хоолойгоор уншиж өгдөг байна.
Pika Speech нь 3 тэрбум параметртэй flow-matching transformer загварт суурилсан бөгөөд 48 кГц чанартай дуу үүсгэх боломжтой. Мөн нэг хүсэлтээр тав хүртэлх минутын яриа үүсгэх боломжтой бөгөөд ярианы өнгө аяс, хурд, үргэлжлэх хугацааг тохируулах боломжтой гэж Pika мэдээлжээ.
Компанийн мэдээлснээр уг технологийг ашиглан кино, видео, тоглоом, сурталчилгаа зэрэг контентод дуу оруулах, өөрийн дуу хоолойгоор текст уншуулах зэрэг олон төрлийн хэрэглээг хэрэгжүүлэх боломжтой.
Pika мөн Pika Speech-ийг багтаасан аудио загваруудын багцаа хөгжүүлж байгаа бөгөөд дуу хоолойноос гадна хөгжим, дууны эффект, видеоноос үүсгэх аудио зэрэг төрөл бүрийн хиймэл оюуны технологийг нэгтгэж байна.
Гэвч хүний дуу хоолойг богино бичлэгээс хуулбарлах боломж нэмэгдэхийн хэрээр зөвшөөрөлгүйгээр бусдын дуу хоолойг ашиглах, хуурамч дуудлага болон хуурамч аудио контент бүтээх эрсдэл мөн нэмэгдэж байна.
Иймээс voice cloning технологийг ашиглахдаа тухайн хүний зөвшөөрөл болон дуу хоолойн хуулбарыг ямар зорилгоор ашиглаж байгааг анхаарах шаардлагатай болж байна.
Хуваалцах:
Анхаар! Та сэтгэгдэл бичихдээ хууль зүйн болон ёс суртахууныг баримтална уу.
Одоогоор сэтгэгдэл бүртгэгдээгүй байна.