څنګه شیپ د مصنوعي ذهانت د وینا مراجعینو لپاره د غږ د کلون کولو د کیفیت ارزونې پروګرام وړاندې کړ
د ډیمو کیفیت څخه تر پلي کولو پورې - څنګه د انسان جوړښتي ارزونې د AI وینا مراجعینو سره مرسته وکړه چې د لابراتوار میټریکونو او حقیقي نړۍ فعالیت ترمنځ واټن کم کړي.
د پروژې کتنه
د غږ کلونینګ ماډلونه په ډیمو کې اغیزمن غږیدلی شي مګر بیا هم په ریښتینې نړۍ کې کارونې کې مبارزه کوي. مراجعینو ته د دې اندازه کولو لپاره د باور وړ لارې ته اړتیا وه چې ایا د دوی ماډل په حقیقت کې ښه کیږي - په ځانګړي توګه د هندي انګلیسي لپاره، کوم چې د لومړیتوب پلي کولو بازار و.
شایپ د بشري ارزونې پروګرام ډیزاین او اداره کولو لپاره راوړل شوی و چې کولی شي د سوداګرۍ درې کلیدي پوښتنو ته ځواب ووایی:
- آیا خبرې طبیعي ښکاري؟
- ایا دا لا هم د اصلي ویناوال په څیر غږ کوي؟
- ایا دا د تولید کارولو لپاره کافي خوندي او د باور وړ دی؟
د دې پر ځای چې یوازې په اتوماتیک میټریکونو تکیه وکړي، پروژې روزل شوي انساني بیاکتونکي وکارول ترڅو د اصلي آډیو محصولاتو ارزونه وکړي او وپیژني چې ماډل لاهم چیرته پاتې راغلی.
د کلیدي ډیټاسیټ میټریکونه
د قضیې کارول
د غږ کلونینګ کیفیت ارزونه
د پروژې موده
12 اونۍ
نمونې بیاکتل شوې
۱۲،۴۰۰ ترکیب شوي آډیو کلیپونه
تشریح کونکي ځای پر ځای شوي
۴۸ روزل شوي انګلیسي ارزوونکي
د TTS او غږ کلونینګ کیفیت ارزولو کې ننګونې
- ماډل ته اړتیا وه چې په ټولو برخو کې ښه کار وکړي څو انګلیسي تلفظونهپه ځانګړې توګه هندي انګلیسي.
- د غږ کیفیت باید په داسې لارو ښه شي چې د کاروونکو لپاره مهم وي، نه یوازې په لابراتوار میټریکونو کې.
- ټیم د پیژندلو لپاره یوې روښانه لارې ته اړتیا درلوده د وینا په پایله کې څه غلط وو؟.
- اوږدې غږیزې کلیپونه کله ناکله د وخت په تیریدو سره د اصلي ویناوال هویت له لاسه ورکوي.
- مراجعینو ته د دې لپاره هم چکونو ته اړتیا وه خوندیتوب، د تقلید خطر، او د واټر مارک شتون.
حل: د مصنوعي ذهانت غږ کیفیت لپاره د بشري ارزونې چوکاټ
د ارزونې ستراتیژي
شایپ د طبیعي والي، وضاحت، غږ ورته والي، ثبات او خوندیتوب ارزولو لپاره د بیاکتنې یو منظم چوکاټ جوړ کړ.
په پیمانه کې د انسان بیاکتنه
۴۸ روزل شوي ارزونکو د هندي انګلیسي، بې طرفه امریکایي انګلیسي، او د هنګلش فرعي ټریک په اوږدو کې ۱۲،۴۰۰ آډیو نمونې بیاکتنه وکړه.
درې برخې ارزونه
- کتونکو دا درجه بندي کړه چې هر کلیپ څومره طبیعي او د پوهیدو وړ و.
- دوی د کلپونو جوړې پرتله کړې ترڅو معلومه کړي چې کومه نسخه غوره وه.
- دوی د کیفیت تکراري مسلې لکه غیر طبیعي تال، د غږ ستونزې، او د سپیکر ډرافټ په نښه کړې.
د کيفيت د کنټرول
شایپ د نمرې ورکولو د دوام او د باور وړ ساتلو لپاره د کیلیبریشن دندو، د سرو زرو معیاري چکونو، تکراري بیاکتنو، او د کیفیت ډاډ څارنې څخه کار واخیست.
د عمل وړ فیډبیک لوپ
د هر سپرنټ موندنې د مراجعینو د ټونینګ پروسې ته بیرته ورکړل شوې، چې ماډل سره یې په څو پړاوونو کې ښه والی کې مرسته وکړه.
د پروژې ساحه: ژبې، تلفظونه او د بیاکتنې پوښښ
| په سيمه کې | حدود |
|---|---|
| ژبه | انګلیسي |
| د لومړیتوب نښې | هندي انګلیسي، بې طرفه امریکایی انګلیسي |
| دوهم پوښښ | برتانوي انګلیسي، هنګلش فرعي ټریک |
| د نمونې ډولونه | لنډې حوالې کلیپونه، څو لنډې نمونې، اوږده وینا |
| د بیاکتنې پایله | د کیفیت درجه بندي، د غوره توب لیبلونه، د مسلې نښه کول |
| د کوژدنې موده | 12 اونیو |
پایلې: د غږ کلونینګ کې د اندازه کولو وړ پرمختګونه
- د غږ کیفیت کې څرګند ښه والی: د ماډل د کیفیت عمومي نمره له ۳.۴۱ څخه ۴.۱۲ ته لوړه شوه، چې دا ښیي چې وینا ډیره طبیعي او د تولید لپاره چمتو شوې ده.
- د سپیکرو غوره مطابقت: سیسټم د اصلي ویناوال غږ ساتلو کې خورا ښه شو، ورته والی یې له 0.71 څخه 0.87 ته لوړ کړ.
- لږ د پام وړ غلطۍ: د وینا مسلې د لومړني پړاو په جریان کې د نمونو له ۳۱٪ څخه د وروستي پړاو په جریان کې ۱۱٪ ته راټیټې شوې.
- قوي پوهاوی: د هندي انګلیسي ژبې لپاره د وروستۍ کلمې د تېروتنې کچه ۴.۸٪ ته ورسېده، چې د هدف حد یې مات کړ.
- د ځای پر ځای کولو لپاره خوندي چمتووالی: ارزونې د مهمو خوندیتوب چکونو په اړه هم قوي فعالیت تایید کړ، په شمول د تقلید خطر سکرینینګ او د واټر مارک تصدیق.
شایپ موږ سره مرسته وکړه چې د موضوعي غږ کیفیت د اندازه کولو وړ ښه والي پروګرام ته واړوو. د دوی د ارزونې چوکاټ موږ ته روښانه سیګنالونه راکړل چې څه باید اصلاح شي، چیرته ښه شي، او څنګه په ډاډ سره تولید ته نږدې شو.
— د مصنوعي ذهانت د وینا محصول مشر