ترجمه فارسی مقاله FastVoiceGrad: تبدیل صدای مبتنی بر انتشار یک مرحله‌ای با تقطیر انتشار شرطی مخالف

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 37,500 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی
عنوان مقاله به انگلیسی FastVoiceGrad: One-step Diffusion-Based Voice Conversion with Adversarial Conditional Diffusion Distillation
عنوان مقاله به فارسی FastVoiceGrad: تبدیل صدای مبتنی بر انتشار یک مرحله‌ای با تقطیر انتشار شرطی مخالف
نویسندگان Takuhiro Kaneko, Hirokazu Kameoka, Kou Tanaka, Yuto Kondo
فرمت مقاله انگلیسی PDF
تعداد صفحات 5
لینک دانلود رایگان مقاله انگلیسی دانلود مقاله
دسته بندی موضوعات Sound,Artificial Intelligence,Machine Learning,Audio and Speech Processing,Machine Learning,صدا , هوش مصنوعی , یادگیری ماشین , پردازش صوتی و گفتار , یادگیری ماشین
توضیحات Submitted 3 September, 2024; originally announced September 2024. , Comments: Accepted to Interspeech 2024. Project page: https://www.kecl.ntt.co.jp/people/kaneko.takuhiro/projects/fastvoicegrad/
توضیحات به فارسی ارسال شده در 3 سپتامبر 2024 ؛در ابتدا در سپتامبر 2024 اعلام شد. ، نظرات: پذیرفته شده در interspeech 2024. صفحه پروژه: https://www.kecl.ntt.co.jp/people/kaneko.takuhiro/projects/fastvoicegrad/
اطلاعات بیشتر از این مقاله در پایگاه های علمی INSPIRE HEP
NASA ADS
Google Scholar
Semantic Scholar

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

چکیده

Diffusion-based voice conversion (VC) techniques such as VoiceGrad have attracted interest because of their high VC performance in terms of speech quality and speaker similarity. However, a notable limitation is the slow inference caused by the multi-step reverse diffusion. Therefore, we propose FastVoiceGrad, a novel one-step diffusion-based VC that reduces the number of iterations from dozens to one while inheriting the high VC performance of the multi-step diffusion-based VC. We obtain the model using adversarial conditional diffusion distillation (ACDD), leveraging the ability of generative adversarial networks and diffusion models while reconsidering the initial states in sampling. Evaluations of one-shot any-to-any VC demonstrate that FastVoiceGrad achieves VC performance superior to or comparable to that of previous multi-step diffusion-based VC while enhancing the inference speed. Audio samples are available at https://www.kecl.ntt.co.jp/people/kaneko.takuhiro/projects/fastvoicegrad/.

چکیده به فارسی (ترجمه ماشینی)

تکنیک های تبدیل صوتی مبتنی بر انتشار (VC) مانند VoiceGrad به دلیل عملکرد بالای VC از نظر کیفیت گفتار و شباهت بلندگو مورد توجه قرار گرفته است.با این حال ، یک محدودیت قابل توجه ، استنباط آهسته ناشی از انتشار معکوس چند مرحله ای است.بنابراین ، ما FastVoiceGrad را پیشنهاد می کنیم ، یک VC مبتنی بر انتشار یک مرحله ای که باعث کاهش تعداد تکرارها از ده ها به یک می شود در حالی که به ارث می برید عملکرد VC بالای VC مبتنی بر انتشار چند مرحله ای.ما مدل را با استفاده از تقطیر انتشار شرطی متناوب (ACDD) بدست می آوریم ، و در حالی که مجدداً حالت های اولیه را در نمونه برداری می کنند ، توانایی شبکه های مخالف مولد و مدل های انتشار را اعمال می کنیم.ارزیابی های یک شات هر یک از VC نشان می دهد که FastVoicegrad به عملکرد VC برتر از یا قابل مقایسه با VC مبتنی بر انتشار چند مرحله ای قبلی در حالی که سرعت استنتاج را افزایش می دهد ، دست می یابد.نمونه های صوتی در https://www.kecl.ntt.co.jp/people/kaneko.takuhiro/projects/fastvoicegrad/ موجود است.

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.