Sound,Artificial Intelligence,Machine Learning,Audio and Speech Processing,صدا , هوش مصنوعی , یادگیری ماشین , پردازش صوتی و گفتار ,
توضیحات
Submitted 26 August, 2024; v1 submitted 22 August, 2024; originally announced August 2024. , Comments: Accepted at International Society for Music Information Retrieval (ISMIR) 2024
توضیحات به فارسی
ارسال شده در 26 اوت 2024 ؛V1 ارسال شده 22 اوت 2024 ؛در ابتدا اوت 2024 اعلام شد ، نظرات: پذیرفته شده در انجمن بین المللی بازیابی اطلاعات موسیقی (ISMIR) 2024
کتاب پرسش و پاسخ چهارگزینهای – نسخه یادگیری سریع
— پاسخها بلافاصله بعد از سؤال برای مرور سریع
مشاهده نمونه نسخه کوییز سریع
کتاب پرسش و پاسخ چهارگزینهای – نسخه خودآزمایی
— پاسخها در انتهای بخشها برای سنجش واقعی یادگیری
مشاهده نمونه نسخه آزمونی
🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتابها، تمرینها و خودآزمایی.
ℹ️ نکات مهم هنگام خرید
این محصول به صورت فایل دانلودی کامل ارائه میشود.
توجه: لینکهای اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال میشوند.
دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینکها را دریافت نکردهاید، نام و نام خانوادگی و نام محصول را پیامک کنید تا
لینکها دوباره ارسال شوند.
💬 راههای ارتباطی پشتیبانی: واتساپ یا هر پیام رسان داخلی یا پیامک:
09395106248 تلگرام: @ma_limbs
چکیده
Hindustani music is a performance-driven oral tradition that exhibits the rendition of rich melodic patterns. In this paper, we focus on generative modeling of singers' vocal melodies extracted from audio recordings, as the voice is musically prominent within the tradition. Prior generative work in Hindustani music models melodies as coarse discrete symbols which fails to capture the rich expressive melodic intricacies of singing. Thus, we propose to use a finely quantized pitch contour, as an intermediate representation for hierarchical audio modeling. We propose GaMaDHaNi, a modular two-level hierarchy, consisting of a generative model on pitch contours, and a pitch contour to audio synthesis model. We compare our approach to non-hierarchical audio models and hierarchical models that use a self-supervised intermediate representation, through a listening test and qualitative analysis. We also evaluate audio model's ability to faithfully represent the pitch contour input using Pearson correlation coefficient. By using pitch contours as an intermediate representation, we show that our model may be better equipped to listen and respond to musicians in a human-AI collaborative setting by highlighting two potential interaction use cases (1) primed generation, and (2) coarse pitch conditioning.
چکیده به فارسی (ترجمه ماشینی)
موسیقی هندوستان یک سنت شفاهی عملکردی است که نمایش الگوهای ملودیک غنی را به نمایش می گذارد.در این مقاله ، ما بر روی مدل سازی تولیدی ملودی های صوتی خوانندگان که از ضبط های صوتی استخراج شده اند ، تمرکز می کنیم ، زیرا صدا از نظر موسیقی در این سنت برجسته است.کار تولیدی قبلی در مدل های موسیقی هندوستان به عنوان نمادهای گسسته درشت که نتوانسته است پیچیدگی های ملودیک غنی آواز را ضبط کند.بنابراین ، ما پیشنهاد می کنیم از یک کانتور زمین ریز و ریز استفاده کنیم ، به عنوان یک نمایش میانی برای مدل سازی صوتی سلسله مراتبی.ما Gamadhani ، یک سلسله مراتب دو سطح مدولار ، متشکل از یک مدل تولیدی در کانتورهای زمین و یک کانتور زمین به مدل سنتز صوتی را پیشنهاد می کنیم.ما رویکرد خود را به مدلهای صوتی غیر سلسله مراتبی و مدلهای سلسله مراتبی که از یک بازنمایی متوسط خود تحت نظارت استفاده می کنند ، از طریق یک آزمون گوش دادن و تجزیه و تحلیل کیفی مقایسه می کنیم.ما همچنین توانایی مدل صوتی را در نمایندگی با وفاداری از ورودی کانتور زمین با استفاده از ضریب همبستگی پیرسون ارزیابی می کنیم.با استفاده از کانتورهای زمین به عنوان یک بازنمایی میانی ، ما نشان می دهیم که مدل ما ممکن است با برجسته کردن دو مورد استفاده از تعامل بالقوه (1) نسل اولیه و (2) زمین درشت ، مجهز به گوش دادن و پاسخ دادن به موسیقی دانان در یک محیط مشترک انسانی-IAT باشد.شرط بندی
📚 محتوای این محصول آموزشی (پکیج کامل)
علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیقتر و تسلط کامل بر مباحث مجموعهای از کتابهای آموزشی نیز ارائه میشود.
کتاب پرسش و پاسخ چهارگزینهای – نسخه یادگیری سریع
— پاسخها بلافاصله بعد از سؤال برای مرور سریع
مشاهده نمونه نسخه کوییز سریع
کتاب پرسش و پاسخ چهارگزینهای – نسخه خودآزمایی
— پاسخها در انتهای بخشها برای سنجش واقعی یادگیری
مشاهده نمونه نسخه آزمونی
🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتابها، تمرینها و خودآزمایی.
ℹ️ نکات مهم هنگام خرید
این محصول به صورت فایل دانلودی کامل ارائه میشود.
توجه: لینکهای اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال میشوند.
دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینکها را دریافت نکردهاید، نام و نام خانوادگی و نام محصول را پیامک کنید تا
لینکها دوباره ارسال شوند.
💬 راههای ارتباطی پشتیبانی: واتساپ یا هر پیام رسان داخلی یا پیامک:
09395106248 تلگرام: @ma_limbs