ترجمه فارسی مقاله الگوریتم های یادگیری شاخص ویتل برای راهزنان بی قرار با اندازه های ثابت

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 37,500 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی
عنوان مقاله به انگلیسی Whittle Index Learning Algorithms for Restless Bandits with Constant Stepsizes
عنوان مقاله به فارسی الگوریتم های یادگیری شاخص ویتل برای راهزنان بی قرار با اندازه های ثابت
نویسندگان Vishesh Mittal, Rahul Meshram, Surya Prakash
فرمت مقاله انگلیسی PDF
تعداد صفحات 14
لینک دانلود رایگان مقاله انگلیسی دانلود مقاله
دسته بندی موضوعات Machine Learning,Systems and Control,Machine Learning,یادگیری ماشین , سیستم ها و کنترل , یادگیری ماشین ,
توضیحات Submitted 6 September, 2024; originally announced September 2024. , Comments: 14 pages
توضیحات به فارسی ارسال شده در 6 سپتامبر 2024 ؛در ابتدا سپتامبر 2024 اعلام شد ، نظرات: 14 صفحه
اطلاعات بیشتر از این مقاله در پایگاه های علمی INSPIRE HEP
NASA ADS
Google Scholar
Semantic Scholar

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

چکیده

We study the Whittle index learning algorithm for restless multi-armed bandits. We consider index learning algorithm with Q-learning. We first present Q-learning algorithm with exploration policies -- epsilon-greedy, softmax, epsilon-softmax with constant stepsizes. We extend the study of Q-learning to index learning for single-armed restless bandit. The algorithm of index learning is two-timescale variant of stochastic approximation, on slower timescale we update index learning scheme and on faster timescale we update Q-learning assuming fixed index value. In Q-learning updates are in asynchronous manner. We study constant stepsizes two timescale stochastic approximation algorithm. We provide analysis of two-timescale stochastic approximation for index learning with constant stepsizes. Further, we present study on index learning with deep Q-network (DQN) learning and linear function approximation with state-aggregation method. We describe the performance of our algorithms using numerical examples. We have shown that index learning with Q learning, DQN and function approximations learns the Whittle index.

چکیده به فارسی (ترجمه ماشینی)

ما الگوریتم یادگیری شاخص Wittle را برای راهزنان چند مسلحانه بی قرار مطالعه می کنیم.ما الگوریتم یادگیری شاخص را با Q-Learning در نظر می گیریم.ما برای اولین بار الگوریتم یادگیری Q را با سیاست های اکتشافی ارائه می دهیم-Epsilon-Greedy ، SoftMax ، Epsilon-Softmax با قدم های ثابت.ما مطالعه یادگیری Q را به یادگیری شاخص برای راهزن بی قرار تک مسلح گسترش می دهیم.الگوریتم یادگیری شاخص نوع دو زمانه از تقریب تصادفی است ، در بازه زمانی کندتر ما طرح یادگیری شاخص را به روز می کنیم و در بازه زمانی سریعتر با فرض ارزش شاخص ثابت ، Q-Learning را به روز می کنیم.به روزرسانی های یادگیری Q به روش ناهمزمان است.ما پله های ثابت دو الگوریتم تقریب تصادفی بازه زمانی را مطالعه می کنیم.ما تجزیه و تحلیل تقریب تصادفی دو زمانه را برای یادگیری شاخص با قدم های ثابت ارائه می دهیم.علاوه بر این ، ما مطالعه در مورد یادگیری شاخص با یادگیری عمیق q (DQN) یادگیری و عملکرد خطی با روش تجمع دولت را ارائه می دهیم.ما عملکرد الگوریتم های خود را با استفاده از نمونه های عددی شرح می دهیم.ما نشان داده ایم که یادگیری شاخص با یادگیری Q ، DQN و تقریبی عملکرد شاخص Whittle را می آموزد.

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.