ترجمه فارسی مقاله آموزش تقویتی چند هدفه دستور واژگانی آستانه دار

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 37,500 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی
عنوان مقاله به انگلیسی Thresholded Lexicographic Ordered Multiobjective Reinforcement Learning
عنوان مقاله به فارسی آموزش تقویتی چند هدفه دستور واژگانی آستانه دار
نویسندگان Alperen Tercan, Vinayak S. Prabhu
فرمت مقاله انگلیسی PDF
تعداد صفحات 29
لینک دانلود رایگان مقاله انگلیسی دانلود مقاله
دسته بندی موضوعات Machine Learning,Artificial Intelligence,یادگیری ماشین , هوش مصنوعی ,
توضیحات Submitted 3 September, 2024; v1 submitted 24 August, 2024; originally announced August 2024. , Comments: Full version of ECAI 2024 paper
توضیحات به فارسی ارسال شده در 3 سپتامبر 2024 ؛V1 ارسال شده 24 اوت 2024 ؛در ابتدا اوت 2024 اعلام شد ، نظرات: نسخه کامل مقاله ECAI 2024
اطلاعات بیشتر از این مقاله در پایگاه های علمی INSPIRE HEP
NASA ADS
Google Scholar
Semantic Scholar

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

چکیده

Lexicographic multi-objective problems, which impose a lexicographic importance order over the objectives, arise in many real-life scenarios. Existing Reinforcement Learning work directly addressing lexicographic tasks has been scarce. The few proposed approaches were all noted to be heuristics without theoretical guarantees as the Bellman equation is not applicable to them. Additionally, the practical applicability of these prior approaches also suffers from various issues such as not being able to reach the goal state. While some of these issues have been known before, in this work we investigate further shortcomings, and propose fixes for improving practical performance in many cases. We also present a policy optimization approach using our Lexicographic Projection Optimization (LPO) algorithm that has the potential to address these theoretical and practical concerns. Finally, we demonstrate our proposed algorithms on benchmark problems.

چکیده به فارسی (ترجمه ماشینی)

مشکلات چند عیار واژگونی واژگونی ، که نظم اهمیت واژگونی را بر روی اهداف تحمیل می کند ، در بسیاری از سناریوهای زندگی واقعی بوجود می آید.کار یادگیری تقویت کننده موجود به طور مستقیم به وظایف واژگونی پرداختن شده است ، کمیاب بوده است.معدود رویکردهای پیشنهادی ، بدون ضمانت نظری ، اکتشافی بودند زیرا معادله بلمن برای آنها کاربرد ندارد.علاوه بر این ، کاربرد عملی این رویکردهای قبلی نیز از موضوعات مختلفی مانند عدم دستیابی به وضعیت هدف رنج می برد.در حالی که برخی از این موضوعات قبلاً شناخته شده بود ، در این کار ما کاستی های بعدی را بررسی می کنیم و در بسیاری از موارد اصلاحات را برای بهبود عملکرد عملی پیشنهاد می کنیم.ما همچنین یک رویکرد بهینه سازی سیاست را با استفاده از الگوریتم بهینه سازی طرح ریزی واژگونی ما (LPO) ارائه می دهیم که پتانسیل رسیدگی به این نگرانی های نظری و عملی را دارد.سرانجام ، ما الگوریتم های پیشنهادی خود را در مورد مشکلات معیار نشان می دهیم.

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.