ترجمه فارسی مقاله مقدمه ای بر آموزش متمرکز برای اجرای غیرمتمرکز در یادگیری تقویتی چند عاملی تعاونی

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 37,500 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی
عنوان مقاله به انگلیسی An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning
عنوان مقاله به فارسی مقدمه ای بر آموزش متمرکز برای اجرای غیرمتمرکز در یادگیری تقویتی چند عاملی تعاونی
نویسندگان Christopher Amato
فرمت مقاله انگلیسی PDF
تعداد صفحات 32
لینک دانلود رایگان مقاله انگلیسی دانلود مقاله
دسته بندی موضوعات Machine Learning,Multiagent Systems,یادگیری ماشین , سیستم های چند منظوره ,
توضیحات Submitted 4 September, 2024; originally announced September 2024. , Comments: arXiv admin note: text overlap with arXiv:2405.06161
توضیحات به فارسی ارسال شده در 4 سپتامبر 2024 ؛در ابتدا سپتامبر 2024 اعلام شد. ، نظرات: Arxiv Admin توجه: همپوشانی متن با ARXIV: 2405.06161
اطلاعات بیشتر از این مقاله در پایگاه های علمی INSPIRE HEP
NASA ADS
Google Scholar
Semantic Scholar

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

چکیده

Multi-agent reinforcement learning (MARL) has exploded in popularity in recent years. Many approaches have been developed but they can be divided into three main types: centralized training and execution (CTE), centralized training for decentralized execution (CTDE), and Decentralized training and execution (DTE). CTDE methods are the most common as they can use centralized information during training but execute in a decentralized manner -- using only information available to that agent during execution. CTDE is the only paradigm that requires a separate training phase where any available information (e.g., other agent policies, underlying states) can be used. As a result, they can be more scalable than CTE methods, do not require communication during execution, and can often perform well. CTDE fits most naturally with the cooperative case, but can be potentially applied in competitive or mixed settings depending on what information is assumed to be observed. This text is an introduction to CTDE in cooperative MARL. It is meant to explain the setting, basic concepts, and common methods. It does not cover all work in CTDE MARL as the subarea is quite extensive. I have included work that I believe is important for understanding the main concepts in the subarea and apologize to those that I have omitted.

چکیده به فارسی (ترجمه ماشینی)

یادگیری تقویت کننده چند عامل (MARL) در سالهای اخیر محبوبیت خود را منفجر کرده است.رویکردهای زیادی ایجاد شده است اما می توان آنها را به سه نوع اصلی تقسیم کرد: آموزش و اجرای متمرکز (CTE) ، آموزش متمرکز برای اجرای غیرمتمرکز (CTDE) و آموزش و اجرای غیر متمرکز (DTE).روشهای CTDE متداول ترین است زیرا می توانند در طول آموزش از اطلاعات متمرکز استفاده کنند اما به صورت غیر متمرکز اجرا شوند - فقط با استفاده از اطلاعات موجود در آن عامل در حین اجرای.CTDE تنها پارادایم است که به یک مرحله آموزشی جداگانه نیاز دارد که در آن می توان از هرگونه اطلاعات موجود (به عنوان مثال ، سایر سیاست های عامل ، حالت های اساسی) استفاده کرد.در نتیجه ، آنها می توانند مقیاس پذیر تر از روش های CTE باشند ، در هنگام اجرای نیاز به برقراری ارتباط ندارند و اغلب می توانند عملکرد خوبی داشته باشند.CTDE به طور طبیعی با مورد تعاونی متناسب است ، اما بسته به آنچه که تصور می شود مشاهده می شود ، می تواند به طور بالقوه در تنظیمات رقابتی یا مختلط اعمال شود.این متن مقدمه ای برای CTDE در تعاونی مارل است.منظور از این است که تنظیم ، مفاهیم اساسی و روشهای متداول را توضیح دهد.این همه کارها را در CTDE MARL پوشش نمی دهد زیرا Subarea کاملاً گسترده است.من کارهایی را انجام داده ام که معتقدم برای درک مفاهیم اصلی در زیرزمین مهم است و از کسانی که من حذف کرده ام عذرخواهی می کنم.

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.