کتاب کاربرد یادگیری تقویتی: حل مسائل پیچیده با یادگیری

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 62,488 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

🎓 دوره آموزشی جامع

📚 اطلاعات دوره

عنوان دوره: دوره کاربرد یادگیری تقویتی: حل مسائل پیچیده با یادگیری

موضوع کلی: یادگیری تقویتی چندعامله (MARL)

موضوع میانی: مبانی یادگیری تقویتی (RL)

📋 سرفصل‌های دوره

  • 1. مقدمه‌ای بر یادگیری تقویتی و کاربردهای آن
  • 2. مفاهیم پایه یادگیری تقویتی: عامل، محیط، پاداش، حالت
  • 3. فرآیند تصمیم‌گیری مارکوف (MDP)
  • 4. معادلات بلمن و کاربرد آن‌ها
  • 5. حل معادلات بلمن: روش تکرار مقداری (Value Iteration)
  • 6. حل معادلات بلمن: روش تکرار سیاست (Policy Iteration)
  • 7. یادگیری تقویتی بدون مدل (Model-Free RL)
  • 8. روش‌های مونت‌کارلو (Monte Carlo Methods)
  • 9. تفاضل زمانی (Temporal Difference Learning)
  • 10. Q-learning: الگوریتم و کاربردها
  • 11. Sarsa: الگوریتم و کاربردها
  • 12. انتخاب عمل (Action Selection): اپسیلون-گریدی (Epsilon-Greedy)
  • 13. انتخاب عمل: سافت‌مکس (Softmax)
  • 14. تقریب توابع (Function Approximation)
  • 15. شبکه‌های عصبی به عنوان تقریب‌گر تابع (Neural Networks as Function Approximators)
  • 16. Deep Q-Network (DQN) و بهبودهای آن
  • 17. روش‌های سیاست‌گرادیان (Policy Gradient Methods)
  • 18. REINFORCE: الگوریتم پایه سیاست‌گرادیان
  • 19. Actor-Critic Methods
  • 20. A2C و A3C
  • 21. Proximal Policy Optimization (PPO)
  • 22. Trust Region Policy Optimization (TRPO)
  • 23. یادگیری تقویتی در محیط‌های پیوسته (Continuous Control)
  • 24. Deep Deterministic Policy Gradient (DDPG)
  • 25. Twin Delayed DDPG (TD3)
  • 26. Soft Actor-Critic (SAC)
  • 27. یادگیری تقویتی چندعامله (Multi-Agent Reinforcement Learning - MARL)
  • 28. مفاهیم پایه MARL: همکاری و رقابت
  • 29. روش‌های هماهنگ‌سازی در MARL
  • 30. Independent Q-Learning
  • 31. Centralized Training with Decentralized Execution (CTDE)
  • 32. Counterfactual Multi-Agent Policy Gradients (COMA)
  • 33. Multi-Agent Deep Deterministic Policy Gradient (MADDPG)
  • 34. استفاده از MARL در بازی‌ها (Games)
  • 35. کاربرد MARL در رباتیک
  • 36. کاربرد MARL در مدیریت منابع
  • 37. کاربرد MARL در شبکه‌های ارتباطی
  • 38. چالش‌ها و محدودیت‌های MARL
  • 39. آینده یادگیری تقویتی و MARL
  • 40. پیاده‌سازی یک پروژه یادگیری تقویتی ساده
  • 41. بهینه‌سازی هایپرپارامترها در یادگیری تقویتی
  • 42. استفاده از کتابخانه‌های یادگیری تقویتی (TensorFlow Agents, PyTorch RL)

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.