کتاب مبانی یادگیری تقویتی تک عامله برای هوش مصنوعی چندعامله

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 62,488 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

🎓 دوره آموزشی جامع

📚 اطلاعات دوره

عنوان دوره: دوره مبانی یادگیری تقویتی تک عامله برای هوش مصنوعی چندعامله

موضوع کلی: یادگیری تقویتی چندعامله (MARL)

موضوع میانی: یادگیری تقویتی تک عامله

📋 سرفصل‌های دوره

  • 1. مقدمه‌ای بر یادگیری تقویتی
  • 2. عوامل و محیط در یادگیری تقویتی
  • 3. مفهوم پاداش و تخفیف
  • 4. مدل‌سازی مارکوف و فرآیندهای تصمیم‌گیری مارکوفی
  • 5. حل معادلات بلمن برای مسائل ساده
  • 6. روش‌های تکراری سیاست
  • 7. روش‌های تکراری ارزش
  • 8. تقریب توابع ارزش
  • 9. تقریب سیاست
  • 10. یادگیری تقویتی مبتنی بر اختلاف زمانی (TD)
  • 11. Sarsa: الگوریتم یادگیری تقویتی برخط
  • 12. Q-learning: الگوریتم یادگیری تقویتی خارج از خط
  • 13. الگوریتم‌های Deep Q-Network (DQN)
  • 14. شبکه‌های عصبی کانولوشنال در یادگیری تقویتی
  • 15. تجربه تکراری (Experience Replay)
  • 16. هدف‌گذاری ثابت (Fixed Q-Targets)
  • 17. اکتشاف و بهره‌برداری: استراتژی‌های مختلف
  • 18. ε-greedy exploration
  • 19. اکتشاف مبتنی بر امیدواری (Optimistic Initialization)
  • 20. استراتژی‌های اکتشاف مبتنی بر توزیع
  • 21. یادگیری تقویتی با سیاست گرادیانی
  • 22. روش‌های مونت کارلو برای سیاست گرادیانی
  • 23. REINFORCE: الگوریتم سیاست گرادیانی
  • 24. Actor-Critic Methods
  • 25. A2C و A3C
  • 26. یادگیری تقویتی چندعامله (MARL)
  • 27. چالش‌های یادگیری تقویتی چندعامله
  • 28. مفاهیم همکاری و رقابت در MARL
  • 29. یادگیری تقویتی مستقل (Independent Learners)
  • 30. یادگیری تقویتی مشترک (Joint Action Learners)
  • 31. الگوریتم‌های هماهنگ‌سازی سیاست
  • 32. Communication Learning در MARL
  • 33. یادگیری تقویتی سلسله مراتبی
  • 34. یادگیری تقویتی با حافظه
  • 35. Long Short-Term Memory (LSTM) در یادگیری تقویتی
  • 36. Transformerها در یادگیری تقویتی
  • 37. یادگیری تقویتی و شبیه‌سازی
  • 38. یادگیری تقویتی در محیط‌های واقعی
  • 39. انتقال یادگیری در یادگیری تقویتی
  • 40. یادگیری تقویتی تطبیقی (Adaptive Reinforcement Learning)
  • 41. یادگیری تقویتی با دانش قبلی
  • 42. Meta-Learning در یادگیری تقویتی
  • 43. یادگیری تقویتی ایمن (Safe Reinforcement Learning)
  • 44. روش‌های محدود کردن پاداش
  • 45. روش‌های محدود کردن عمل
  • 46. یادگیری تقویتی و اخلاق
  • 47. تفسیرپذیری در یادگیری تقویتی
  • 48. یادگیری تقویتی و حریم خصوصی
  • 49. بررسی موردی: بازی‌های Atari با یادگیری تقویتی
  • 50. بررسی موردی: رباتیک با یادگیری تقویتی
  • 51. بررسی موردی: مدیریت منابع با یادگیری تقویتی
  • 52. کاربردهای یادگیری تقویتی در شبکه‌های ارتباطی
  • 53. یادگیری تقویتی در سیستم‌های توصیه‌گر
  • 54. یادگیری تقویتی در مالی و تجارت
  • 55. چالش‌ها و آینده یادگیری تقویتی تک عامله
  • 56. چالش‌ها و آینده یادگیری تقویتی چندعامله
  • 57. تحلیل عملکرد الگوریتم‌های یادگیری تقویتی
  • 58. انتخاب الگوریتم مناسب برای مسئله مورد نظر
  • 59. تنظیم هایپرپارامترها در یادگیری تقویتی
  • 60. بهینه‌سازی پاداش در یادگیری تقویتی
  • 61. ارزیابی سیاست‌های یادگیری تقویتی
  • 62. روش‌های ارزیابی سیاست
  • 63. مقایسه روش‌های مختلف یادگیری تقویتی
  • 64. مسائل باز در یادگیری تقویتی

📚 محتوای این محصول آموزشی (پکیج کامل)

💡 این محصول یک نسخهٔ کامل و جامع است

تمامی محتوای آموزشی این کتاب در قالب یک بسته‌ی کامل و یکپارچه ارائه می‌شود و شامل تمام نسخه‌ها و فایل‌های موردنیاز برای یادگیری است.

🎁 محتویات کامل بسته دانلودی

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل کتاب‌ها، تمرین‌ها و خودآزمایی .


ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود و نسخهٔ چاپی ندارد.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های کتاب همانجا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.