ترجمه فارسی مقاله مدل‌های زبانی از پیش آموزش‌دیده، توانایی تصمیم‌گیری سریع و کم‌هزینه‌ی تبدیل‌کننده‌ی تصمیم‌گیری را بهبود می‌بخشند

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 37,500 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی
عنوان مقاله به انگلیسی Pre-trained Language Models Improve the Few-shot Prompt Ability of Decision Transformer
عنوان مقاله به فارسی مدل‌های زبانی از پیش آموزش‌دیده، توانایی تصمیم‌گیری سریع و کم‌هزینه‌ی تبدیل‌کننده‌ی تصمیم‌گیری را بهبود می‌بخشند
نویسندگان Yu Yang, Pan Xu
فرمت مقاله انگلیسی PDF
تعداد صفحات 15
دسته بندی موضوعات Machine Learning,Artificial Intelligence,Computation and Language,یادگیری ماشین , هوش مصنوعی , محاسبات و زبان ,
توضیحات Submitted 2 August, 2024; originally announced August 2024. , Comments: 2 figures, 8 tables. Accepted by the Training Agents with Foundation Models Workshop at RLC 2024
توضیحات به فارسی ارسال شده در 2 اوت 2024 ؛در ابتدا اوت 2024 اعلام شد. ، نظرات: 2 شکل ، 8 جدول.پذیرفته شده توسط نمایندگان آموزش با کارگاه مدلهای بنیاد در RLC 2024

قیمت: 19,000 تومان

دانلود مقاله اصل انگلیسی + خلاصه دو صفحه ای مقاله + پادکست صوتی فارسی خلاصه مقاله

با انتخاب این گزینه، علاوه بر دریافت مقاله اصلی، یک خلاصه دو صفحه‌ای فارسی و پادکست صوتی فارسی خلاصه مقاله را نیز دریافت خواهید کرد.

قیمت: 99,000 تومان

سفارش + خلاصه دو صفحه ای مقاله + پادکست صوتی فارسی خلاصه مقاله

با انتخاب این گزینه، علاوه بر دریافت مقاله اصلی و ترجمه کامل آن، یک خلاصه دو صفحه‌ای فارسی و پادکست صوتی فارسی خلاصه مقاله را نیز دریافت خواهید کرد.

قیمت: 600,000 تومان

زمان تحویل: 2 تا 3 روز کاری


📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

چکیده

Decision Transformer (DT) has emerged as a promising class of algorithms in offline reinforcement learning (RL) tasks, leveraging pre-collected datasets and Transformer's capability to model long sequences. Recent works have demonstrated that using parts of trajectories from training tasks as prompts in DT enhances its performance on unseen tasks, giving rise to Prompt-DT methods. However, collecting data from specific environments can be both costly and unsafe in many scenarios, leading to suboptimal performance and limited few-shot prompt abilities due to the data-hungry nature of Transformer-based models. Additionally, the limited datasets used in pre-training make it challenging for Prompt-DT type of methods to distinguish between various RL tasks through prompts alone. To address these challenges, we introduce the Language model-initialized Prompt Decision Transformer (LPDT), which leverages pre-trained language models for meta-RL tasks and fine-tunes the model using Low-rank Adaptation (LoRA). We further incorporate prompt regularization to effectively differentiate between tasks based on prompt feature representations. Our approach integrates pre-trained language model and RL tasks seamlessly. Extensive empirical studies demonstrate that initializing with a pre-trained language model significantly enhances the performance of Prompt-DT on unseen tasks compared to baseline methods.

چکیده به فارسی (ترجمه ماشینی)

ترانسفورماتور تصمیم گیری (DT) به عنوان یک کلاس امیدوار کننده از الگوریتم ها در کارهای یادگیری تقویت آفلاین (RL) ظاهر شده است ، و با استفاده از مجموعه داده های از پیش جمع آوری شده و توانایی ترانسفورماتور برای مدل سازی توالی های طولانی.آثار اخیر نشان داده اند که استفاده از بخش هایی از مسیرها از کارهای آموزشی به عنوان پیشبرد در DT ، عملکرد آن را در کارهای غیب افزایش می دهد و باعث ایجاد روش های سریع DT می شود.با این حال ، جمع آوری داده ها از محیط های خاص می تواند در بسیاری از سناریوها هم پرهزینه و هم ناامن باشد ، که منجر به عملکرد زیر حداقلی و محدودیت های سریع شات به دلیل ماهیت داده گرسنه مدلهای مبتنی بر ترانسفورماتور می شود.علاوه بر این ، مجموعه داده های محدود مورد استفاده در پیش از این ، باعث می شود که نوع روشهای سریع DT برای تمایز بین کارهای مختلف RL از طریق Prompts به تنهایی چالش برانگیز باشد.برای پرداختن به این چالش ها ، ما ترانسفورماتور تصمیم گیری سریع مدل زبان (LPDT) را معرفی می کنیم ، که مدل های زبان از پیش آموزش داده شده را برای کارهای META-RL و تنظیم دقیق مدل با استفاده از سازگاری با درجه پایین (LORA) اعمال می کند.ما در ادامه ، تنظیم مجدد سریع را برای تمایز مؤثر بین وظایف بر اساس بازنمایی ویژگی های سریع درج می کنیم.رویکرد ما یکپارچه مدل زبان از قبل آموزش دیده و وظایف RL یکپارچه است.مطالعات تجربی گسترده نشان می دهد که اولیه سازی با یک مدل زبان از پیش آموزش دیده ، عملکرد سریع DT را در کارهای غیب نسبت به روشهای پایه افزایش می دهد.

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.