ترجمه فارسی مقاله انطباق خط مشی از طریق بهینه سازی زبان: تجزیه وظایف برای تقلید چند شات

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 37,500 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی
عنوان مقاله به انگلیسی Policy Adaptation via Language Optimization: Decomposing Tasks for Few-Shot Imitation
عنوان مقاله به فارسی انطباق خط مشی از طریق بهینه سازی زبان: تجزیه وظایف برای تقلید چند شات
نویسندگان Vivek Myers, Bill Chunyuan Zheng, Oier Mees, Sergey Levine, Kuan Fang
فرمت مقاله انگلیسی PDF
تعداد صفحات 27
لینک دانلود رایگان مقاله انگلیسی دانلود مقاله
دسته بندی موضوعات Robotics,Machine Learning,روباتیک , یادگیری ماشین ,
توضیحات Submitted 28 August, 2024; originally announced August 2024. , Comments: 27 pages, 14 figures
توضیحات به فارسی ارسال شده 28 اوت 2024 ؛در ابتدا اوت 2024 اعلام شد ، نظرات: 27 صفحه ، 14 شکل
اطلاعات بیشتر از این مقاله در پایگاه های علمی INSPIRE HEP
NASA ADS
Google Scholar
Semantic Scholar

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

چکیده

Learned language-conditioned robot policies often struggle to effectively adapt to new real-world tasks even when pre-trained across a diverse set of instructions. We propose a novel approach for few-shot adaptation to unseen tasks that exploits the semantic understanding of task decomposition provided by vision-language models (VLMs). Our method, Policy Adaptation via Language Optimization (PALO), combines a handful of demonstrations of a task with proposed language decompositions sampled from a VLM to quickly enable rapid nonparametric adaptation, avoiding the need for a larger fine-tuning dataset. We evaluate PALO on extensive real-world experiments consisting of challenging unseen, long-horizon robot manipulation tasks. We find that PALO is able of consistently complete long-horizon, multi-tier tasks in the real world, outperforming state of the art pre-trained generalist policies, and methods that have access to the same demonstrations.

چکیده به فارسی (ترجمه ماشینی)

سیاستهای روبات با شرایط زبان آموخته شده اغلب برای تطبیق مؤثر با وظایف جدید در دنیای واقعی تلاش می کنند ، حتی اگر از قبل در مجموعه متنوعی از دستورالعمل ها از پیش استفاده شود.ما یک رویکرد جدید برای سازگاری چند عکس با وظایف غیب ارائه می دهیم که از درک معنایی تجزیه کار ارائه شده توسط مدلهای بینایی-زبان (VLMS) سوء استفاده می کند.روش ما ، سازگاری سیاست از طریق بهینه سازی زبان (PALO) ، تعداد معدودی از تظاهرات یک کار را با تجزیه زبان پیشنهادی نمونه برداری از VLM برای امکان پذیرش سریع سازگاری غیر پارامتری ، از نیاز به یک مجموعه داده تنظیم دقیق بزرگتر ترکیب می کند.ما PALO را در مورد آزمایش های گسترده در دنیای واقعی متشکل از کارهای دستکاری ربات های غیب و بی نظم و بدون افکار ، ارزیابی می کنیم.ما می دانیم که PALO قادر به انجام کارهای افکار طولانی مدت ، چند لایه در دنیای واقعی است ، از وضعیت سیاست های ژنرالیستی از پیش آموزش داده شده هنری و روشهایی که به همان تظاهرات دسترسی دارند ، بهتر است.

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.