ترجمه فارسی مقاله تقویت هواخصم های خطی مبتنی بر اولویت از طریق زمان پاسخ انسانی

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 37,500 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی
عنوان مقاله به انگلیسی Enhancing Preference-based Linear Bandits via Human Response Time
عنوان مقاله به فارسی تقویت هواخصم های خطی مبتنی بر اولویت از طریق زمان پاسخ انسانی
نویسندگان Shen Li, Yuyang Zhang, Zhaolin Ren, Claire Liang, Na Li, Julie A. Shah
فرمت مقاله انگلیسی PDF
تعداد صفحات 37
لینک دانلود رایگان مقاله انگلیسی دانلود مقاله
دسته بندی موضوعات Machine Learning,Artificial Intelligence,Human-Computer Interaction,Econometrics,Machine Learning,یادگیری ماشین , هوش مصنوعی , تعامل انسان و رایانه , اقتصاد سنجی , یادگیری ماشین ,
توضیحات Submitted 9 September, 2024; originally announced September 2024.
توضیحات به فارسی ارسال شده در 9 سپتامبر 2024 ؛در ابتدا سپتامبر 2024 اعلام شد.
اطلاعات بیشتر از این مقاله در پایگاه های علمی INSPIRE HEP
NASA ADS
Google Scholar
Semantic Scholar

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

چکیده

Binary human choice feedback is widely used in interactive preference learning for its simplicity, but it provides limited information about preference strength. To overcome this limitation, we leverage human response times, which inversely correlate with preference strength, as complementary information. Our work integrates the EZ-diffusion model, which jointly models human choices and response times, into preference-based linear bandits. We introduce a computationally efficient utility estimator that reformulates the utility estimation problem using both choices and response times as a linear regression problem. Theoretical and empirical comparisons with traditional choice-only estimators reveal that for queries with strong preferences ("easy" queries), choices alone provide limited information, while response times offer valuable complementary information about preference strength. As a result, incorporating response times makes easy queries more useful. We demonstrate this advantage in the fixed-budget best-arm identification problem, with simulations based on three real-world datasets, consistently showing accelerated learning when response times are incorporated.

چکیده به فارسی (ترجمه ماشینی)

بازخورد انتخاب بشر باینری به دلیل سادگی آن در یادگیری اولویت تعاملی مورد استفاده قرار می گیرد ، اما اطلاعات محدودی در مورد قدرت اولویت ارائه می دهد.برای غلبه بر این محدودیت ، ما از زمان پاسخگویی انسان استفاده می کنیم ، که به طور معکوس با قدرت ترجیح ، به عنوان اطلاعات مکمل ارتباط دارد.کار ما مدل EZ-diffusion را که به طور مشترک از انتخاب های انسانی و زمان پاسخگویی استفاده می کند ، در راهزنان خطی مبتنی بر ترجیح ادغام می کند.ما یک برآوردگر ابزار محاسباتی کارآمد را معرفی می کنیم که مشکل تخمین ابزار را با استفاده از هر دو گزینه و زمان پاسخ به عنوان یک مشکل رگرسیون خطی اصلاح می کند.مقایسه های نظری و تجربی با برآوردگرهای فقط انتخاب سنتی نشان می دهد که برای پرس و جو با ترجیحات قوی (نمایش داده شدگان "آسان") ، انتخاب به تنهایی اطلاعات محدودی را ارائه می دهد ، در حالی که زمان پاسخگویی اطلاعات مکمل ارزشمندی را در مورد قدرت ترجیح ارائه می دهد.در نتیجه ، ترکیب زمان پاسخ ، نمایش داده های آسان را مفیدتر می کند.ما این مزیت را در مشکل شناسایی بهترین بازوی با بودجه ثابت ، با شبیه سازی های مبتنی بر سه مجموعه داده در دنیای واقعی نشان می دهیم ، که به طور مداوم یادگیری شتاب را نشان می دهد که زمان پاسخ گنجانیده شده است.

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.