ترجمه فارسی مقاله شستشوی ایمنی: آیا معیارهای ایمنی هوش مصنوعی واقعاً پیشرفت ایمنی را اندازه‌گیری می‌کنند؟

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 37,500 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی
عنوان مقاله به انگلیسی Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?
عنوان مقاله به فارسی شستشوی ایمنی: آیا معیارهای ایمنی هوش مصنوعی واقعاً پیشرفت ایمنی را اندازه‌گیری می‌کنند؟
نویسندگان Richard Ren, Steven Basart, Adam Khoja, Alice Gatti, Long Phan, Xuwang Yin, Mantas Mazeika, Alexander Pan, Gabriel Mukobi, Ryan H. Kim, Stephen Fitz, Dan Hendrycks
فرمت مقاله انگلیسی PDF
تعداد صفحات 43
دسته بندی موضوعات Machine Learning,Artificial Intelligence,Computation and Language,Computers and Society,یادگیری ماشین , هوش مصنوعی , محاسبات و زبان , رایانه و جامعه ,
توضیحات Submitted 31 July, 2024; originally announced July 2024.
توضیحات به فارسی ارسال 31 ژوئیه 2024 ؛در ابتدا ژوئیه 2024 اعلام شد.

قیمت: 19,000 تومان

دانلود مقاله اصل انگلیسی + خلاصه دو صفحه ای مقاله + پادکست صوتی فارسی خلاصه مقاله

با انتخاب این گزینه، علاوه بر دریافت مقاله اصلی، یک خلاصه دو صفحه‌ای فارسی و پادکست صوتی فارسی خلاصه مقاله را نیز دریافت خواهید کرد.

قیمت: 99,000 تومان

سفارش + خلاصه دو صفحه ای مقاله + پادکست صوتی فارسی خلاصه مقاله

با انتخاب این گزینه، علاوه بر دریافت مقاله اصلی و ترجمه کامل آن، یک خلاصه دو صفحه‌ای فارسی و پادکست صوتی فارسی خلاصه مقاله را نیز دریافت خواهید کرد.

قیمت: 1,720,000 تومان

زمان تحویل: 2 تا 3 روز کاری


📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

چکیده

As artificial intelligence systems grow more powerful, there has been increasing interest in "AI safety" research to address emerging and future risks. However, the field of AI safety remains poorly defined and inconsistently measured, leading to confusion about how researchers can contribute. This lack of clarity is compounded by the unclear relationship between AI safety benchmarks and upstream general capabilities (e.g., general knowledge and reasoning). To address these issues, we conduct a comprehensive meta-analysis of AI safety benchmarks, empirically analyzing their correlation with general capabilities across dozens of models and providing a survey of existing directions in AI safety. Our findings reveal that many safety benchmarks highly correlate with upstream model capabilities, potentially enabling "safetywashing" -- where capability improvements are misrepresented as safety advancements. Based on these findings, we propose an empirical foundation for developing more meaningful safety metrics and define AI safety in a machine learning research context as a set of clearly delineated research goals that are empirically separable from generic capabilities advancements. In doing so, we aim to provide a more rigorous framework for AI safety research, advancing the science of safety evaluations and clarifying the path towards measurable progress.

چکیده به فارسی (ترجمه ماشینی)

از آنجا که سیستم های هوش مصنوعی قدرتمندتر می شوند ، علاقه زیادی به تحقیقات "ایمنی هوش مصنوعی" برای رفع خطرات در حال ظهور و آینده وجود داشته است.با این حال ، زمینه ایمنی هوش مصنوعی به طور ضعیف تعریف شده و متناقض اندازه گیری می شود و منجر به سردرگمی در مورد چگونگی مشارکت محققان می شود.این عدم وضوح با رابطه نامشخص بین معیارهای ایمنی هوش مصنوعی و قابلیت های عمومی بالادست (به عنوان مثال ، دانش و استدلال عمومی) پیچیده می شود.برای پرداختن به این موضوعات ، ما یک متاآنالیز جامع از معیارهای ایمنی AI را انجام می دهیم ، به صورت تجربی ارتباط آنها با قابلیت های عمومی در ده ها مدل و ارائه نظرسنجی از جهت های موجود در ایمنی هوش مصنوعی انجام می شود.یافته های ما نشان می دهد که بسیاری از معیارهای ایمنی با قابلیت های مدل بالادست ارتباط دارند ، که به طور بالقوه امکان "شستشوی ایمنی" را فراهم می کند - جایی که پیشرفت های توانایی به عنوان پیشرفت های ایمنی به اشتباه نشان داده می شوند.بر اساس این یافته ها ، ما یک بنیاد تجربی برای توسعه معیارهای ایمنی معنادار تر پیشنهاد می کنیم و ایمنی هوش مصنوعی را در یک زمینه تحقیق یادگیری ماشین به عنوان مجموعه ای از اهداف تحقیقاتی کاملاً مشخص که از نظر تجربی از پیشرفت های قابلیت های عمومی جدا هستند ، تعریف می کنیم.با انجام این کار ، ما قصد داریم چارچوبی سختگیرانه تر برای تحقیقات ایمنی هوش مصنوعی ، پیشبرد علم ارزیابی های ایمنی و روشن کردن مسیر به سمت پیشرفت قابل اندازه گیری فراهم کنیم.

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.