ترجمه فارسی مقاله مدولاریت در ترانسفورماتورها: بررسی تفکیک پذیری و تخصص نورون

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 37,500 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی
عنوان مقاله به انگلیسی Modularity in Transformers: Investigating Neuron Separability & Specialization
عنوان مقاله به فارسی مدولاریت در ترانسفورماتورها: بررسی تفکیک پذیری و تخصص نورون
نویسندگان Nicholas Pochinkov, Thomas Jones, Mohammed Rashidur Rahman
فرمت مقاله انگلیسی PDF
تعداد صفحات 11
لینک دانلود رایگان مقاله انگلیسی دانلود مقاله
دسته بندی موضوعات Machine Learning,Artificial Intelligence,Computation and Language,یادگیری ماشین , هوش مصنوعی , محاسبات و زبان ,
توضیحات Submitted 30 August, 2024; originally announced August 2024. , Comments: 11 pages, 6 figures , MSC Class: 68T07 (Primary) 68Q32; 68T05 (Secondary) ACM Class: I.2.4; I.2.6; I.2.7
توضیحات به فارسی ارسال شده در 30 اوت 2024 ؛در ابتدا اوت 2024 اعلام شد ، نظرات: 11 صفحه ، 6 شکل ، کلاس MSC: 68T07 (اولیه) 68Q32 ؛کلاس 68T05 (ثانویه) کلاس ACM: I.2.4 ؛I.2.6 ؛i.2.7
اطلاعات بیشتر از این مقاله در پایگاه های علمی INSPIRE HEP
NASA ADS
Google Scholar
Semantic Scholar

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

چکیده

Transformer models are increasingly prevalent in various applications, yet our understanding of their internal workings remains limited. This paper investigates the modularity and task specialization of neurons within transformer architectures, focusing on both vision (ViT) and language (Mistral 7B) models. Using a combination of selective pruning and MoEfication clustering techniques, we analyze the overlap and specialization of neurons across different tasks and data subsets. Our findings reveal evidence of task-specific neuron clusters, with varying degrees of overlap between related tasks. We observe that neuron importance patterns persist to some extent even in randomly initialized models, suggesting an inherent structure that training refines. Additionally, we find that neuron clusters identified through MoEfication correspond more strongly to task-specific neurons in earlier and later layers of the models. This work contributes to a more nuanced understanding of transformer internals and offers insights into potential avenues for improving model interpretability and efficiency.

چکیده به فارسی (ترجمه ماشینی)

مدل های ترانسفورماتور به طور فزاینده ای در برنامه های مختلف شیوع دارند ، اما درک ما از عملکرد داخلی آنها محدود است.در این مقاله به بررسی مدولار بودن و تخصص وظیفه نورونها در معماری ترانسفورماتور ، با تمرکز بر روی مدل های دید (VIT) و زبان (MISTRAL 7B) پرداخته شده است.با استفاده از ترکیبی از تکنیک های خوشه بندی هرس انتخابی و Moefication ، ما همپوشانی و تخصص نورونها را در کارهای مختلف و زیر مجموعه های داده تجزیه و تحلیل می کنیم.یافته های ما شواهدی از خوشه های نورون اختصاصی وظیفه ، با درجات مختلف همپوشانی بین کارهای مرتبط را نشان می دهد.ما مشاهده می کنیم که الگوهای اهمیت نورون حتی در مدلهای اولیه به طور تصادفی تا حدی ادامه دارد ، و یک ساختار ذاتی را نشان می دهد که آموزش را اصلاح می کند.علاوه بر این ، ما می دانیم که خوشه های نورون که از طریق moefication شناسایی می شوند بیشتر با نورون های خاص وظیفه در لایه های قبلی و بعدی مدل ها مطابقت دارند.این کار به درک ظریف تر از داخلی ترانسفورماتور کمک می کند و بینشی در مورد راه های بالقوه برای بهبود تفسیر مدل و کارآیی ارائه می دهد.

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.