ترجمه فارسی مقاله آموزش مدل زبان زمینه فوق العاده طولانی با ترانسفورماتور توزیع شده کاملاً خط لوله

انتخاب پلن

انتخاب پلن برای ادامه خرید الزامی است.

پرداخت اقساطی
در صورت خرید اقساطی هر قسط: 37,500 تومان
۴ قسط ماهانه. بدون سود، چک و ضامن.
پرداخت اقساطی با دیجی‌پی پرداخت اقساطی با ترب‌پی
عنوان مقاله به انگلیسی Training Ultra Long Context Language Model with Fully Pipelined Distributed Transformer
عنوان مقاله به فارسی آموزش مدل زبان زمینه فوق العاده طولانی با ترانسفورماتور توزیع شده کاملاً خط لوله
نویسندگان Jinghan Yao, Sam Ade Jacobs, Masahiro Tanaka, Olatunji Ruwase, Aamir Shafi, Hari Subramoni, Dhabaleswar K. Panda
فرمت مقاله انگلیسی PDF
تعداد صفحات 12
لینک دانلود رایگان مقاله انگلیسی دانلود مقاله
دسته بندی موضوعات Distributed, Parallel, and Cluster Computing,Artificial Intelligence,Machine Learning,محاسبات توزیع شده , موازی و خوشه ای , هوش مصنوعی , یادگیری ماشین
توضیحات Submitted 29 August, 2024; originally announced August 2024.
توضیحات به فارسی ارسال شده 29 اوت 2024 ؛در ابتدا اوت 2024 اعلام شد.
اطلاعات بیشتر از این مقاله در پایگاه های علمی INSPIRE HEP
NASA ADS
Google Scholar
Semantic Scholar

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

چکیده

Large Language Models (LLMs) with long context capabilities are integral to complex tasks in natural language processing and computational biology, such as text generation and protein sequence analysis. However, training LLMs directly on extremely long contexts demands considerable GPU resources and increased memory, leading to higher costs and greater complexity. Alternative approaches that introduce long context capabilities via downstream finetuning or adaptations impose significant design limitations. In this paper, we propose Fully Pipelined Distributed Transformer (FPDT) for efficiently training long-context LLMs with extreme hardware efficiency. For GPT and Llama models, we achieve a 16x increase in sequence length that can be trained on the same hardware compared to current state-of-the-art solutions. With our dedicated sequence chunk pipeline design, we can now train 8B LLM with 2 million sequence length on only 4 GPUs, while also maintaining over 55% of MFU. Our proposed FPDT is agnostic to existing training techniques and is proven to work efficiently across different LLM models.

چکیده به فارسی (ترجمه ماشینی)

مدل های بزرگ زبان (LLMS) با قابلیت های زمینه طولانی برای انجام کارهای پیچیده در پردازش زبان طبیعی و زیست شناسی محاسباتی ، مانند تولید متن و تجزیه و تحلیل توالی پروتئین ، یکپارچه هستند.با این حال ، آموزش LLM ها به طور مستقیم در زمینه های بسیار طولانی نیاز به منابع GPU قابل توجهی و افزایش حافظه دارد و منجر به هزینه های بالاتر و پیچیدگی بیشتر می شود.رویکردهای جایگزین که قابلیت های زمینه طولانی را از طریق FinetUning پایین دست یا سازگاری معرفی می کنند ، محدودیت های قابل توجهی در طراحی را تحمیل می کنند.در این مقاله ، ما ترانسفورماتور توزیع شده کاملاً خط لوله (FPDT) را برای آموزش کارآمد LLM های طولانی مدت با راندمان سخت افزاری شدید پیشنهاد می کنیم.برای مدل های GPT و LLAMA ، ما به افزایش 16 برابر در طول دنباله می رسیم که می تواند در همان سخت افزار در مقایسه با راه حل های پیشرفته فعلی آموزش دیده باشد.با طراحی خط لوله توالی اختصاصی ما ، اکنون می توانیم 8B LLM را با 2 میلیون طول دنباله در تنها 4 GPU آموزش دهیم ، در حالی که بیش از 55 ٪ MFU را نیز حفظ می کنیم.FPDT پیشنهادی ما برای تکنیک های آموزش موجود آگنوستیک است و ثابت می شود که در مدلهای مختلف LLM کارآمد است.

📚 محتوای این محصول آموزشی (پکیج کامل)

علاوه بر مقاله اصلی انگلیسی که دریافت می کنید، برای یادگیری عمیق‌تر و تسلط کامل بر مباحث مجموعه‌ای از کتاب‌های آموزشی نیز ارائه می‌شود.

🎯 این بسته یک دورهٔ آموزشی کامل و چندلایه است؛ شامل ویدیوهای آموزشی، کتاب‌ها، تمرین‌ها و خودآزمایی.

ℹ️ نکات مهم هنگام خرید

  • این محصول به صورت فایل دانلودی کامل ارائه می‌شود.
  • توجه: لینک‌های اختصاصی دوره طی حداکثر 24 ساعت پس از ثبت سفارش ارسال می‌شوند.
  • دقت کنید لینک ها به شماره موبایل شما ارسال می شوند. پس در ارائه شماره موبایل صحیح دقت کنید.
  • برای راهنمایی در مورد نحوه دانلود به شماره 09395106248 پیامک دهید یا تماس بگیرید. (ایده آل ترین گزینه ارسال پیام در یکی از پیام رسان ها به همین شماره است تا سریعا لینک های محصول همان جا برای شما ارسال گردد.)
  • اگر پرداخت انجام شده ولی بعد از 24 ساعت هنوز لینک‌ها را دریافت نکرده‌اید، نام و نام خانوادگی و نام محصول را پیامک کنید تا لینک‌ها دوباره ارسال شوند.

💬 راه‌های ارتباطی پشتیبانی:
واتس‌اپ یا هر پیام رسان داخلی یا پیامک: 09395106248
تلگرام: @ma_limbs

نظرات

هنوز نظری ثبت نشده است.

وارد شوید تا نظر ثبت کنید.