آمازون خود را برای عرضه نسل دوم تراشه قدرتمند Trainium آماده میکند که به شکل قابل توجهی از نسل اول قویتر است. عرضه این مدل تنور رقابت در زمینه هوش مصنوعی را بین آمازون و انویدیا داغتر میکند.
آمازون وب سرویس (AWS) با معرفی تراشه هوش مصنوعی Trainium 2، رویکردی جدید و بهینه برای آموزش مدلهای زبانی بزرگ (LLM) مانند Llama 2 از شرکت Meta ارائه کرد. نسل جدید این تراشه که بهطور خاص برای آموزش مدلهای یادگیری ماشین طراحی شده، عملکرد و هزینهها را بهبود بخشیده و به توسعهدهندگان امکان میدهد تا مدلهای LLM قدرتمند را با کارایی بیشتری تنظیم و اجرا کنند.

مشخصات تراشه آمازون Trainium 2
تراشه ترینیوم ۲ توسط یکی از زیرمجموعههای آمازون به نام Annapurna Labs طراحش شده که در آستین تگزاس قرار دارد. این چیپ به صورت ویژه برای محاسبات یادگیری ماشین طراحی شده و انتظار میرود که ماه آینده عرضه شود.
تراشه Trainium 2 از ماهها قبل توسط شرکتهای Databricks، اپراتور دویچه تلکام و استارتاپ هوش مصنوعی Anthropic در حال تست است. طبق ادعای آمازون توان عملیاتی نسل دوم ترینیوم نسبت به نسل اول حدود ۴ برابر ارتقا پیدا کرده که دستاوردی چشمگیر برای آمازون است. در عین حال این تراشه ۲ برابر بازدهی انرژی بالاتری ارائه میکند.
تراشه هوش مصنوعی Trainium 2 بر پایه معماری خاصی بنا شده که به طور ویژه برای پردازش وظایف یادگیری ماشین بهینه شده است. این تراشه از واحدهای پردازش تنسور (TPU) بهره میبرد که قادر به انجام محاسبات ماتریسی با کارایی بالا هستند. از این رو ترینیوم گزینهای ایدهآل برای آموزش مدلهای بزرگ و پیچیده خواهد بود.
تراشه جدید آمازون از حافظههای پرسرعت و پهنای باند بالا استفاده میکند که باعث کاهش زمان انتقال دادهها و افزایش سرعت پردازش میشود.

مزایای تراشه هوش مصنوعی آمازون
چیپ Trainium قابلیتها و مزایای متعددی دارد که آن را از دیگر تراشههای موجود در بازار متمایز میکند. یکی از این قابلیتها پشتیبانی از آموزش مدلهای بزرگ مانند جمینای ۱.۵ پرو است.
علاوه بر این انعطافپذیری هم دارد و با انواع فریمورکهای یادگیری ماشین مانند TensorFlow و PyTorch سازگار است. این ویژگی به توسعهدهندگان اجازه میدهد تا از ابزارها و کتابخانههای مورد علاقه خود برای آموزش مدلها استفاده کنند.
ترینیوم با تمرکز روی کاهش هزینههای آموزش مدلها طراحی شده است. AWS اعلام کرده که استفاده از Trainium میتواند هزینههای آموزش را تا حد زیادی کاهش دهد. این امر برای شرکتها و سازمانهایی جذاب است که به دنبال صرفهجویی در هزینههای پروژههای یادگیری ماشین هستند.
مشخصات سختافزاری 1 Trainium
آمازون از این تراشه در یکی از محبوبترین و پرکاربردترین سرویسهای محاسبات ابری یعنی EC2 استفاده میکند. ترینیوم در قلب سرورهای مجازی یا اینستنسها قرار گرفته و محاسبات پیچیده را مدیریت میکند.
هر تراشه Trainium شامل ۱۶ هسته NeuronCore است که هر کدام ۳۲ گیگابایت حافظه با پهنای باند بالا دارند و در مجموع ۵۱۲ گیگابایت حافظه برای هر اینستنس فراهم میدهند.
این معماری امکان پردازش موازی دادههای حجیم را فراهم میکند و سرعت آموزش را به طور چشمگیری افزایش میدهد.
علاوه بر این Trainium از اتصال تا ۱۶ نمونه با پهنای باند پتابیت پشتیبانی میکند که آموزش توزیع شده در مقیاس بزرگ را برای سنگینترین بارهای کاری LLM ممکن میآورد.
اپراتور هوش مصنوعی اهورا با فراهم کردن سرورهای گرافیکی با بیش از 10 سخت افزار قدرتمند، نیازهای پردازشی کاربران حرفهای را پوشش میدهد. سرور gpu به ویژه برای پروژههای مبتنی بر هوش مصنوعی، یادگیری ماشین و شبیهسازیهای پیچیده مناسباند. شما میتوانید با خرید یا اجاره این سرورها، بدون نیاز به سرمایهگذاری اولیه بالا، از قدرت پردازشی فوقالعاده بهرهمند شوید.
منابع:
