بهنظر میرسد که انتخاب Cerebras بهعنوان شریک AMD در مسیر تقویت قابلیتهای استنتاجی سیستم رکاسکیل Helios بسیار هوشمندانه بوده است؛ چراکه اخیراً یک پژوهشگر شرکت OpenAI نیز ستایش بزرگی را نثار موتور مقیاس ویفر (Wafer-Scale Engine) شرکت Cerebras کرده است.
به گزارش Wccftech، سیستم هلیوس اولین راهکار ایامدی در مقیاس رک برای کارهای هوش مصنوعی است و از اجزای زیر تشکیل شده است:
- پردازندههای گرافیکی AMD Instinct MI455X
- پردازندههای مرکزی نسل ششم AMD EPYC
- کارتهای شبکه هوش مصنوعی AMD Pensando (NICs)
- واحد پردازش داده (DPU) AMD Pensando
- فناوری AMD Infinity Fabric
- پشته نرمافزاری AMD ROCm
ایامدی برای تقویت بیشتر کارایی سیستمهای Helios خود در بارهای کاری هوش مصنوعی، با شرکت Cerebras شریک شده است و قصد دارد موتور مقیاس ویفر Cerebras را با سیستمهای Helios خود برای استنتاج فوقالعاده سریع یکپارچه کند.
برای کسانی که ممکن است مطلع نباشند، موتور مقیاس ویفر Cerebras تمام حافظه و توان محاسباتی یک سوپرکامپیوتر هوش مصنوعی را روی یک تکه سیلیکون غولپیکر و بههمپیوسته قرار میدهد که در آن صدها هزار هسته محاسباتی و دهها گیگابایت حافظه SRAM به طور یکپارچه متصل میشوند و به دادهها اجازه میدهند بدون برخورد به گلوگاههای شبکه خارجی به طور کارآمد حرکت کنند.
اساساً، موتور Cerebras میتواند مدلی با اندازه متوسط، یا بخشهای بزرگی از یک مدل بزرگ، را در بخش واحدی از حافظه SRAM خود جای دهد. همچنین، همهکاره بودن رویکرد Cerebras امکان اجرای امور آموزش و استنتاج را فراهم میکند.
بر اساس نقشه راه در نظر گرفته شده توسط AMD، سیستم Helios یک موتور توان عملیاتی مقیاسپذیر با عملکرد بالا ارائه خواهد داد، درحالیکه فناوری Cerebras استنتاج و تولید توکن با تأخیر فوقالعاده پایین و فوقالعاده سریع را فراهم میکند. انتظار میرود این دو موتور محاسباتی در کنار هم در هر ثانیه تا ۵ برابر توکن بیشتر به ازای هر وات ارائه دهند.


«جفری وانگ» (Jeffrey Wang)، پژوهشگر OpenAI، فاش میکند مدلهای داخلی که روی تراشههای Cerebras اجرا میشوند به قدری سریع هستند که وظایف پیش از اینکه او حتی فرصتی برای تغییر زمینه (Context-Switch) پیدا کند به پایان میرسند و این موضوع بهرهوری او را افزایش میدهد. او توضیح داد:
«در داخل سازمان ما برخی مدلهای OpenAI روی تراشههای Cerebras اجرا میشوند. این تراشهها شگفتانگیز هستند زیرا قدرت استنتاج بسیار سریعی دارند.»
وانگ در ادامه اعلام کرد:
«و اهمیت این موضوع برای من در کارهای روزمره این است: درحالیکه پیش از این ممکن بود مجبور باشم چند دقیقه برای اتمام یک کار صبر کنم، اکنون کار پیش از اینکه حتی فرصتی برای تغییر زمینه پیدا کنم برای من به پایان میرسد. این موضوع بهرهوری مرا به شدت افزایش میدهد.»
مدلهای هوش مصنوعی معمولاً زمانی که از یک وظیفه به وظیفه دیگر میپرند، تغییر زمینه میدهند. این اتفاق ممکن است در تنظیمات چندعاملی (Multi-agentic) که در آن مدل باید مجموعهای از وظایف متنوع را انجام دهد، یا در مدلهای ترکیب متخصصان (MoE) رخ دهد که در آن شبکههای عصبی فرعی مختلف در انجام یک وظیفه خاص تخصص دارند.
این واقعیت که سیستمهای Cerebras مهندسان OpenAI را تحت تأثیر قرار داده، نشان میدهد که سیستمهای رکاسکیل Helios شرکت AMD که با موتورهای مقیاس ویفر یکپارچه شدهاند، احتمالاً پس از عرضه با استقبال بسیار خوبی مواجه خواهند شد.
این موضوع زمانی اهمیت بیشتری پیدا میکند که بدانید هزینههای استنتاج اکنون بزرگترین تعیینکننده سودآوری دیتاسنترها هستند.
نظرات کاربران