فهرست مطالب
هواوی بهدلیل کمبود ظرفیت تولید و تقاضای بالای چین، عرضه جهانی تراشههای هوش مصنوعی Ascend را محدود کرده و بر توسعه ابرخوشهها تمرکز میکند.
به گزارش سرویس سخت افزار تکناک، اریک شو، رئیس دورهای هواوی، در حاشیه کنفرانس Huawei Connect گفت: «از آنجا که ظرفیت کافی برای پاسخگویی به تقاضا حتی در داخل چین را نداریم، برنامهای برای گسترش کامل فعالیتها در بازار بینالمللی نداریم.»
او افزود که هواوی حجم محدودی از محصولات خود را به «برخی کشورهایی که تقاضای بسیار بالایی دارند» عرضه میکند، اما جزئیات بیشتری ارائه نداد.
هواوی این هفته نقشه راه جدید شتابدهندههای هوش مصنوعی خود را رونمایی کرد.
این نقشه راه از افزایش چشمگیر عملکرد پردازش و استنتاج در نسلهای بعدی Ascend 960، 970 و 980 در مقایسه با Ascend 910C و سری Ascend 950 حکایت دارد.
قرار است مدلهای Ascend 960DT و 960PR در سال ۲۰۲۷، عملکرد آموزش FP8 را به ۲ پتافلاپس و عملکرد استنتاج FP4 را بهترتیب به ۴ و ۸ پتافلاپس برسانند.
در نسلهای بعدی نیز پیشبینی میشود Ascend 970 و Ascend 980 بهترتیب عملکرد FP4 را به ۱۴ و ۲۸ پتافلاپس افزایش دهند.
فاصله عملکردی با انویدیا و محدودیت تولید

با وجود سرعت بسیار بیشتر پردازندههای عصبی آینده هواوی نسبت به نسلهای قبلی، بهویژه در پردازش استنتاج، این محصولات از نظر توان محاسباتی خام همچنان فاصله زیادی با شتابدهندههای نسلهای قبلی و فعلی انویدیا خواهند داشت.
پیشبینی میشود Ascend 960DT در سال ۲۰۲۷ به عملکرد ۲ پتافلاپس FP8 در آموزش برسد، درحالیکه انویدیا H200 که در سال ۲۰۲۳ عرضه شد، ۴ پتافلاپس FP8 ارائه میدهد.
انتظار میرود Ascend 960PR نیز در پردازش FP4 به ۸ پتافلاپس برسد، رقمی که بسیار پایینتر از عملکرد ۱۵ تا ۲۰ پتافلاپس NVFP4 در انویدیا B300 است.
حتی Ascend 980 که عرضه آن برای سال ۲۰۲۹ هدفگذاری شده، احتمالاً به ۷٫۲ پتافلاپس FP8 و ۲۸ پتافلاپس FP4 میرسد.
این ارقام همچنان از عملکرد مورد انتظار انویدیا R200 کمتر هستند. پیشبینی میشود این تراشه در سال جاری به ۱۷٫۵ پتافلاپس FP8 و ۳۵ یا ۵۰ پتافلاپس FP4 دست پیدا کند.
چنین اختلاف عملکرد گستردهای با سختافزارهای پیشرفته هوش مصنوعی، وابستگی هواوی به مقیاسپذیری در سطح سامانه را برای رقابت با انویدیا بیشتر میکند.
این شرکت بهجای رقابت مستقیم تراشهبهتراشه، باید با کنار هم قرار دادن تعداد زیادی پردازنده، توان محاسباتی بالاتری ایجاد کند.
بااینحال، افزایش مقیاس سامانهها مصرف انرژی بسیار زیادی به همراه دارد و همین موضوع میتواند رقابتپذیری نسل بعدی Atlas SuperPoD و SuperCluster هواوی را در بازارهایی که به سختافزار AMD یا انویدیا دسترسی دارند، کاهش دهد.
هواوی در موقعیتی متناقض قرار گرفته است. از یک سو، تلاشهای این شرکت برای یکپارچهسازی، از جمله استفاده از فناوری اپتیک نزدیک به بستهبندی تراشه (NPO)، ظرفیت گرههای ساخت قدیمیتر را آزاد میکند تا بتوان از آنها برای تولید دیگر اجزای پلتفرمهای هوش مصنوعی استفاده کرد.
از سوی دیگر، ناتوانی SMIC در افزایش تولید تراشههای مبتنی بر فرایندهای ۷ و ۶ نانومتری، توانایی هواوی برای تأمین سختافزار هوش مصنوعی را محدود کرده است.
همین مسئله یکی از دلایل اصلی دشواری این شرکت در پاسخگویی به تقاضاست.
بیشتر بخوانید: شایعه جنجالی در چین؛ آیا مدیرعامل هواوی از کشور فرار کرده است؟
مقیاسپذیری گسترده؛ راهکار هواوی برای رقابت
بااینحال، Atlas SuperPoDهای هواوی که میتوانند به حداکثر ۱۵٬۴۸۸ پردازنده عصبی Ascend 960 مجهز شوند، قادر خواهند بود به عملکرد ۳۰ اگزافلاپس FP8 و ۱۲۰ اگزافلاپس FP4 برسند.
این توان محاسباتی بهمراتب از ظرفیت خوشههای NVL72 انویدیا با مقیاسپذیری حداکثر ۷۲ پردازنده گرافیکی فراتر میرود.
با وجود این، پیشبینی میشود بهرهوری انرژی این سامانهها، یعنی عملکرد بهازای هر وات، بهطور چشمگیری از معماریهای انویدیا پایینتر باشد.
در نتیجه، تقاضا برای چنین سختافزاری در بازارهای خارج از چین احتمالاً بسیار محدود خواهد بود.
بنابراین، عرضه گسترده جهانی سختافزارهای هوش مصنوعی هواوی در شرایط فعلی چندان منطقی به نظر نمیرسد.
در عوض، این شرکت میتواند با فراهم کردن دسترسی ابری به سختافزارهای خود برای مراکز دانشگاهی و پژوهشی، نرمافزار CANN را در میان کاربران بیشتری رواج دهد.
بیشتر بخوانید: هواوی برای رقابت با انویدیا آماده میشود

















