دو شرکت گوگل و انویدیا با یکدیگر همکاری کردهاند تا دسترسی کاربران به حداکثر یک میلیون GPU انویدیا را برای اجرای نمونههای تازه معرفیشده A5X فراهم کنند.
به گزارش سرویس سخت افزار تکناک، این اعلامیه بخشی از همکاری جدید گوگل و انویدیا برای کاهش هزینههای استنتاج و افزایش سرعت پردازش توکن است. سیستم A5X بر پایه شتابدهندههای شبکهای انویدیا ساخته شده است که امکان ایجاد زیرساختهای محاسباتی تکخوشهای و چندخوشهای مخصوص پردازش بارهای هوش مصنوعی را فراهم میکنند.
نمونههای A5X جدیدترین محصولات گوگل هستند که بهطور ویژه برای اجرای بارهای پردازشی هوش مصنوعی عاملمحور طراحی شدهاند. این نمونهها بخشی از مجموعه AI Hypercomputer گوگل هستند؛ پلتفرمی که موتور مدل Gemini و دیگر سرویسهای هوش مصنوعی مصرفی و سازمانی این شرکت را نیز تامین میکند. در جریان آخرین سری از اعلامیهها، گوگل مجموعهای از ارتقاها برای Hypercomputer معرفی کرد که شامل ماشینهای مجازی جدید با پردازندههای اختصاصی مبتنی بر Arm، نسل هشتم پردازندههای تنسور، پشتیبانی بومی PyTorch برای TPUها و نمونههای A5X است.
این قابلیتهای تازه، به طور خاص برای هدفگیری بارهای هوش مصنوعی عاملمحور طراحی شدهاند؛ بارهایی که بر مجموعهای از ایجنتهای هوش مصنوعی تکیه دارند تا مسائل را به صورت بخشبندیشده و مرحلهای حل کنند. نمونههای A5X نخستین محصولات گوگل هستند که برای کار با جدیدترین GPUهای هوش مصنوعی انویدیا با نام Vera Rubin ساخته شدهاند.

بر اساس جزئیات منتشرشده، A5X از کارتهای شبکه ConnectX-9 انویدیا استفاده میکند؛ کارتهایی که برای شتابدهی بارهای هوش مصنوعی در زیرساختهای ابری مبتنی بر اترنت طراحی شدهاند. این کارتها در کنار پلتفرم Virgo گوگل، به کاربران اجازه میدهند تا به ۸۰ هزار GPU روبین در یک خوشه واحد و ۹۶۰ هزار GPU در یک خوشه چندسایتی دسترسی داشته باشند.
| بخش | مشخصات |
|---|---|
| حداکثر ظرفیت یک خوشه در یک دیتاسنتر (انویدیا Vera Rubin) | ۸۰٬۰۰۰ |
| حداکثر ظرفیت در خوشه چندسایتی (انویدیا Vera Rubin) | ۹۶۰٬۰۰۰ |
| GPUهای انویدیا Vera Rubin | ۸۰٬۰۰۰ تا ۹۶۰٬۰۰۰ بر اساس مقیاس خوشه |
| TPUهای اختصاصی گوگل – ظرفیت یک خوشه | ۱۳۴٬۰۰۰ |
| TPUهای اختصاصی گوگل – ظرفیت چندسایتی | بیش از ۱٬۰۰۰٬۰۰۰ |
| زیرساخت شبکه | کارتهای ConnectX‑9 انویدیا؛ پلتفرم شبکه Virgo گوگل |
پلتفرم Virgo گوگل امکان اتصال چندین تراشه هوش مصنوعی را در یک دیتاسنتر فراهم میکند. این پلتفرم علاوه بر پشتیبانی از GPUهای روبین انویدیا با TPUهای گوگل نیز سازگار است. Virgo میتواند تا ۱۳۴ هزار TPU را در یک دیتاسنتر و بیش از یک میلیون تراشه را در چند سایت به یکدیگر متصل کند. طبق اعلام انویدیا، نمونههای A5X قادر هستند هزینه استنتاج بهازای هر توکن را تا ۱۰ برابر کاهش دهند و بهرهوری انرژی بهازای هر مگاوات را تا ۱۰ برابر نسبت به نسل قبلی افزایش دهند.
بر اساس گزارش Wccftech، همچنین انویدیا اشاره کوتاهی به حوزههای «هوش مصنوعی فیزیکی و صنعتی» دارد و اعلام میکند که محصولات شرکتهایی مانند Cadence و Siemens از طریق زیرساخت این شرکت پشتیبانی میشوند و بر بستر Google Cloud در دسترس هستند. این شرکت اضافه میکند که پلتفرم Gemini گوگل نیز قادر است مدلها و گردشکارهای عاملمحور را در صنایع مختلف از جمله امنیت سایبری پیادهسازی کند.

















