فهرست مطالب
شرکت OpenAI با معرفی مدل پیشرفته GPT-6 Astra و آموزش آن روی صدهزار پردازنده گرافیکی انویدیا گام بلندی در مسیر رسیدن به هوش عمومی مصنوعی برداشت.
به گزارش سرویس هوش مصنوعی تکناک، شرکت OpenAI با عرضه مدل GPT-6 Astra، موج جدیدی از هیجان و رقابت در صنعت فناوری را به راه انداخته است. این شرکت که اکنون در کانون توجه جهانی قرار دارد، با معرفی مدل جدید خود، استانداردهای تواناییهای هوش مصنوعی را بازتعریف کرده است. همزمان، ورود Jensen Huang، مدیرعامل NVIDIA، به این بحثها و تایید توانمندیهای جدید OpenAI، نشاندهنده شدت تغییرات در مسیر رسیدن به هوش عمومی مصنوعی یا AGI است.
مدل GPT-6 Astra بر پایه یک زیرساخت عظیم آموزش دیده است. این مدل با استفاده از کلاستر اختصاصی شامل 100,000 GPU آموزش یافته که هزینهی این عملیات سنگین، برآورد شده بین 500 میلیون تا 1 میلیارد دلار است. با در نظر گرفتن هزینههای ساعری پردازش در هر GPU، این رقم میتواند در بازههای زمانی مختلف از 540 میلیون دلار برای ۹۰ روز فعالیت تا بیش از یک میلیارد دلار برای ۱۲۰ روز فعالیت متغیر باشد. انجام این فرآیند در مرکز داده Stargate در Abilene تگزاس، هزینهها را برای OpenAI بهینه نگه داشته است؛ چرا که استفاده از زیرساختهای تأمینکنندگان دیگر مانند CoreWeave، با نرخهای بسیار بالاتر، هزینهها را به شدت افزایش میداد.
فاز بعدی با ۴۰۰ هزار پردازنده گرافیکی
اما این تنها شروع ماجرا نیست. آیندهی OpenAI با پروژهای بسیار بزرگتر از Astra گره خورده است. Jensen Huang اعلام کرده که مرحلهی بعدی، فعالسازی فرآیند آموزشی با استفاده از 400,000 پردازنده گرافیکی خواهد بود. اگر این فرآیند با استفاده از تجهیزات پیشرفتهای نظیر رکهای سرور NVIDIA GB 200 NVL72 انجام شود، نیاز به انرژی برق به شکلی باورنکردنی افزایش مییابد. تخمین زده میشود که OpenAI برای تکمیل این مرحله از آموزش، به حدود 1.2 گیگاوات برق نیاز داشته باشد که نشاندهنده مقیاس عظیم زیرساختهای مورد نیاز برای نسلهای بعدی هوش مصنوعی است.

تفاوت بنیادین GPT-6 Astra با مدلهای پیشین، در نحوه تعامل آن با دنیای نرمافزاری است. برخلاف مدلهای قدیمی که برای هر فعالیت خاص به توسعهدهندگان نیاز داشتند تا APIهای اختصاصی تعریف کنند، Astra به شکلی شبیه به انسان با نرمافزارها تعامل میکند. این مدل میتواند از طریق ایجاد عاملهای هوشمند (Agents)، در مرورگرها، صفحات گسترده، وبسایتها و اپلیکیشنهای دسکتاپ به فعالیت بپردازد. Astra تنها دستورالعمل ارائه نمیدهد، بلکه میتواند جریانهای کاری چند مرحلهای را به طور کامل پیادهسازی کند، اسناد نهایی را تولید کند و ارائههای پیچیده را آماده سازد.
ساختار چندعاملی و مقاومت در برابر خطا
قلب تپنده این مدل، یک موتور استدلال مبتنی بر ساختار چندعاملی (Multi-agent) است. در مواجهه با مسائل پیچیده، عامل اصلی مدل وظیفه سازماندهی را بر عهده میگیرد؛ او نظریهای را برای حل مسئله تدوین کرده و زیرعاملهای مختلف را برای آزمایش فرضیات و تایید نتایج به صورت موازی به کار میگیرد. این ویژگی باعث شده است که مدل در برابر پدیدهی «حلقه مرگ» یا همان گیر کردن در چرخههای تکراری خطا، بسیار مقاوم باشد. در واقع، Astra قادر است به طور خودگردان کدهای خود را عیبیابی کرده و استراتژیهای عملیاتی خود را در لحظه تغییر دهد.
با وجود این پیشرفتهای چشمگیر، بحثهای علمی و فنی همچنان ادامه دارد. بسیاری از متخصصان، تعریف دقیق AGI را به توانایی هوش مصنوعی در درک و ترسیم مدلهای سهبعدی پیوند میدهند. با این حال، منتقدان معتقدند که GPT-6 Astra هنوز در برخی شاخصهای کلیدی از رقبای خود عقبتر است. برای مثال، مدل Fable 5.1 از شرکت Anthropic همچنان در شاخصهای تخصصی مانند SWE-bench Pro، شاخص هوش Artificial Analysis و همچنین در زمینهی اثباتهای ریاضی رسمی (ProofBench v1.1)، عملکرد برتری نسبت به Astra نشان میدهد. به نوشته Wccftech، این رقابت تنگاتنگ نشان میدهد که مسیر رسیدن به هوش عمومی مصنوعی، فراتر از صرفاً افزایش تعداد پردازندهها و قدرت محاسباتی، نیازمند تکامل در ساختارهای استدلالی و دقت در حل مسائل پیچیده است.

















