فهرست مطالب
شرکت OpenAI حالت Ultrafast را برای مدل GPT-5.6 Sol معرفی کرد که با تکیه بر Cerebras میتواند تا ۷۵۰ توکن در ثانیه تولید کند و ۱۴ برابر سریعتر از Standard است.
به گزارش سرویس هوش مصنوعی تکناک، در ژوئن گذشته، زمانی که OpenAI نخستین بار از سری GPT-5.6 رونمایی کرد، این شرکت اعلام کرد که مدل Sol نیز در ژوئیه روی پلتفرم Cerebras راهاندازی خواهد شد و سرعتی تا ۷۵۰ توکن در ثانیه را برای برخی مشتریان منتخب فراهم میکند.
با وجود این، OpenAI در ژوئیه هیچ جزئیاتی درباره اجرای استنتاج مدل Sol روی پلتفرم Cerebras منتشر نکرد. کارکنان OpenAI بعدا در شبکه اجتماعی ایکس تایید کردند که این شرکت پیش از این در حال آزمایش این حالت پرسرعت به صورت خصوصی با مشتریان منتخب بوده است.
شرکت OpenAI امروز به طور رسمی از حالت جدید Ultrafast برای مدل GPT-5.6 Sol رونمایی کرد؛ حالتی که میتواند این مدل پیشرفته را با سرعت حداکثر ۷۵۰ توکن خروجی در ثانیه اجرا کند. این سرعت تا ۱۴ برابر سریعتر از حالت پردازش Standard است، بدون اینکه مدل به نسخه کوچکتر یا کمتوانتر تغییر کند.
01
از 02بیواسطه با معماری Wafer-Scale Engine
این حالت جدید Ultrafast توسط معماری موتور مقیاسویفر (Wafer-Scale Engine) شرکت Cerebras پشتیبانی میشود که از ۴۴ گیگابایت حافظه SRAM روی تراشه استفاده میکند و گلوگاههای جابهجایی داده را کاهش میدهد که معمولا سرعت استنتاج را در سیستمهای مبتنی بر کارت گرافیک محدود میکنند.

بر اساس سرعتهای خروجی گزارششده توسط Artificial Analysis، شرکت Cerebras تاکید کرده است که GPT-5.6 Sol Ultrafast نسبت به مدل Fable 5، حدود ۱۱ برابر و نسبت به Opus 4.8 در حالت Fast پنج برابر سریعتر است. در آزمون Humanity’s Last Exam، مدل Sol Ultrafast تمام ۲۵۰۰ سوال را در ۱۱ ساعت و ۱۱ دقیقه پردازش کرد؛ در حالی که پردازش این سوالات توسط Fable 5 به ۷۸ ساعت و ۲۷ دقیقه زمان نیاز داشت. این در حالی است که هر دو مدل دقتی قابل مقایسه ارائه دادند.
02
از 02کاربردهای کلیدی حالت Ultrafast مدل GPT-5.6 Sol
شرکت OpenAI در پست وبلاگی خود اشاره کرد که حالت جدید Ultrafast برای پاسخدهی به حوادث، تحقیقات مالی، پشتیبانی مشتریان در لحظه و کاربردهای صوتی، تجارت الکترونیک، برنامهنویسی و گردشکارهای پژوهشی مناسب است. در داخل این شرکت نیز توسعهدهندگان OpenAI از این حالت برای تحلیل لاگها و دادههای ردیابی در جریان حوادث و اجرای سریعتر تکرارهای پژوهشی استفاده میکنند.
براساس گزارش نئووین، از آنجا که ظرفیت Cerebras در دسترس OpenAI محدود است، این شرکت مشتریان را بر اساس تناسب گردشکار و در دسترس بودن ظرفیت ارزیابی خواهد کرد تا دسترسی به حالت Ultrafast را اعطا کند. مشتریان علاقهمند میتوانند فرم مربوطه را تکمیل کنند تا زمانی که این حالت به صورت گسترده در دسترس قرار گرفت، از آن مطلع شوند.

















