فهرست مطالب
مدل صوتی Grok Voice Think Fast 2.0 شرکت xAI با کسب رتبه اول در بنچمارک τ-voice Bench، مدلهای رقیب از OpenAI و گوگل را پشت سر گذاشته است.
به گزارش سرویس هوش مصنوعی تکناک، این مدل که در ۲۹ ژوئیه ۲۰۲۶ عرضه شد، بالاترین امتیاز عملکرد عاملمحور را در بنچمارک τ-voice Bench ثبت کرده و ایلان ماسک نیز با انتشار پستی در X به این موفقیت اشاره کرده است.
بیشتر بخوانید: خبر خوش برای برنامهنویسان؛ قیمت مدل GPT-5.6 Sol کمتر میشود
این رتبه دقیقا چه چیزی را اندازهگیری میکند؟
مدل صوتی Grok Voice Think Fast 2.0 در بخش Agentic Performance بنچمارک τ-voice Bench موفق به کسب امتیاز ۵۶.۵ درصد شده است؛ معیاری که توانایی یک مدل صوتی را برای مدیریت فرایندهای چندمرحلهای، استفاده از ابزارها و اجرای دستورات پیچیده ارزیابی میکند. برخلاف آزمونهای معمول کیفیت صدا یا سرعت تشخیص گفتار، این بنچمارک بررسی میکند که یک دستیار صوتی تا چه حد میتواند وظایف واقعی مانند رزرو خدمات، دریافت دادههای لحظهای و تعامل میان چند اپلیکیشن را انجام دهد.

خبر پیشنهادی: پرپلکسیتی مدل هوش مصنوعی محلی Portable Computer را معرفی کرد
در همین معیار، GPT-Realtime-2.1 از OpenAI با امتیاز ۴۵.۷ درصد و Gemini 3.1 Flash Live از گوگل با امتیاز ۳۷.۷ درصد در رتبههای بعدی قرار گرفتهاند. برتری Grok نسبت به این دو مدل به ترتیب حدود ۱۱ و ۱۹ واحد درصد است؛ اختلافی که نشاندهنده فاصله قابل توجه در توانایی اجرای وظایف عاملمحور است. با وجود این، عملکرد Grok در همه حوزهها صدرنشین نیست. در شاخص کیفیت گفتار به گفتار Artificial Analysis، این مدل با امتیاز ۸۲.۹ درصد در رتبه دوم قرار دارد و اندکی پایینتر از Qwen Audio 3.0 Realtime Plus شرکت علیبابا با امتیاز ۸۴.۱ درصد است.
برای مطالعه بیشتر: گوگل در حال آزمایش تغییرات کاربردی جدید در جمنای است + تصویر
پیشرفت مدل صوتی Grok Voice Think Fast 2.0
این مدل نسبت به نسل قبل خود نیز پیشرفت چشمگیری داشته است. کیفیت کلی گفتار به گفتار از ۷۵.۷ درصد به ۸۲.۹ درصد افزایش یافته، زمان شروع پاسخ صوتی از ۱.۲۵ ثانیه به ۰.۷۰ ثانیه کاهش پیدا کرده و این مدل را به یکی از سریعترین سیستمهای صوتی موجود تبدیل کرده است. کاهش تاخیر به کمتر از یک ثانیه اهمیت ویژهای دارد، چرا که در تعاملات صوتی، حتی چند صد میلیثانیه میتواند مرز میان یک مکالمه طبیعی و تجربهای مصنوعی باشد. حفظ تواناییهای عاملمحور در کنار پاسخدهی سریع، یکی از دشوارترین چالشهای توسعه دستیارهای صوتی هوشمند محسوب میشود. از نظر اکوسیستم تسلا نیز اگرچه این پیشرفت هنوز به معنای تغییر فوری در خودروها نیست، اما مسیر توسعه Grok میتواند زمینهساز ادغام عمیقتر این دستیار هوش مصنوعی با محصولات تسلا باشد. دستیار صوتی که قادر به اجرای وظایف پیچیده و چندمرحلهای باشد، میتواند نقش یک کمکراننده هوشمند واقعی را ایفا کند.

















