فهرست مطالب
مدلهای پیشرفته هوش مصنوعی از جمله ChatGPT، جمنای و Claude در آزمون ورودی دانشگاه توکیو، عملکردی فراتر از انسان ثبت کردهاند.
به گزارش سرویس هوش مصنوعی تکناک، در سال ۲۰۲۴ آزمایشهای انجامشده توسط LifePrompt نشان داد که مدل GPT-4 در آزمون ورودی دانشگاه توکیو نهتنها موفق به قبولی نشد، بلکه عملکردی پایینتر از حد نصاب پذیرش ثبت کرد. با وجود این، تنها دو سال بعد، در ژانویه ۲۰۲۶، ChatGPT با عملکردی بینظیر در این آزمون به میانگین ۹۷ درصد در ۱۵ درس مشترک آزمونهای ورودی دست یافت و در ۹ درس نمره کامل را کسب کرد. دادههای جدید آوریل ۲۰۲۶ نیز تداوم این روند صعودی را تایید میکنند. در یکی از مهمترین شاخصهای این ارزیابی، مدل هوش مصنوعی در آزمون رقابتی “Natural Sciences III” دانشگاه توکیو، که مسیر ورود به رشته پزشکی محسوب میشود، موفق شد ۵۰ امتیاز بالاتر از بهترین داوطلب انسانی کسب کند؛ فاصلهای که نشاندهنده عبور از سطح رقابت مستقیم و ورود به یک طبقه عملکردی متفاوت است.
بیشتر بخوانید: جمنای امکان تولید و استخراج مستقیم فایلهای آفیس را فراهم کرد

مرتبط: قرارداد محرمانه گوگل با پنتاگون؛ ارتش آمریکا به قلب هوش مصنوعی رسید
ضعف عملکرد ChatGPT در آزمون تشریحی دانشگاه توکیو
با وجود این، تحلیل نتایج نشان میدهد که این برتری یکنواخت نیست. در حالی که عملکرد ChatGPT در بخشهایی مانند زبان انگلیسی به ۹۰ درصد رسیده، در سوالات تشریحی از جمله تاریخ جهان تنها ۲۵ درصد ثبت شده است. این شکاف میان توانایی در حل مسائل ساختاریافته و ضعف در استدلالهای باز و تفسیری همچنان پابرجا است. نکته قابل توجه آن است که ارزیابی پاسخهای تشریحی توسط معلمان موسسات آموزشی انجام شده و توسط سیستمهای خودکار نبوده است، که خود نشاندهنده تداوم نقش قضاوت انسانی در حوزههایی است که هوش مصنوعی هنوز در آنها به بلوغ کامل نرسیده است. در مجموع، دادهها نشان میدهد که هوش مصنوعی در حوزههای مبتنی بر پاسخهای قطعی مانند ریاضیات، فیزیک، شیمی و علوم رایانه به سطحی فراتر از توان انسانی رسیده است؛ اما در حوزههای نیازمند تحلیل، استدلال و تفسیر، اگرچه فاصله در حال کاهش است، اما هنوز به نقطه تسلط کامل نرسیده است.
مرتبط: ۴ کاربرد جذاب ChatGPT در ارز دیجیتال
نتایج جمنای و Claude
در این مطالعه، Gemini 3 Pro Preview از گوگل و Claude Opus 4.5 از آنتروپیک (به عنوان پیشرفتهترین مدلهای این شرکتها) نیز مورد آزمون قرار گرفتند. نتایج نشان میدهد که گوگل در تمامی مسیرهای آزمون ورودی دانشگاه توکیو عملکردی در سطح برتر ثبت کرده و موفق به کسب سه نمره کامل در بخش ریاضیات شده است. در همین حال، Claude نیز در تمام مسیرهای آزمون از جمله علوم طبیعی ۳ و دانشکده پزشکی دانشگاه کیوتو، بالاتر از حد نصاب قبولی قرار گرفته و در بخش فیزیک، نمره کامل کسب کرده است. این نتایج را نمیتوان به یک عملکرد مقطعی یا «روز خوب یک مدل» نسبت داد؛ بلکه باید آن را نشانهای از یک تحول ساختاری در توانایی مدلهای هوش مصنوعی در عبور از معیارهای سختگیرانه آکادمیک دانست.
برای مطالعه بیشتر: کاهش محبوبیت ChatGPT؛ عرضه اولیه سهام OpenAI در خطر است؟
از منظر کلان، این تغییر زمانی اهمیت بیشتری پیدا میکند که بدانیم سالانه حدود ۵۰۰ هزار داوطلب در آزمونهای ورودی دانشگاههای ژاپن شرکت میکنند و این آزمونها یکی از رقابتیترین نظامهای گزینش آموزشی در جهان محسوب میشوند. بر اساس دادههای موجود، عملکرد ChatGPT در حوزه آزمونها فراتر از تمامی این داوطلبان انسانی بوده است؛ موضوعی که به طور مستقیم ماهیت و کارکرد این آزمونها را زیر سوال میبرد. با وجود این، ساتوشی اندو از LifePrompt تاکید میکند که مدلهای هوش مصنوعی همچنان در پردازش و تحلیل متون ژاپنی برای تولید پاسخهای تشریحی با محدودیت جدی مواجه هستند. بنابراین، پیامدهای آموزشی این تحول پیچیده و چندلایه است و نمیتوان آن را به یک برتری مطلق و بدون استثنا تقلیل داد.

















