• صفحه اصلی
  • همه اخبار
  • تبلیغات تکناک
  • درباره ما
  • تماس با ما
اخبار تکنولوژی روز جهان و ایران
  • فناوری
    • اخبار هوش مصنوعی
    • رباتیک
    • اینترنت و شبکه
    • شبکه های اجتماعی
    • هوافضا
    • معماری
    • ورزش
    • رویداد ها
    • دوربین دیجیتال
  • کامپیوتر و موبایل
    • موبایل و تبلت
    • لپ تاپ و کامپیوتر
    • اپلیکیشن موبایل
    • نرم افزار
    • سخت افزار
    • ساعت هوشمند
    • مانیتور
    • اسپیکر و هدفون
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
  • نقد و بررسی
    • بررسی موبایل و تبلت
    • کنسول بازی
    • بررسی لپ تاپ و کامپیوتر
    • قطعات کامپیوتر
    • نرم افزار
    • بررسی اسپیکر و هدفون
    • بررسی ساعت هوشمند
  • آموزش
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
    • آموزش هوش مصنوعی
    • سخت افزار
  • اخبار ارز دیجیتال
    • قیمت لحظه ای ارز دیجیتال
    • ماشین حساب ارز دیجیتال
    • آموزش ارز دیجیتال
  • علمی
    • سلامت و پزشکی
    • انرژی
    • فیزیک
    • شیمی
    • نجوم
    • ورزش
    • محیط زیست
    • باستان شناسی
  • کسب و کار
    • شرکت ها
    • بورس
    • مدیریت(پروژه، کسب و کار، منابع انسانی)
    • استارتاپ ها
    • دولت الکترونیک
    • رویداد کسب و کار
  • وسائل نقلیه
    • خودرو
    • دوچرخه
    • موتور سیکلت
    • قطار
    • هواپیما
  • بازی و سرگرمی
    • کنسول بازی های کامپیوتری
    • بازی های کامپیوتر
    • بازی کنسول
    • بازی موبایل
    • فیلم و سریال
  • چند رسانه ای
    • عکس
    • ویدئو
  • اخبار داخلی
    • دانش بنیان
    • دولت الکترونیک
    • رویداد داخلی
    • بازار
    • دانشگاه
No Result
مشاهده تمامی نتایج
اخبار تکنولوژی روز جهان و ایران
  • فناوری
    • اخبار هوش مصنوعی
    • رباتیک
    • اینترنت و شبکه
    • شبکه های اجتماعی
    • هوافضا
    • معماری
    • ورزش
    • رویداد ها
    • دوربین دیجیتال
  • کامپیوتر و موبایل
    • موبایل و تبلت
    • لپ تاپ و کامپیوتر
    • اپلیکیشن موبایل
    • نرم افزار
    • سخت افزار
    • ساعت هوشمند
    • مانیتور
    • اسپیکر و هدفون
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
  • نقد و بررسی
    • بررسی موبایل و تبلت
    • کنسول بازی
    • بررسی لپ تاپ و کامپیوتر
    • قطعات کامپیوتر
    • نرم افزار
    • بررسی اسپیکر و هدفون
    • بررسی ساعت هوشمند
  • آموزش
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
    • آموزش هوش مصنوعی
    • سخت افزار
  • اخبار ارز دیجیتال
    • قیمت لحظه ای ارز دیجیتال
    • ماشین حساب ارز دیجیتال
    • آموزش ارز دیجیتال
  • علمی
    • سلامت و پزشکی
    • انرژی
    • فیزیک
    • شیمی
    • نجوم
    • ورزش
    • محیط زیست
    • باستان شناسی
  • کسب و کار
    • شرکت ها
    • بورس
    • مدیریت(پروژه، کسب و کار، منابع انسانی)
    • استارتاپ ها
    • دولت الکترونیک
    • رویداد کسب و کار
  • وسائل نقلیه
    • خودرو
    • دوچرخه
    • موتور سیکلت
    • قطار
    • هواپیما
  • بازی و سرگرمی
    • کنسول بازی های کامپیوتری
    • بازی های کامپیوتر
    • بازی کنسول
    • بازی موبایل
    • فیلم و سریال
  • چند رسانه ای
    • عکس
    • ویدئو
  • اخبار داخلی
    • دانش بنیان
    • دولت الکترونیک
    • رویداد داخلی
    • بازار
    • دانشگاه
No Result
مشاهده تمامی نتایج
اخبار تکنولوژی روز جهان و ایران
تک ناک فناوری اخبار هوش مصنوعی

پاسخ محققان به پژوهش جنجالی اپل: ایراد از ارزیابی است نه هوش مصنوعی

سید محمد برازنده نوشته شده توسط سید محمد برازنده
دوشنبه 26 خرداد 1404 - 10:05
در اخبار هوش مصنوعی, فناوری
پاسخ محققان به پژوهش جنجالی اپل: ایراد از ارزیابی است نه هوش مصنوعی
کپی لینکاشتراک گذاری در تلگراماشتراک گذاری در توییتر

محققان در پاسخ به نتایج مقاله پر سر و صدای اپل درباره ناتوانی مدل‌های هوش مصنوعی در حل مسائل پیچیده گفتند که مشکل از نقص‌های ارزیابی است و ارتباطی با هوش مصنوعی ندارد.

به گزارش تک‌ناک، مقاله اخیر اپل با عنوان «توهم تفکر» (The Illusion of Thinking) که به بررسی توانایی مدل‌های بزرگ استدلالی (LRM) در حل مسائل پیچیده پرداخته بود، بازتاب گسترده‌ای در میان پژوهشگران هوش مصنوعی داشت. اپل در این مقاله به صراحت نتیجه گرفته بود که حتی پیشرفته‌ترین مدل‌ها نیز در مواجهه با وظایف پیچیده دچار فروپاشی می‌شوند. اما همه این تحلیل را قبول ندارند.

الکس لاوسن، پژوهشگر بنیاد Open Philanthropy روز گذشته، مقاله‌ای تحلیلی منتشر کرد که بسیاری از یافته‌های بحث‌برانگیز اپل را ناشی از ضعف در طراحی آزمایش‌ها دانسته است. این مقاله با همکاری مدل هوش مصنوعی کلود اوپوس (Claude Opus) از شرکت Anthropic نوشته شده است.

لاوسن در مقاله خود با عنوان «توهمِ توهم تفکر» به این موضوع پرداخته است که اگرچه مدل‌های فعلی در حل پازل‌های پیچیده برنامه‌ریزی دچار چالش می‌شوند، اما اپل در تفسیر نتایج، میان محدودیت‌های خروجی عملی و نقص‌های طراحی ارزیابی با شکست واقعی در استدلال خلط کرده است.

پاسخ محققان به مقاله اپل: ایراد از ارزیابی است و ارتباطی با هوش مصنوعی ندارد

او سه ایراد اصلی را به روش اپل وارد می‌داند:

  • نادیده گرفتن محدودیت‌های توکن خروجی:

شرکت اپل مدعی است که مدل‌ها در پازل‌هایی مانند برج هانوی با ۸ دیسک یا بیشتر دچار فروپاشی می‌شوند، اما لاوسن می‌گوید که مدل‌هایی مانند Claude در این موارد به سقف ظرفیت توکن‌های خروجی خود رسیده‌اند. به گفته او، خروجی‌های واقعی مدل‌ها به صراحت اشاره می‌کنند: «الگو ادامه دارد، اما برای صرفه‌جویی در توکن‌ها متوقف می‌شوم.»

  • شمارش پازل‌های غیرقابل حل به عنوان شکست:

به گفته لاوسن، در آزمون عبور از رودخانه اپل، نمونه‌هایی از پازل‌ها گنجانده شده بود که اصولاً غیرقابل حل بودند (برای مثال، بیش از ۶ جفت کاراکتر با قایقی که ظرفیت عبور همه را نداشت). مدل‌ها به دلیل تشخیص این موضوع و عدم تلاش برای حل آنها، نمره منفی گرفته‌اند.

  • عدم تمایز میان شکست استدلالی و محدودیت خروجی:

شرکت اپل از اسکریپت‌های ارزیابی خودکاری استفاده کرده است، که تنها پاسخ‌هایی با فهرست کامل حرکات را به عنوان موفقیت تلقی کرده‌اند. به همین دلیل، خروجی‌های جزئی یا استراتژیک به عنوان شکست کامل ثبت شده‌اند.

لاوسن برای اثبات ادعای خود، بخشی از آزمون‌های برج هانوی را به شیوه‌ای متفاوت بازآزمایی کرده است: به جای فهرست کامل حرکات، از مدل‌ها خواسته است یک تابع بازگشتی به زبان Lua بنویسند که راه‌حل را تولید کند. نتیجه؟ مدل‌هایی مانند Claude، Gemini و o3 از OpenAI بدون مشکل توانستند راه‌حل الگوریتمی صحیح برای پازل‌هایی با ۱۵ دیسک ارائه دهند؛ یعنی به‌مراتب فراتر از پیچیدگی‌ که اپل در آن موفقیتی گزارش نکرده بود.

لاوسن نتیجه‌گیری می‌کند: «زمانی که محدودیت‌های مصنوعی خروجی را حذف می‌کنیم، مدل‌های زبانی بزرگ توان استدلال درباره وظایف پیچیده را دارند؛ حداقل در زمینه تولید الگوریتم به این صورت است.»

اهمیت این جدال علمی درباره هوش مصنوعی

در نگاه نخست، این بحث شاید مانند اختلافات معمول در تحقیقات هوش مصنوعی به نظر برسد، اما اهمیت آن بیش از این است. مقاله اپل بارها به عنوان شاهدی بر این ادعا مطرح شده است که مدل‌های زبانی کنونی فاقد توانایی استدلال مقیاس‌پذیر هستند. اما لاوسن نشان می‌دهد که واقعیت می‌تواند پیچیده‌تر باشد: بله، مدل‌ها در شمارش طولانی توکن‌ها مشکل دارند، اما موتورهای استدلالی‌ آنها به اندازه‌ای شکننده نیست که مقاله اپل القا می‌کند.

البته این به معنای رفع مسئولیت از مدل‌ها نیست. حتی لاوسن اذعان می‌کند که تعمیم الگوریتم در عمل همچنان یک چالش است و نتایج آزمایش‌های او فعلا مقدماتی به حساب می‌آیند. او همچنین پیشنهادهایی برای تحقیقات آینده مطرح کرده است:

  • طراحی آزمون‌هایی که تفاوت میان توان استدلال و محدودیت خروجی را نشان دهد.
  • از قابل حل بودن پازل‌ها پیش از ارزیابی عملکرد مدل اطمینان حاصل شود.
  • از سنجه‌های پیچیدگی که دشواری محاسباتی را نشان دهد نه صرفاً طول راه‌حل را استفاده شود.
  • اشکال مختلف ارائه پاسخ برای تفکیک درک الگوریتمی از اجرای آن در نظر گرفته شود.

به گفته لاوسن، پرسش اصلی این نیست که آیا مدل‌های زبانی بزرگ می‌توانند استدلال کنند یا خیر؛ بلکه این است که آیا روش‌های ارزیابی ما می‌توانند تفاوت میان استدلال واقعی و صرفاً تایپ کردن خروجی را نشان دهند یا خیر.

سید محمد برازنده

سید محمد برازنده

مطالب مرتبط

ترکیه از موشک بالستیک هفت تنی «تایفون بلاک ۴» رونمایی کرد
پیشنهاد سردبیر

ترکیه از موشک بالستیک هفت تنی «تایفون بلاک 4» رونمایی کرد

نوشته شده توسط نرگس چالوک
11 مرداد 1404
کنترل از راه دور و نظارت بر وضعیت زخم بدون برداشتن پانسمان با دستگاهی نوآورانه
سلامت و پزشکی

این دستگاه نظارت بر وضعیت زخم بدون برداشتن پانسمان را آسان می کند

نوشته شده توسط ساینا چمنی
11 مرداد 1404
متا بزرگ‌ترین خوشه هوش مصنوعی جهان را می‌ سازد
اخبار هوش مصنوعی

متا بزرگ‌ترین خوشه هوش مصنوعی جهان را می‌ سازد

نوشته شده توسط امیرحسین یونس
11 مرداد 1404
این مدل هوش مصنوعی جدید سکته مغزی را سریع‌ و دقیق‌ تشخیص می‌ دهد
سلامت و پزشکی

این مدل هوش مصنوعی سکته مغزی را به سرعت تشخیص می‌ دهد

نوشته شده توسط ساینا چمنی
11 مرداد 1404
جدال دوباره مدیران انویدیا و آنتروپیک بر سر آینده هوش مصنوعی
اخبار هوش مصنوعی

جدال دوباره مدیران انویدیا و آنتروپیک بر سر آینده هوش مصنوعی

نوشته شده توسط امیرحسین یونس
11 مرداد 1404
خبر بعدی
چگونه در زمان جنگ آرامش روانی خود را حفظ کنیم؟

چگونه در زمان جنگ آرامش روانی خود را حفظ کنیم؟

دیدگاهتان را بنویسید لغو پاسخ

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

آذرآنلاین آذرآنلاین آذرآنلاین

پیشنهادی

رویداد گلکسی آنپکد

مشخصات رسمی محصولات سامسونگ در رویداد گلکسی آنپکد فاش شد

17 تیر 1404
عرضه HyperOS 3 برای ۱۰ دستگاه اولویت‌دار شیائومی از سپتامبر آغاز می‌شود

رابط کاربری HyperOS 3 برای این گوشی‌های شیائومی منتشر خواهد شد

8 مرداد 1404

داغ‌ترین‌های روز

گوشی های پوکو

بهترین گوشی های پوکو در بازار ایران (تابستان 1404)

10 مرداد 1404
موشک خرمشهر ۵؛ پاسخ ایران به رقابت‌های تسلیحاتی مدرن

موشک خرمشهر ۵؛ پاسخ ایران به رقابت‌های تسلیحاتی مدرن

5 مرداد 1404
ترکیه از قدرتمندترین بمب غیرهسته‌ای جهان رونمایی کرد

ترکیه از قدرتمندترین بمب غیرهسته‌ای جهان رونمایی کرد

9 مرداد 1404
بهترین اپلیکیشن‌های مسیریابی ایرانی و خارجی

بهترین اپلیکیشن‌های مسیریابی ایرانی و خارجی

10 مرداد 1404
گوشی FOSSiBOT F107 Pro

اولین گوشی هوشمند مجهز به قابلیت دید در شب رنگی دنیا معرفی شد

8 مرداد 1404
تک ناک - اخبار تکنولوژی روز جهان و ایران

دنیا با سرعتی خیره کننده به سمت تحقق رویاهایی می رود که تا دیروز دست نیافتنی و محال بود و بشر با گذر از دریایی از موانع یک به یک در حال تحقق آنها است.

ما در” تک ناک” تلاش می کنیم سهمی از انعکاس تحولات بی شمار فناوری و اخبار تکنولوژی داشته باشیم و در این کهکشان بی انتهای یافته های علمی و دانش محور محتوایی قابل اتکاء و اخباری موثق را از گوشه و کنار دنیا در اختیار علاقمندان و مخاطبان خود قرار دهیم.

ما را در شبکه های اجتماعی دنبال کنید

تازه‌ها

چگونگی تکامل سیب زمینی امروزی از گوجه ‌فرنگی در ۹ میلیون سال قبل

چگونگی تکامل سیب زمینی امروزی از گوجه ‌فرنگی در ۹ میلیون سال قبل

11 مرداد 1404
سقوط قیمت ریپل (XRP) به زیر ۳ دلار؛ اصلاح عمیق‌تر در راه است؟

سقوط قیمت ریپل (XRP) به زیر ۳ دلار؛ اصلاح عمیق‌تر در راه است؟

11 مرداد 1404
سقوط ۱۲ درصدی قیمت سولانا در این هفته؛ آیا بازگشت به سطح ۱۲۷ دلار نزدیک است؟

سقوط ۱۲ درصدی قیمت سولانا در این هفته؛ آیا بازگشت به سطح ۱۲۷ دلار نزدیک است؟

11 مرداد 1404
تولد شگفت‌انگیز نوزاد در آمریکا از جنینی که ۳۱ سال منجمد بود

تولد شگفت‌انگیز نوزاد آمریکایی از جنین 31 ساله منجمد

11 مرداد 1404

دسترسی سریع

  • فناوری
  • کامپیوتر و موبایل
  • نقد و بررسی
  • آموزش
  • ارز دیجیتال
  • علمی
  • کسب و کار
  • وسائل نقلیه
  • بازی و سرگرمی
  • چند رسانه ای
  • صفحه اصلی
  • همه اخبار
  • تبلیغات تکناک
  • درباره ما
  • تماس با ما

© Copyright 2025 Technoc.ir

technoc-instagram
No Result
مشاهده تمامی نتایج
  • فناوری
    • اخبار هوش مصنوعی
    • رباتیک
    • اینترنت و شبکه
    • شبکه های اجتماعی
    • هوافضا
    • معماری
    • ورزش
    • رویداد ها
    • دوربین دیجیتال
  • کامپیوتر و موبایل
    • موبایل و تبلت
    • لپ تاپ و کامپیوتر
    • اپلیکیشن موبایل
    • نرم افزار
    • سخت افزار
    • ساعت هوشمند
    • مانیتور
    • اسپیکر و هدفون
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
  • نقد و بررسی
    • بررسی موبایل و تبلت
    • کنسول بازی
    • بررسی لپ تاپ و کامپیوتر
    • قطعات کامپیوتر
    • نرم افزار
    • بررسی اسپیکر و هدفون
    • بررسی ساعت هوشمند
  • آموزش
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
    • آموزش هوش مصنوعی
    • سخت افزار
  • اخبار ارز دیجیتال
    • قیمت لحظه ای ارز دیجیتال
    • ماشین حساب ارز دیجیتال
    • آموزش ارز دیجیتال
  • علمی
    • سلامت و پزشکی
    • انرژی
    • فیزیک
    • شیمی
    • نجوم
    • ورزش
    • محیط زیست
    • باستان شناسی
  • کسب و کار
    • شرکت ها
    • بورس
    • مدیریت(پروژه، کسب و کار، منابع انسانی)
    • استارتاپ ها
    • دولت الکترونیک
    • رویداد کسب و کار
  • وسائل نقلیه
    • خودرو
    • دوچرخه
    • موتور سیکلت
    • قطار
    • هواپیما
  • بازی و سرگرمی
    • کنسول بازی های کامپیوتری
    • بازی های کامپیوتر
    • بازی کنسول
    • بازی موبایل
    • فیلم و سریال
  • چند رسانه ای
    • عکس
    • ویدئو
  • اخبار داخلی
    • دانش بنیان
    • دولت الکترونیک
    • رویداد داخلی
    • بازار
    • دانشگاه

© Copyright 2025 Technoc.ir