• صفحه اصلی
  • همه اخبار
  • تبلیغات تکناک
  • درباره ما
  • تماس با ما
اخبار تکنولوژی روز جهان و ایران
  • فناوری
    • اخبار هوش مصنوعی
    • رباتیک
    • اینترنت و شبکه
    • شبکه های اجتماعی
    • هوافضا
    • معماری
    • ورزش
    • رویداد ها
    • دوربین دیجیتال
  • کامپیوتر و موبایل
    • موبایل و تبلت
    • لپ تاپ و کامپیوتر
    • اپلیکیشن موبایل
    • نرم افزار
    • سخت افزار
    • ساعت هوشمند
    • مانیتور
    • اسپیکر و هدفون
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
  • نقد و بررسی
    • بررسی موبایل و تبلت
    • کنسول بازی
    • بررسی لپ تاپ و کامپیوتر
    • قطعات کامپیوتر
    • نرم افزار
    • بررسی اسپیکر و هدفون
    • بررسی ساعت هوشمند
  • آموزش
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
    • آموزش هوش مصنوعی
    • سخت افزار
  • اخبار ارز دیجیتال
    • قیمت لحظه ای ارز دیجیتال
    • ماشین حساب ارز دیجیتال
    • آموزش ارز دیجیتال
  • علمی
    • سلامت و پزشکی
    • انرژی
    • فیزیک
    • شیمی
    • نجوم
    • ورزش
    • محیط زیست
    • باستان شناسی
  • کسب و کار
    • شرکت ها
    • بورس
    • مدیریت(پروژه، کسب و کار، منابع انسانی)
    • استارتاپ ها
    • دولت الکترونیک
    • رویداد کسب و کار
  • وسائل نقلیه
    • خودرو
    • دوچرخه
    • موتور سیکلت
    • قطار
    • هواپیما
  • بازی و سرگرمی
    • کنسول بازی های کامپیوتری
    • بازی های کامپیوتر
    • بازی کنسول
    • بازی موبایل
    • فیلم و سریال
  • چند رسانه ای
    • عکس
    • ویدئو
  • اخبار داخلی
    • دانش بنیان
    • دولت الکترونیک
    • رویداد داخلی
    • بازار
    • دانشگاه
No Result
مشاهده تمامی نتایج
اخبار تکنولوژی روز جهان و ایران
  • فناوری
    • اخبار هوش مصنوعی
    • رباتیک
    • اینترنت و شبکه
    • شبکه های اجتماعی
    • هوافضا
    • معماری
    • ورزش
    • رویداد ها
    • دوربین دیجیتال
  • کامپیوتر و موبایل
    • موبایل و تبلت
    • لپ تاپ و کامپیوتر
    • اپلیکیشن موبایل
    • نرم افزار
    • سخت افزار
    • ساعت هوشمند
    • مانیتور
    • اسپیکر و هدفون
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
  • نقد و بررسی
    • بررسی موبایل و تبلت
    • کنسول بازی
    • بررسی لپ تاپ و کامپیوتر
    • قطعات کامپیوتر
    • نرم افزار
    • بررسی اسپیکر و هدفون
    • بررسی ساعت هوشمند
  • آموزش
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
    • آموزش هوش مصنوعی
    • سخت افزار
  • اخبار ارز دیجیتال
    • قیمت لحظه ای ارز دیجیتال
    • ماشین حساب ارز دیجیتال
    • آموزش ارز دیجیتال
  • علمی
    • سلامت و پزشکی
    • انرژی
    • فیزیک
    • شیمی
    • نجوم
    • ورزش
    • محیط زیست
    • باستان شناسی
  • کسب و کار
    • شرکت ها
    • بورس
    • مدیریت(پروژه، کسب و کار، منابع انسانی)
    • استارتاپ ها
    • دولت الکترونیک
    • رویداد کسب و کار
  • وسائل نقلیه
    • خودرو
    • دوچرخه
    • موتور سیکلت
    • قطار
    • هواپیما
  • بازی و سرگرمی
    • کنسول بازی های کامپیوتری
    • بازی های کامپیوتر
    • بازی کنسول
    • بازی موبایل
    • فیلم و سریال
  • چند رسانه ای
    • عکس
    • ویدئو
  • اخبار داخلی
    • دانش بنیان
    • دولت الکترونیک
    • رویداد داخلی
    • بازار
    • دانشگاه
No Result
مشاهده تمامی نتایج
اخبار تکنولوژی روز جهان و ایران

تک ناک » فناوری » پاسخ محققان به پژوهش جنجالی اپل: ایراد از ارزیابی است نه هوش مصنوعی

پاسخ محققان به پژوهش جنجالی اپل: ایراد از ارزیابی است نه هوش مصنوعی

سید محمد برازنده نوشته شده توسط سید محمد برازنده
دوشنبه 26 خرداد 1404 - 10:05
در اخبار هوش مصنوعی, فناوری
پاسخ محققان به پژوهش جنجالی اپل: ایراد از ارزیابی است نه هوش مصنوعی
کپی لینکاشتراک گذاری در تلگراماشتراک گذاری در توییتر

فهرست مطالب

  • 1. اهمیت این جدال علمی درباره هوش مصنوعی

محققان در پاسخ به نتایج مقاله پر سر و صدای اپل درباره ناتوانی مدل‌های هوش مصنوعی در حل مسائل پیچیده گفتند که مشکل از نقص‌های ارزیابی است و ارتباطی با هوش مصنوعی ندارد.

به گزارش تک‌ناک، مقاله اخیر اپل با عنوان «توهم تفکر» (The Illusion of Thinking) که به بررسی توانایی مدل‌های بزرگ استدلالی (LRM) در حل مسائل پیچیده پرداخته بود، بازتاب گسترده‌ای در میان پژوهشگران هوش مصنوعی داشت. اپل در این مقاله به صراحت نتیجه گرفته بود که حتی پیشرفته‌ترین مدل‌ها نیز در مواجهه با وظایف پیچیده دچار فروپاشی می‌شوند. اما همه این تحلیل را قبول ندارند.

الکس لاوسن، پژوهشگر بنیاد Open Philanthropy روز گذشته، مقاله‌ای تحلیلی منتشر کرد که بسیاری از یافته‌های بحث‌برانگیز اپل را ناشی از ضعف در طراحی آزمایش‌ها دانسته است. این مقاله با همکاری مدل هوش مصنوعی کلود اوپوس (Claude Opus) از شرکت Anthropic نوشته شده است.

لاوسن در مقاله خود با عنوان «توهمِ توهم تفکر» به این موضوع پرداخته است که اگرچه مدل‌های فعلی در حل پازل‌های پیچیده برنامه‌ریزی دچار چالش می‌شوند، اما اپل در تفسیر نتایج، میان محدودیت‌های خروجی عملی و نقص‌های طراحی ارزیابی با شکست واقعی در استدلال خلط کرده است.

پاسخ محققان به مقاله اپل: ایراد از ارزیابی است و ارتباطی با هوش مصنوعی ندارد

او سه ایراد اصلی را به روش اپل وارد می‌داند:

  • نادیده گرفتن محدودیت‌های توکن خروجی:

شرکت اپل مدعی است که مدل‌ها در پازل‌هایی مانند برج هانوی با ۸ دیسک یا بیشتر دچار فروپاشی می‌شوند، اما لاوسن می‌گوید که مدل‌هایی مانند Claude در این موارد به سقف ظرفیت توکن‌های خروجی خود رسیده‌اند. به گفته او، خروجی‌های واقعی مدل‌ها به صراحت اشاره می‌کنند: «الگو ادامه دارد، اما برای صرفه‌جویی در توکن‌ها متوقف می‌شوم.»

  • شمارش پازل‌های غیرقابل حل به عنوان شکست:

به گفته لاوسن، در آزمون عبور از رودخانه اپل، نمونه‌هایی از پازل‌ها گنجانده شده بود که اصولاً غیرقابل حل بودند (برای مثال، بیش از ۶ جفت کاراکتر با قایقی که ظرفیت عبور همه را نداشت). مدل‌ها به دلیل تشخیص این موضوع و عدم تلاش برای حل آنها، نمره منفی گرفته‌اند.

  • عدم تمایز میان شکست استدلالی و محدودیت خروجی:

شرکت اپل از اسکریپت‌های ارزیابی خودکاری استفاده کرده است، که تنها پاسخ‌هایی با فهرست کامل حرکات را به عنوان موفقیت تلقی کرده‌اند. به همین دلیل، خروجی‌های جزئی یا استراتژیک به عنوان شکست کامل ثبت شده‌اند.

لاوسن برای اثبات ادعای خود، بخشی از آزمون‌های برج هانوی را به شیوه‌ای متفاوت بازآزمایی کرده است: به جای فهرست کامل حرکات، از مدل‌ها خواسته است یک تابع بازگشتی به زبان Lua بنویسند که راه‌حل را تولید کند. نتیجه؟ مدل‌هایی مانند Claude، Gemini و o3 از OpenAI بدون مشکل توانستند راه‌حل الگوریتمی صحیح برای پازل‌هایی با ۱۵ دیسک ارائه دهند؛ یعنی به‌مراتب فراتر از پیچیدگی‌ که اپل در آن موفقیتی گزارش نکرده بود.

لاوسن نتیجه‌گیری می‌کند: «زمانی که محدودیت‌های مصنوعی خروجی را حذف می‌کنیم، مدل‌های زبانی بزرگ توان استدلال درباره وظایف پیچیده را دارند؛ حداقل در زمینه تولید الگوریتم به این صورت است.»

01
از 01
اهمیت این جدال علمی درباره هوش مصنوعی

در نگاه نخست، این بحث شاید مانند اختلافات معمول در تحقیقات هوش مصنوعی به نظر برسد، اما اهمیت آن بیش از این است. مقاله اپل بارها به عنوان شاهدی بر این ادعا مطرح شده است که مدل‌های زبانی کنونی فاقد توانایی استدلال مقیاس‌پذیر هستند. اما لاوسن نشان می‌دهد که واقعیت می‌تواند پیچیده‌تر باشد: بله، مدل‌ها در شمارش طولانی توکن‌ها مشکل دارند، اما موتورهای استدلالی‌ آنها به اندازه‌ای شکننده نیست که مقاله اپل القا می‌کند.

البته این به معنای رفع مسئولیت از مدل‌ها نیست. حتی لاوسن اذعان می‌کند که تعمیم الگوریتم در عمل همچنان یک چالش است و نتایج آزمایش‌های او فعلا مقدماتی به حساب می‌آیند. او همچنین پیشنهادهایی برای تحقیقات آینده مطرح کرده است:

  • طراحی آزمون‌هایی که تفاوت میان توان استدلال و محدودیت خروجی را نشان دهد.
  • از قابل حل بودن پازل‌ها پیش از ارزیابی عملکرد مدل اطمینان حاصل شود.
  • از سنجه‌های پیچیدگی که دشواری محاسباتی را نشان دهد نه صرفاً طول راه‌حل را استفاده شود.
  • اشکال مختلف ارائه پاسخ برای تفکیک درک الگوریتمی از اجرای آن در نظر گرفته شود.

به گفته لاوسن، پرسش اصلی این نیست که آیا مدل‌های زبانی بزرگ می‌توانند استدلال کنند یا خیر؛ بلکه این است که آیا روش‌های ارزیابی ما می‌توانند تفاوت میان استدلال واقعی و صرفاً تایپ کردن خروجی را نشان دهند یا خیر.

سید محمد برازنده

سید محمد برازنده

کارشناسی مترجمی زبان فرانسه. از سال 87 تاکنون در حوزه های مختلف سابقه ترجمه دارم. بیش از یک سال هست که مترجم حوزه فناوری تو سایت تک ناک هستم.

مطالب مرتبط

سایه دو دست در حال استفاده از گوشی‌های هوشمند در مقابل لوگوی بزرگ واتس‌اپ.
شبکه های اجتماعی

ایتالیا دستور تعلیق سیاست محدودکننده چت‌بات‌های هوش مصنوعی رقیب در واتساپ را صادر کرد

نوشته شده توسط اسما کلهر
3 دی 1404
گوشی هوشمندی که آیکون رنگی جیمیل را روی پس‌زمینه‌ای با الگوی تکرار شونده حرف M نشان می‌دهد.
فناوری

گوگل امکان تغییر آدرس ایمیل @gmail.com را پس از سال‌ها محدودیت فعال می‌کند

نوشته شده توسط اسما کلهر
3 دی 1404
دست کاربر در حال نگه داشتن یک گوشی سامسونگ گلکسی با چیدمان دوربین سه‌گانه عمودی.
پیشنهاد سردبیر

سامسونگ گزینه عکاسی ۲۴ مگاپیکسلی را به گوشی‌های گلکسی اضافه می‌کند

نوشته شده توسط اسما کلهر
3 دی 1404
قدیمی‌ترین استخر استخراج بیت‌کوین
فناوری

قدیمی‌ترین استخر استخراج بیت‌کوین جهان ۱۵ ساله شد

نوشته شده توسط امیرحسین یونس
3 دی 1404
کلاژ تصویری از سم آلتمن، ایلان ماسک و یک مدیر تکنولوژی دیگر در مقابل یک پس‌زمینه سبز شطرنجی.
اخبار هوش مصنوعی

هشدار پزشکان: هوش مصنوعی رابطه‌ای سلامت روان کاربران را به خطر می‌اندازد

نوشته شده توسط امیرحسین یونس
3 دی 1404
خبر بعدی
چگونه در زمان جنگ آرامش روانی خود را حفظ کنیم؟

چگونه در زمان جنگ آرامش روانی خود را حفظ کنیم؟

دیدگاهتان را بنویسید لغو پاسخ

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

آذرآنلاین آذرآنلاین آذرآنلاین

پیشنهادی

ربات انسان‌نمای Unitree H2 حریف خود را ضربه‌فنی کرد!

ربات انسان‌نمای Unitree H2 حریف خود را ضربه‌فنی کرد! + ویدیو

18 آذر 1404
ایلان ماسک با تی‌شرت مشکی "Occupy Mars" در حال نشستن در داخل یکی از سوله‌های صنعتی اسپیس‌اکس.

اینترنت استارلینک به ۹ میلیون مشتری رسید؛ جذب ۲۰ هزار کاربر جدید روزانه

3 دی 1404

داغ‌ترین‌های روز

سامانه پدافند هوایی S-500 روسیه روی خودروی پرتابگر

پدافند هوایی S-500 روسیه رسما آغاز به کار کرد

29 آذر 1404
نقد و بررسی ASUS ROG Strix SCAR 18: قدرتمندترین لپ‌تاپ گیمینگ ۲۰۲۵؟

نقد و بررسی ASUS ROG Strix SCAR 18؛ قدرتمندترین لپ‌تاپ گیمینگ ۲۰۲۵

30 آذر 1404 - به‌روزشده در 1 دی 1404
نمای نزدیک از ساعت هوشمند Huawei Watch نسخه دهمین سالگرد با بدنه فلزی، تاج چرخان و صفحه نمایش دایره‌ای حاوی ویجت‌ های سلامت و زمان، تمرکز بر طراحی پریمیوم و رابط کاربری پیشرفته

هواوی نسخه دهمین سالگرد هواوی واچ را هم‌زمان با نوا ۱۵ معرفی می‌کند

26 آذر 1404
گلکسی A57 و A37؛ میان‌رده‌هایی که در قامت یک پرچم‌دار ظاهر می‌ شوند

گلکسی A57 و A37؛ میان‌رده‌هایی که در قامت یک پرچم‌دار ظاهر می‌ شوند

2 دی 1404
پرهزینه‌ترین فیلم‌های تاریخ سینما؛ گران‌ترین پروژه‌های هالیوود چگونه ساخته شدند؟

پرهزینه‌ترین فیلم‌های تاریخ سینما را بشناسید

30 آذر 1404
Technoc

دنیا با سرعتی خیره کننده به سمت تحقق رویاهایی می رود که تا دیروز دست نیافتنی و محال بود و بشر با گذر از دریایی از موانع یک به یک در حال تحقق آنها است.

ما در” تک ناک” تلاش می کنیم سهمی از انعکاس تحولات بی شمار فناوری و اخبار تکنولوژی داشته باشیم و در این کهکشان بی انتهای یافته های علمی و دانش محور محتوایی قابل اتکاء و اخباری موثق را از گوشه و کنار دنیا در اختیار علاقمندان و مخاطبان خود قرار دهیم.

ما را در شبکه های اجتماعی دنبال کنید

تازه‌ها

سایه دو دست در حال استفاده از گوشی‌های هوشمند در مقابل لوگوی بزرگ واتس‌اپ.

ایتالیا دستور تعلیق سیاست محدودکننده چت‌بات‌های هوش مصنوعی رقیب در واتساپ را صادر کرد

3 دی 1404
گوشی هوشمندی که آیکون رنگی جیمیل را روی پس‌زمینه‌ای با الگوی تکرار شونده حرف M نشان می‌دهد.

گوگل امکان تغییر آدرس ایمیل @gmail.com را پس از سال‌ها محدودیت فعال می‌کند

3 دی 1404
دست کاربر در حال نگه داشتن یک گوشی سامسونگ گلکسی با چیدمان دوربین سه‌گانه عمودی.

سامسونگ گزینه عکاسی ۲۴ مگاپیکسلی را به گوشی‌های گلکسی اضافه می‌کند

3 دی 1404
مانیتور گیمینگ ایسوس مدل ROG Swift OLED PG32UCDM از نمای جلو و پشت با نورپردازی RGB.

انتشار جزییات جدید از مانیتور پرچمدار ROG Swift ایسوس

3 دی 1404

دسترسی سریع

  • فناوری
  • کامپیوتر و موبایل
  • نقد و بررسی
  • آموزش
  • ارز دیجیتال
  • علمی
  • کسب و کار
  • وسائل نقلیه
  • بازی و سرگرمی
  • چند رسانه ای
  • صفحه اصلی
  • همه اخبار
  • تبلیغات تکناک
  • درباره ما
  • تماس با ما

© Copyright 2025 Technoc.ir

No Result
مشاهده تمامی نتایج
  • فناوری
    • اخبار هوش مصنوعی
    • رباتیک
    • اینترنت و شبکه
    • شبکه های اجتماعی
    • هوافضا
    • معماری
    • ورزش
    • رویداد ها
    • دوربین دیجیتال
  • کامپیوتر و موبایل
    • موبایل و تبلت
    • لپ تاپ و کامپیوتر
    • اپلیکیشن موبایل
    • نرم افزار
    • سخت افزار
    • ساعت هوشمند
    • مانیتور
    • اسپیکر و هدفون
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
  • نقد و بررسی
    • بررسی موبایل و تبلت
    • کنسول بازی
    • بررسی لپ تاپ و کامپیوتر
    • قطعات کامپیوتر
    • نرم افزار
    • بررسی اسپیکر و هدفون
    • بررسی ساعت هوشمند
  • آموزش
    • سیستم عامل موبایل
    • سیستم عامل کامپیوتر
    • آموزش هوش مصنوعی
    • سخت افزار
  • اخبار ارز دیجیتال
    • قیمت لحظه ای ارز دیجیتال
    • ماشین حساب ارز دیجیتال
    • آموزش ارز دیجیتال
  • علمی
    • سلامت و پزشکی
    • انرژی
    • فیزیک
    • شیمی
    • نجوم
    • ورزش
    • محیط زیست
    • باستان شناسی
  • کسب و کار
    • شرکت ها
    • بورس
    • مدیریت(پروژه، کسب و کار، منابع انسانی)
    • استارتاپ ها
    • دولت الکترونیک
    • رویداد کسب و کار
  • وسائل نقلیه
    • خودرو
    • دوچرخه
    • موتور سیکلت
    • قطار
    • هواپیما
  • بازی و سرگرمی
    • کنسول بازی های کامپیوتری
    • بازی های کامپیوتر
    • بازی کنسول
    • بازی موبایل
    • فیلم و سریال
  • چند رسانه ای
    • عکس
    • ویدئو
  • اخبار داخلی
    • دانش بنیان
    • دولت الکترونیک
    • رویداد داخلی
    • بازار
    • دانشگاه

© Copyright 2025 Technoc.ir