فهرست مطالب
گزارشی جدید از Project Lily نشان میدهد OpenAI برای بهبود ChatGPT از نیروی انسانی برای بررسی مکالمات کاربران و ارزیابی پاسخها استفاده میکند.
به گزارش سرویس هوش مصنوعی تکناک،نام پروژه امتیازدهی OpenAI، «Project Lily» است.
این رسانه به راهنماهای آموزشی پروژه، کانالهای Slack، مکالمات واقعی ChatGPT و سامانه امتیازدهی برای دستهبندی مکالمات دسترسی پیدا کرده است.
افرادی که این کار را انجام میدهند، «بررسیکنندگان پرامپت» نام دارند.
وظیفه آنها نسبتاً ساده است، آنها مکالمات واقعی و ناشناس کاربران را بررسی میکنند و کیفیت پاسخهای ChatGPT را میسنجند تا مشخص شود آیا پاسخ واقعاً به پرسش کاربر جواب داده است یا خیر.
آنها همچنین بررسی میکنند که متن بیش از حد از ادبیات مخصوص هوش مصنوعی، لحن تحقیرآمیز، ایموجی یا چاپلوسی استفاده نکند.
بررسیکنندگان همچنین باید مراقب انساننمایی بیش از حد مدل و بیان تجربههای شخصی باشند.
برای نمونه، ChatGPT میتواند بگوید «اطلاعاتی پیدا کردم»، اما نباید بگوید «بهعنوان یک سرآشپز، من این را دوست دارم» یا «میدانم این موضوع چه حسی دارد».
Project Lily و بررسی دستی مکالمات

یکی از بررسیکنندگان این کار را «بسیار تکراری» توصیف کرده است. با این حال، طبق گزارش، دستمزد این افراد بیش از ۵۰ دلار در ساعت است که برای کاری با این میزان سادگی، رقم قابلتوجهی محسوب میشود.
این فرد همچنین گفته است دستورالعملهای کاری دائماً تغییر میکنند و گاهی با یکدیگر تناقض دارند، مشکلی که بسیاری از توسعهدهندگان نرمافزار احتمالاً با آن آشنا هستند.
این بررسیکننده معتقد است بیشتر کاربران نمیدانند افراد دیگری ممکن است مکالمات آنها را بخوانند.
این موضوع بهویژه زمانی نگرانکننده است که کاربران از ChatGPT بهعنوان یک دوست یا درمانگر موقت استفاده میکنند و عمیقترین رازهای خود را در اختیار این چتبات قرار میدهند.
طبق گزارش، مکالمات پیش از ارسال برای بررسیکنندگان از فرایند ناشناسسازی عبور میکنند و نام کاربری افراد در اختیار آنها قرار نمیگیرد.
با این حال، OpenAI به 404 Media گفته است که این فیلتر ممکن است اجازه دهد برخی اطلاعات شخصی، بهویژه در مکالمات کوتاه، همچنان باقی بمانند.
بیشتر بخوانید: کافی است بپرسید؛ ChatGPT حالا داشبورد حرفهای میسازد
اطلاعات شخصی ممکن است در اختیار بررسیکنندگان قرار گیرد
404 Media همچنین اشاره کرده است که در بسیاری از مکالمات، کاربران از ChatGPT میخواهند محتوای گفتوگو را محرمانه نگه دارد.
نسخهای از مکالمه که در اختیار بررسیکنندگان قرار میگیرد، طبق این گزارش شامل «خلاصه حافظه کاربر» نیز میشود.
این خلاصه میتواند اطلاعاتی درباره پرسشها و علایق کاربر، زمینه مکالمات و حتی احتمالاً موقعیت مکانی او را در بر داشته باشد.
نکته مهم دیگر این است که Project Lily صحت واقعی اطلاعات موجود در پاسخها را ارزیابی نمیکند، مگر در مواردی که اشتباهات واضح وجود داشته باشد.
این موضوع نشان میدهد احتمالاً دستکم یک تیم دیگر یا چند تیم دیگر، ارزیابیهای جداگانهای را درباره صحت پاسخها انجام میدهند.
این فرایند همچنین با بررسیهای دستی ایمنی متفاوت است.
بررسیهای ایمنی برای تشخیص مواردی انجام میشوند که احتمال دارد کاربر قصد آسیب رساندن به فرد دیگری یا احتمالاً خودش را داشته باشد.
بیشتر بخوانید: ابزار ChatGPT Sites از راه رسید؛ ساخت و انتشار سایت فقط با دستور متنی
گزینه جلوگیری از استفاده از مکالمات گذشته
وجود Project Lily نشان میدهد برخلاف تصویری که شرکتهای هوش مصنوعی معمولاً درباره پیشرفت فناوری و مدلهای خود ارائه میکنند، بهبود مدلها فقط با پیشرفت فناوری و مجموعهدادههای بهتر انجام نمیشود و همچنان به حضور تعداد قابلتوجهی نیروی انسانی متخصص نیاز دارد.
احتمالاً بسیاری از کاربران با گزینهای شبیه «اجازه دهید از مکالمات شما برای بهبود محصول استفاده کنیم» در چتباتهای عمومی مواجه شدهاند.
طبق گزارش، این گزینه در بیشتر چتباتهای مصرفکننده بهصورت پیشفرض فعال است و حتی بسیاری از طرحهای پولی نیز از همین رویه استفاده میکنند.
در ChatGPT، این گزینه برای مشتریان Enterprise، Business و Educational بهصورت پیشفرض غیرفعال است.
با این حال، تغییر این گزینه بهصورت عطفبهماسبق عمل نمیکند.
بنابراین مکالماتی که پیشتر در پایگاه داده ChatGPT ذخیره شدهاند، همچنان باقی میمانند، مگر اینکه کاربر درخواست حذف آنها را ارائه کند.
حذف مکالمات نیز بهصورت عطفبهماسبق عمل نمیکند، زیرا ممکن است گفتوگوهای حذفشده پیش از آن جمعآوری و ناشناسسازی شده باشند و در یک مجموعهداده باقی مانده باشند.
OpenAI درباره اطلاعرسانی به کاربران توضیح داد
OpenAI در ابتدا پاسخی درباره این پرسش 404 Media که آیا کاربران بهطور مشخص از امکان خوانده شدن مکالماتشان توسط انسانها مطلع میشوند یا خیر، ارائه نکرد.
این شرکت در نهایت لینکی به یکی از صفحات پرسشهای متداول خود ارائه کرد که بررسی انسانی مکالمات برای بهبود مدل را توضیح میدهد.
404 Media اعلام کرده است که این اطلاعرسانی دستکم دو سال قدمت دارد و احتمالاً حتی قدیمیتر است.
پس از انتشار این گزارش، OpenAI صفحه راهنمای خود درباره نحوه انصراف کاربران از جمعآوری دادهها را تغییر داد، اما در این متن اشارهای به بررسی مکالمات توسط نیروی انسانی نشده است.
این نوع جمعآوری و بررسی دادهها فقط به OpenAI محدود نمیشود.
گوگل Gemini بهصراحت اعلام میکند که «ممکن است انسانها برخی مکالمات ذخیرهشده را بررسی کنند» و Anthropic نیز صفحهای اختصاصی درباره این موضوع دارد.
وضعیت Perplexity اما روشن نیست، زیرا سیاست حفظ حریم خصوصی این شرکت نه دسترسی انسانها به لاگهای مکالمات را تأیید میکند و نه آن را رد میکند.

















